GitHub 趋势洞察 2026-08-21,token 账单打出来了,穴居人语法、拼车网关和红队靶场同日上榜
- caveman 以穴居人语法让 agent 说短句,砍掉约 65% 输出 token,代码命令错误原样保留,10 万星冲到第 11 位。
- 它的 Proxy 组件进一步压输入,54 轮基准测试省 33.2%,Pixel 模式把 markdown 转成 PNG 给模型读,自家 skill 再省 61%。
- sub2api 把 Claude、Codex、Gemini、Grok 订阅转成标准 API 网关,内置支付宝微信 Stripe,3.8 万星但明确警告可能违反上游服务条款。
- 腾讯朱雀实验室的 AI-Infra-Guard 全栈红队平台上榜,skill-scan 在 SkillTrustBench 拿到 F1 0.9848,登上过 Black Hat Europe。
- openai/codex 以 Rust 实现、CDN 优先安装器和桌面云三形态冲到第 2,官方也在把 agent 的使用成本和体验往工程化里压。
今日焦点,狂欢一年,账单到了
agent 们开了一年的派对,今晚榜单上全是收拾账单的人。
三个证据摆在一起看。caveman 第 11 位,一个让 AI 说穴居人话省 token 的 skill,10 万星。sub2api 第 10 位,把买好的订阅转成 API 给一群人拼车用,3.8 万星。AI-Infra-Guard 第 19 位,腾讯朱雀实验室的全栈 AI 红队平台。
省的省,分的分,查的查。
这三件事同时上榜不是巧合。agent 编码工具普及到第二年,token 从演示时的无限幻觉变成了账单上的真金白银,安全审计也从可选项变成了上线前的必答题。榜单是行业情绪的最诚实快照。
背景板上还有 openai/codex 冲到第 2,+3,626 星,官方自己的 agent 也在卷成本和体验。
榜单前五深度解读
1. caveman,为什么用很多 token,当少 token 就行
这个项目的灵魂是那句 tagline,why use many token when few token do trick。
它是一个 Claude Code skill,让 agent 用极简的电报式风格说话,砍掉约 65% 的输出 token,同时代码、命令、报错信息一字不动。lite、full、ultra 三档压缩强度,带子 agent 预设和 commit、review 的精简模式。30 多个 agent 都兼容。
2.0 版把刀伸向了输入侧。Caveman Proxy 是个本地代理,在每次请求发给模型前压缩输入,官方 54 轮固定基准里省 33.2% 输入 token,号称字节级精确恢复。原生包裹 Claude Code、Codex、Gemini、Aider 等 8 个 agent,零配置改动。
最疯的是 Pixel 模式,把 skill 的 markdown 正文转成 PNG 图片让模型读图,他们拿自己的 skill 试,再省 61%。还有压缩浏览,比 Playwright 基线小约 130 倍。
真正让它立住的是诚实。README 里专门有一段「诚实数字警告」,承认 skill 只省输出、每轮反而多加约 1 到 1.5k 输入 token,对本就话少的任务可能净亏。一个 meme 项目把基准和免责声明做得比多数正经理财产品还规范,这就是它能到 10 万星的原因。
2. sub2api,订阅拼车的灰色工程学
它把 Claude、OpenAI Codex、Gemini、Grok 的付费订阅转换成标准 API 端点。平台发 key,管认证、计费、负载均衡、请求转发,Token 级计费、粘性会话调度、并发限流一应俱全,甚至内置了 Stripe、支付宝、微信支付。
技术栈是 Go 加 Gin 加 Ent,前端 Vue 3,PostgreSQL 加 Redis,一条命令部署,macOS 26 还能跑 Apple containers。支持 Claude Code 的 OAuth 订阅、Codex 的 Responses WebSocket 接入、Grok 的图片视频生成端点。6,086 个 commit,8k fork。
有意思的是它的自我定位,一个用于学习和研究的开源网关,README 用加粗字体警告使用可能违反 Anthropic 等上游的服务条款。3.8 万星投出来的需求是真实的,订阅制的额度闲置和 API 的按量付费之间的价差,就是这门生意的全部空间。
3. AI-Infra-Guard,腾讯朱雀把红队靶场开源了
Apache 2.0,腾讯朱雀实验室出品,全栈 AI 红队平台。它扫四类目标,存活的服务和基础设施、MCP 服务器、Agent Skills、Dify 和 Coze 上的工作流。
技能扫描是招牌。skill-scan 把风险分成 14 类,映射 SkillTrustBench 的 T01 到 T09 分类法,指令劫持、记忆投毒、提权、工具伪装都在内,那个基准上 F1 高到 0.9848。基础设施扫描覆盖 100 多个框架组件对 2000 多条 CVE 规则。越狱评估内置 Many-Shot、PAIR、GOAT、ActorAttack 多轮攻击战术。
工程化程度也够,skill-scan、mcp-scan、agent-scan 各有独立 CLI 可以进 CI/CD,YAML 指纹和规则库开放社区共建。它上过 Black Hat Europe 2025 的 Arsenal,讲 MCP Unchained 协议风险研究,被 NVIDIA、Google、微软、Hugging Face 致谢过漏洞修复,DeepSeek、工商银行、B 站在用。
license 有个小钩子,重打包成自有产品不注明出处是被明令禁止的。
4. openai/codex,官方 agent 的工程化加速
第 2 位,+3,626,总 110,604。仓库里 codex-rs 目录坐实了 Rust 实现,发布物是 musl 静态链接的 Linux 包加 aarch64 Apple 包,Rust CLI 的标配。
最近的变化都在分发和形态上。新的独立安装器默认走 releases.openai.com 的 CDN 再回落 GitHub,npm 和 brew 一条命令装齐。形态铺满了 IDE 扩展(VS Code、Cursor、Windsurf)、桌面应用、云端 Codex Web,ChatGPT 订阅直接登录。9,647 个 commit,5k+ open issues,旗舰仓库的活跃度。
5. modular,五万个 commit 的语言平台
第 7 位,+905。Mojo 语言加 MAX 推理框架的组合,编译器、标准库、加速核、推理服务一体,OpenAI 兼容端点。53,766 个 commit 的工程纵深,Apache 2.0 加 LLVM 例外许可。当大家都在应用层卷 agent,还有人在一层一层往下重写地基。
趋势分析
token 成本意识元年
caveman 的 10 万星是标志事件。去年大家讨论 token 是讨论能力上限,今年讨论的是账单下限。省 token 从工程细节变成了产品卖点,输出压缩、输入压缩、图像化读取,每条路都有人趟。接下来会有更多「token 会计」类工具,按会话、按 repo、按任务算成本归因。
订阅与 API 的价差催生灰色市场
sub2api 的火爆是个价格信号。厂商把订阅和 API 定成两套价格,中间的套利空间就一定有人填。工具本身是中性的工程,风险全在条款侧,拼车党的规模越大,上游收紧的概率越高,这个猫鼠游戏今年内会见分晓。
安全审计从可选项变成必答题
AIG 上榜说明企业侧的心态变了。agent 接了内网、读了文档、调了工具,上线前不红队一遍谁都不敢签字。skill 扫描的 F1 卷到 0.98 以上,说明这已经是正经的检测工程,不是写两页 checklist 的年代了。
值得关注的潜力项目
DietrichGebert/ponytail(第 16 位)
让 agent 像最懒的资深工程师一样思考,最好的代码是没写的那行。8 月初见过它一次,9.6 万星还在涨。跟 caveman 是同一枚硬币,一个省 token,一个省代码量,懒人哲学全面进军 agent 层。
Panniantong/Agent-Reach(第 23 位)
agent 相关的新面孔,名字直白。agent 间通信和触达这个方向,这个月已经见了好几个项目,基础设施化趋势明确。
ripienaar/free-for-dev(第 14 位)
免费开发者服务清单,老牌常青树每逢成本焦虑就回榜。它在 2015 年就是省钱的答案,2026 年还在,省钱的需求从不退潮。
完整榜单
写在最后
三点收束。
第一,caveman 用 10 万星证明,成本焦虑是当下最大的真实需求,一个 meme 的外壳加一套诚实的基准,比正经发布会更能击中开发者。
第二,sub2api 的存在是价格双轨制的必然,填价差的工具永远会有,值得关注的不是工具本身,而是上游什么时候、用什么方式收紧。
第三,红队平台进趋势榜意味着 agent 安全完成了从「安全团队的事」到「工程团队的事」的转移,上线前扫一遍会变成像跑测试一样自然的步骤。
一个总判断,接下来一个季度的明星项目会出现在「给 agent 省钱」和「给 agent 上保险」这两条赛道上。能力层的军备竞赛暂时见顶,账单层的战争刚刚开打。

评论互动