GitHub 趋势洞察 2026-08-25,dsh 卫冕榜单大换血,tobi 把 git 托管塞进了对象存储

发布于 · 3,609 字 · 约 9 分钟#Github 解读#Agent 框架
GitHub 趋势洞察 2026-08-25,dsh 卫冕榜单大换血,tobi 把 git 托管塞进了对象存储 封面图
  • deepseek-harness 以 +2,939 全天霸榜完成卫冕,总星 194,645 领先 codex 约 7.7 万
  • 榜单对凌晨快照换血 12 席,VoltAgent 聚合器一天掉榜,skill 生态仍在高震期谈不上收口
  • FreeToken 是本地 MoE 推理引擎而非免费代理,作者团队含 Song Han、Matei Zaharia、Ion Stoica
  • tobi(Shopify CEO)开源 walgit,把 Cursor Continuity 的 WAL 即仓库架构落成单二进制
  • gods-eye-view 用 CesiumJS 加 13 层公开数据在浏览器里复刻间谍卫星驾驶舱,单日冲上第 2

2026 年 8 月 25 日 · 本期共收录 25 个热门开源项目

数据为 08-25 全天晚间快照(00:56 重抓),已取代凌晨早间版

今日焦点,一天之内,榜单换了一半人

讲真,把凌晨抓的快照和这份晚间快照放一起看,第一反应是揉眼睛。25 个席位换了 12 个,凌晨的第 2 名 awesome-gpt-image-2 退到第 4,昨天刚写过的聚合器 VoltAgent 直接掉榜,连 hermes-agent、OpenLogi、unlazy 这些熟脸都不见了。换血一半,这不是榜单,这是绞肉机。

不变的是冠军。deepseek-harness 以 +2,939 继续霸榜,从凌晨快照到晚间快照全天第一,总星 194,645,对第三周期上榜的 codex 拉开 76,689 颗星。怎么讲,harness 冠军战打了三周,第一次出现全天无争议的领跑者。

新故事也有三个。第 2 名是个叫 gods-eye-view 的项目,在浏览器里复刻间谍卫星驾驶舱,全部用公开数据。第 3 名 FreeToken 挖开一看根本不是名字暗示的免费 token 代理,是在游戏本上跑 290B MoE 的本地推理引擎,作者名单里有 Song Han 和 Ion Stoica。还有个藏在第 21 位的小仓库 walgit,作者是 tobi,Shopify 的 CEO。

榜单前五深度解读

1. deepseek-ai/deepseek-harness · TypeScript · +2,939 · 194,645

卫冕日,把之前几轮没展开的工程决策补齐。这个 194k 星的仓库不打版本号不发 release,所有开发直接走 master,README 用全大写警告兼容性随时会碎,Issue 面板关闭,反馈全走 GitHub Discussions 加 Discord,外加 deepseek.com/harness 产品页。把讨论场域收拢到自己手里,这套社区运营在开源大项目里很少见。

工程化密度值得单独说。根目录一份 BENCHMARK.md 开始用基准数据说话,patches/ 和 vendor/ 目录装着打过补丁的依赖,tsdown 构建、oxlint 双配置、lefthook 钩子、jscpd 查重、GitHub CI 和 GitLab CI 双轨,Vitest 拆了 e2e、快照、web、web 压测、web 性能五套测试矩阵。22,069 个 fork 说明插件开发现役开发者的盘子在扩大。我一直觉得,dsh 现在的领先不是功能领先,是 dsh-plugin topic 这个自发生态的护城河,星数只是它的投影。

2. bilawalsidhu/gods-eye-view · - · +2,164 · 2,786

God's Eye View,浏览器里的间谍卫星模拟器,区别是数据全真。Google Photorealistic 3D Tiles 做地球底座,CesiumJS 做渲染,叠加 13 层实时公开数据,飞机航班走 OpenSky 和 adsb.lol,约 840 颗卫星用 CelesTrak 的 TLE 加 SGP4 外推,地震用 USGS,火情用 NASA FIRMS,还有约 800 个公共摄像头和 750 个地理定位电台。13 层里 10 层不需要任何 API key,克隆下来就能玩。

作者是 YouTube 创作者 Bilawal Sidhu,同系列视频 500 万以上播放,这个仓库是他把闭源的 WorldView 项目开源的结果,目前只有 4 个 commit 就冲到 2,786 星。工程上有几个真功夫,渲染滞后一个轮询周期靠插值加惯性外推补齐 15 到 30 秒的数据断档,图标朝向用逐帧屏幕空间投影保证任何相机角度下指向为真,卫星轨道环用格林尼治恒星时对齐。驾驶舱模式可以搭乘真实航班,传感器风格有夜视、前视红外、CRT 等 GLSL 着色器,语音 Agent 接 OpenAI Realtime 带 28 个工具,会话内消费封顶 5 美元。README 里有一句立场很硬的话,People are not a query type here,不做人名搜索不做人脸识别不做个体追踪,越界的 PR 不收。坦白讲,一个玩具项目把数据伦理写进贡献守则,这份自觉比技术本身稀缺。

3. FlashML-org/FreeToken · Python · +1,869 · 6,999

名字起得像免费 token 代理,挖开是完全另一回事。这是一个本地推理引擎,宣称在游戏本上跑 290B 以上参数的前沿 MoE 模型,CPU、GPU、主机内存、互联带宽被当成一个弹性推理平台统一调度。核心机制包括带宽自适应的 CPU-GPU 协同执行,专家放在带宽最优的位置,全层双缓冲预填充流式处理,全局 LRU 专家缓存,还有一个叫 FTW 的快速权重格式。对 Agent 场景的优化很具体,语义锚点检查点让工具调用和思考块这类上下文编辑跳过冗余重算,显存管理可以在运行时动态再平衡专家缓存和 KV 之间的分配,不用重启不重载权重。

模型支持 DeepSeek-V4-Flash、Qwen3.6-35B-A3B、GLM-5.2,量化覆盖 MXFP4、NVFP4、FP8、BF16,硬件瞄准 RTX 30/40/50 系,对外暴露 Anthropic 和 OpenAI 兼容 API,Codex、Claude Code、OpenCode 可以直接接。作者阵容离谱,Song Han、Kurt Keutzer、Matei Zaharia、Ion Stoica,arXiv 论文编号 2608.16157,代码复用了 SGLang、vLLM、FlashInfer 的成果并逐一署名。说真的,这个项目把「白嫖」这件事的工程上限抬到了重写推理栈的高度,免费 token 不是从云厂商额度里抠的,是自己硅上算出来的。

4. MadsLorentzen/ai-job-search · Python · +1,266 · 35,037

从凌晨快照的第 23 位一路爬到第 5,全天加速。作者是个被裁的地球物理学家,靠这套跑在本机上的 Claude Code 求职框架拿到了 AI 工程师 offer。核心是 /apply 流水线,drafter Agent 起草 LaTeX 简历和求职信,另起一个干净上下文的 reviewer Agent 调研公司挑毛病,起草方修改后编译 PDF,然后视觉检查循环迭代,直到简历整两页信整一页,最后用 pdftotext 提取文本层做 ATS 检查,按招聘解析器的视角查联系方式、阅读顺序和关键词覆盖。简历裁剪按岗位相关度加权打分而不是从头删起,没有依据的技能标记为缺口而不是硬塞。

12,080 个 fork 是被设计出来的,仓库定位是复刻后私有化,README 明确警告公开 fork 会泄露个人资料,建议私有仓库加 upstream 跟踪。你想想看,一个求职工具用 fork 数证明了自己被多少人真实使用,这个指标比星数诚实。

5. tobi/walgit · Rust · +418 · 1,450

排在第 21 位,但这是今天最值得单说的仓库,作者是 tobi,Tobias Lütke,Shopify 的 CEO。walgit 是一个 Rust 写的 git 服务器,单个二进制,前面跑一个 S3 或 GCS 桶,没有数据库,没有 leader,没有需要维护的本地状态。名字来自 WAL 加 git,写前日志存在对象存储里,日志本身就是仓库,README 的中心句是 the bucket is the repository,本地磁盘和内存只是缓存。

架构上它落地了 Cursor 那篇 Git at any scale 博文里的 Continuity 设计,push 是不可变对象,通过一个极小 manifest 上的比较并交换操作才对外可见,这个 CAS 就是共识本身,不用选主不用法定人数,任何实例都能收 push,竞争实例只有一个能赢。在此之上还有小机器扩展,本地放不下的仓库通过 HTTP Range 请求远程读取,history pack 把提交和树留在本地、blob 留在桶里,bundle-uri 让全新克隆直接从 CDN 静态文件走。README 强调每次读都先对桶做校验,不存在最终一致。整个仓库目前 3 个 commit,1,450 星。其实吧,一个市值千亿公司的 CEO 下场写 Rust,把论文架构一个人落成单二进制,这个信号比仓库本身大,大佬的个人产能开始直接进入开源市场。

趋势分析

token 成本战争开出了两条战线

同一张榜上,token 省钱这件事出现了两种完全不同的解法。一种在云端做聚合,freellmapi 排名 22,把 28 家 LLM 供应商的免费层堆在一个 OpenAI 兼容端点后面,每月约 4B token,带智能路由和自动故障转移,free-claude-code 排名 13 继续 49,633 星的量级。另一种在本地重写推理栈,FreeToken 让 290B MoE 在消费级显卡上跑出交互速度,把每 token 成本压到电费。我一直觉得这两条路线的并存说明一件事,Agent 工作流的 token 消耗已经大到让「省钱」本身成为一个工程学科,云端抠额度是战术,本地重造推理是战略,中间还夹着 dsh 和 codex 的订阅绑定。判断很直接,成本层的创新速度会超过模型层,因为它离账单最近。

Skill 生态没有收口,还在高震

昨天凌晨版我写过 Skill 生态开始收口的判断,晚间数据要求修正这个结论。证据很直接,收口叙事的标志性项目 VoltAgent 聚合器一天之内掉榜,anthropics 官方插件市场也没了踪影,可另一边 karpathy 四规则升到第 10 位总星 207,037,ponytail 第 8 位 110,630,新进场的还有 archify、claude-obsidian、headlong 三种完全不同形态的 Skill 项目。说明什么,说明单日 trending 测的是瞬时热度,不是生态格局,Skill 品类的新陈代谢周期已经短到以天计。坦白讲,这个速度下任何「格局已定」的判断都活不过一个快照周期,能确定的只有一件事,这个品类的内容供给过剩了,缺的仍然是有粘性的分发和真正解决痛点的技能。

今天榜单上有个隐含名单。tobi 用 3 个 commit 的 walgit 教科书级实现 Cursor 的 Continuity 架构,basecamp 的 omarchy 排名 7 连续第二天在榜冲向 31,000 星,创作者 Bilawal Sidhu 用 4 个 commit 换 2,786 星。三位都是各自领域有存量信誉的人,开源仓库成了他们信誉的直接变现通道,星数增速远超普通项目。怎么说呢,名人开源不新鲜,新鲜的是他们交的作业不再是玩具,walgit 的 CAS 共识和 omarchy 的发行级完成度都是硬货。判断是,个人信誉流量会持续注入开源市场,中小项目在 trending 上的曝光竞争会因此更卷,护城河只能来自持续的工程交付而不是首发声量。

值得关注的潜力项目

AgriciDaniel/claude-obsidian · Python · +810 · 12,491

基于 Karpathy 的 LLM Wiki 模式给 Claude Code 做的第二大脑,任何来源丢进 inbox,原始件先做内容寻址的不可变存档,然后 LLM 阅读建链归档成你拥有的纯 Markdown 知识图谱。工程自觉拉满,声明账本要求高风险论断有两个独立来源,无支撑论断保持可见而不是静默丢弃,所有写入走事务,并行 Agent 只交草稿,单一编排者合并后按 approved_plan_sha256 哈希审核才落盘,vault 锁加原子替换加日志化备份。检索用确定性的 BM25 加可选重排,默认不出网。12,491 星还在爬。

tt-a1i/archify · HTML · +676 · 15,924

一个专门出图的 Agent Skill,做架构图、工作流、时序图、数据流图、生命周期图,产物是自带动效的自包含 HTML,导出清晰。定位踩得很准,Agent 写代码在行画图翻车,而架构沟通恰恰是工程协作里最高频的图需求。15,924 星说明这个痛点足够普遍,值得盯它能不能成为图表类 Skill 的事实标准。

laude-institute/headlong · Shell · +457 · 530

自称 Agent 微 harness,卖点是持久 agency 和递归 LLM,口号直接引用林肯句式,of bash, by bash, for bash, it's shells all the way down。Laude Institute 出品,Shell 写的,总星才 530 刚起步。在所有 harness 都在做重客户端的时候,反其道用纯 bash 做持久化 Agent 运行时,这个极端路线要么死掉要么成为传奇,值得提前放进观察列表。

完整榜单

排名仓库语言今日新增总 Stars
1deepseek-ai/deepseek-harnessTypeScript+2,939194,645
2bilawalsidhu/gods-eye-view-+2,1642,786
3FlashML-org/FreeTokenPython+1,8696,999
4freestylefly/awesome-gpt-image-2JavaScript+1,69817,252
5MadsLorentzen/ai-job-searchPython+1,26635,037
6openai/codexRust+1,183117,956
7basecamp/omarchyShell+1,08030,970
8DietrichGebert/ponytailJavaScript+944110,630
9arvids-unavailable/openGymJavaScript+8714,819
10multica-ai/andrej-karpathy-skills-+828207,037
11AgriciDaniel/claude-obsidianPython+81012,491
12b-nnett/grok-bot-0.18-reconstructedTypeScript+7662,378
13Alishahryar1/free-claude-codePython+72949,633
14tt-a1i/archifyHTML+67615,924
15stablyai/orcaTypeScript+63653,435
16rohitg00/ai-engineering-from-scratchPython+57248,779
17tinyhumansai/openhumanRust+54137,628
18apache/makaTypeScript+5383,219
19laude-institute/headlongShell+457530
20pathwaycom/arc-task-genPython+4505,887
21tobi/walgitRust+4181,450
22tashfeenahmed/freellmapiTypeScript+41220,138
23ControllerBolt57/RX-Audio-Editor-+400545
24ApodexAI/FrontierAgentPython+391469
25bryllim/workout-guideAstro+385405

写在最后

三点收束。

第一,快照会骗人,全天数据才会说话。凌晨版和晚间版换血 12 席,昨天关于收口的判断今天就被打脸。做趋势分析的人要记住,trending 是热度的微分,不是格局的积分,单日榜单上的任何叙事都标着保质期。

第二,token 成本已经是一个独立工程学科。FreeToken 在硅上重写推理栈,freellmapi 在云端堆免费层,两条路线同榜说明需求侧足够宽。对做 Agent 产品的人,成本层的设计该提到和模型选型同一优先级。

第三,个人信誉正在成为开源市场的新货币。tobi 三个 commit 换 1,450 星,Bilawal Sidhu 四个 commit 换 2,786 星,omarchy 靠 basecamp 的招牌连续霸榜。声量可以借,交付还不了,这些仓库的共同点是第一次亮相就带着完成度。

一个总判断。这期榜单真正的主题不是哪个项目冲得高,是速度本身,生态换血以天计,叙事保质期以小时计,大佬和学生在同一张榜上抢位置。在这样的市场里,能带走的方法论只有一条,别把任何单日结论当资产,把可复算的数据管道和快速修正的写作流程当资产。这份榜单日报自己也在实践这件事,凌晨版发出去,晚间版推倒重来,错就认,认了就改。

评论互动

© 2026 王若风的技术博客 · Powered by Astro