GitHub 趋势洞察 2026-08-25,dsh 卫冕榜单大换血,tobi 把 git 托管塞进了对象存储
- deepseek-harness 以 +2,939 全天霸榜完成卫冕,总星 194,645 领先 codex 约 7.7 万
- 榜单对凌晨快照换血 12 席,VoltAgent 聚合器一天掉榜,skill 生态仍在高震期谈不上收口
- FreeToken 是本地 MoE 推理引擎而非免费代理,作者团队含 Song Han、Matei Zaharia、Ion Stoica
- tobi(Shopify CEO)开源 walgit,把 Cursor Continuity 的 WAL 即仓库架构落成单二进制
- gods-eye-view 用 CesiumJS 加 13 层公开数据在浏览器里复刻间谍卫星驾驶舱,单日冲上第 2
2026 年 8 月 25 日 · 本期共收录 25 个热门开源项目
数据为 08-25 全天晚间快照(00:56 重抓),已取代凌晨早间版
今日焦点,一天之内,榜单换了一半人
讲真,把凌晨抓的快照和这份晚间快照放一起看,第一反应是揉眼睛。25 个席位换了 12 个,凌晨的第 2 名 awesome-gpt-image-2 退到第 4,昨天刚写过的聚合器 VoltAgent 直接掉榜,连 hermes-agent、OpenLogi、unlazy 这些熟脸都不见了。换血一半,这不是榜单,这是绞肉机。
不变的是冠军。deepseek-harness 以 +2,939 继续霸榜,从凌晨快照到晚间快照全天第一,总星 194,645,对第三周期上榜的 codex 拉开 76,689 颗星。怎么讲,harness 冠军战打了三周,第一次出现全天无争议的领跑者。
新故事也有三个。第 2 名是个叫 gods-eye-view 的项目,在浏览器里复刻间谍卫星驾驶舱,全部用公开数据。第 3 名 FreeToken 挖开一看根本不是名字暗示的免费 token 代理,是在游戏本上跑 290B MoE 的本地推理引擎,作者名单里有 Song Han 和 Ion Stoica。还有个藏在第 21 位的小仓库 walgit,作者是 tobi,Shopify 的 CEO。
榜单前五深度解读
1. deepseek-ai/deepseek-harness · TypeScript · +2,939 · 194,645
卫冕日,把之前几轮没展开的工程决策补齐。这个 194k 星的仓库不打版本号不发 release,所有开发直接走 master,README 用全大写警告兼容性随时会碎,Issue 面板关闭,反馈全走 GitHub Discussions 加 Discord,外加 deepseek.com/harness 产品页。把讨论场域收拢到自己手里,这套社区运营在开源大项目里很少见。
工程化密度值得单独说。根目录一份 BENCHMARK.md 开始用基准数据说话,patches/ 和 vendor/ 目录装着打过补丁的依赖,tsdown 构建、oxlint 双配置、lefthook 钩子、jscpd 查重、GitHub CI 和 GitLab CI 双轨,Vitest 拆了 e2e、快照、web、web 压测、web 性能五套测试矩阵。22,069 个 fork 说明插件开发现役开发者的盘子在扩大。我一直觉得,dsh 现在的领先不是功能领先,是 dsh-plugin topic 这个自发生态的护城河,星数只是它的投影。
2. bilawalsidhu/gods-eye-view · - · +2,164 · 2,786
God's Eye View,浏览器里的间谍卫星模拟器,区别是数据全真。Google Photorealistic 3D Tiles 做地球底座,CesiumJS 做渲染,叠加 13 层实时公开数据,飞机航班走 OpenSky 和 adsb.lol,约 840 颗卫星用 CelesTrak 的 TLE 加 SGP4 外推,地震用 USGS,火情用 NASA FIRMS,还有约 800 个公共摄像头和 750 个地理定位电台。13 层里 10 层不需要任何 API key,克隆下来就能玩。
作者是 YouTube 创作者 Bilawal Sidhu,同系列视频 500 万以上播放,这个仓库是他把闭源的 WorldView 项目开源的结果,目前只有 4 个 commit 就冲到 2,786 星。工程上有几个真功夫,渲染滞后一个轮询周期靠插值加惯性外推补齐 15 到 30 秒的数据断档,图标朝向用逐帧屏幕空间投影保证任何相机角度下指向为真,卫星轨道环用格林尼治恒星时对齐。驾驶舱模式可以搭乘真实航班,传感器风格有夜视、前视红外、CRT 等 GLSL 着色器,语音 Agent 接 OpenAI Realtime 带 28 个工具,会话内消费封顶 5 美元。README 里有一句立场很硬的话,People are not a query type here,不做人名搜索不做人脸识别不做个体追踪,越界的 PR 不收。坦白讲,一个玩具项目把数据伦理写进贡献守则,这份自觉比技术本身稀缺。
3. FlashML-org/FreeToken · Python · +1,869 · 6,999
名字起得像免费 token 代理,挖开是完全另一回事。这是一个本地推理引擎,宣称在游戏本上跑 290B 以上参数的前沿 MoE 模型,CPU、GPU、主机内存、互联带宽被当成一个弹性推理平台统一调度。核心机制包括带宽自适应的 CPU-GPU 协同执行,专家放在带宽最优的位置,全层双缓冲预填充流式处理,全局 LRU 专家缓存,还有一个叫 FTW 的快速权重格式。对 Agent 场景的优化很具体,语义锚点检查点让工具调用和思考块这类上下文编辑跳过冗余重算,显存管理可以在运行时动态再平衡专家缓存和 KV 之间的分配,不用重启不重载权重。
模型支持 DeepSeek-V4-Flash、Qwen3.6-35B-A3B、GLM-5.2,量化覆盖 MXFP4、NVFP4、FP8、BF16,硬件瞄准 RTX 30/40/50 系,对外暴露 Anthropic 和 OpenAI 兼容 API,Codex、Claude Code、OpenCode 可以直接接。作者阵容离谱,Song Han、Kurt Keutzer、Matei Zaharia、Ion Stoica,arXiv 论文编号 2608.16157,代码复用了 SGLang、vLLM、FlashInfer 的成果并逐一署名。说真的,这个项目把「白嫖」这件事的工程上限抬到了重写推理栈的高度,免费 token 不是从云厂商额度里抠的,是自己硅上算出来的。
4. MadsLorentzen/ai-job-search · Python · +1,266 · 35,037
从凌晨快照的第 23 位一路爬到第 5,全天加速。作者是个被裁的地球物理学家,靠这套跑在本机上的 Claude Code 求职框架拿到了 AI 工程师 offer。核心是 /apply 流水线,drafter Agent 起草 LaTeX 简历和求职信,另起一个干净上下文的 reviewer Agent 调研公司挑毛病,起草方修改后编译 PDF,然后视觉检查循环迭代,直到简历整两页信整一页,最后用 pdftotext 提取文本层做 ATS 检查,按招聘解析器的视角查联系方式、阅读顺序和关键词覆盖。简历裁剪按岗位相关度加权打分而不是从头删起,没有依据的技能标记为缺口而不是硬塞。
12,080 个 fork 是被设计出来的,仓库定位是复刻后私有化,README 明确警告公开 fork 会泄露个人资料,建议私有仓库加 upstream 跟踪。你想想看,一个求职工具用 fork 数证明了自己被多少人真实使用,这个指标比星数诚实。
5. tobi/walgit · Rust · +418 · 1,450
排在第 21 位,但这是今天最值得单说的仓库,作者是 tobi,Tobias Lütke,Shopify 的 CEO。walgit 是一个 Rust 写的 git 服务器,单个二进制,前面跑一个 S3 或 GCS 桶,没有数据库,没有 leader,没有需要维护的本地状态。名字来自 WAL 加 git,写前日志存在对象存储里,日志本身就是仓库,README 的中心句是 the bucket is the repository,本地磁盘和内存只是缓存。
架构上它落地了 Cursor 那篇 Git at any scale 博文里的 Continuity 设计,push 是不可变对象,通过一个极小 manifest 上的比较并交换操作才对外可见,这个 CAS 就是共识本身,不用选主不用法定人数,任何实例都能收 push,竞争实例只有一个能赢。在此之上还有小机器扩展,本地放不下的仓库通过 HTTP Range 请求远程读取,history pack 把提交和树留在本地、blob 留在桶里,bundle-uri 让全新克隆直接从 CDN 静态文件走。README 强调每次读都先对桶做校验,不存在最终一致。整个仓库目前 3 个 commit,1,450 星。其实吧,一个市值千亿公司的 CEO 下场写 Rust,把论文架构一个人落成单二进制,这个信号比仓库本身大,大佬的个人产能开始直接进入开源市场。
趋势分析
token 成本战争开出了两条战线
同一张榜上,token 省钱这件事出现了两种完全不同的解法。一种在云端做聚合,freellmapi 排名 22,把 28 家 LLM 供应商的免费层堆在一个 OpenAI 兼容端点后面,每月约 4B token,带智能路由和自动故障转移,free-claude-code 排名 13 继续 49,633 星的量级。另一种在本地重写推理栈,FreeToken 让 290B MoE 在消费级显卡上跑出交互速度,把每 token 成本压到电费。我一直觉得这两条路线的并存说明一件事,Agent 工作流的 token 消耗已经大到让「省钱」本身成为一个工程学科,云端抠额度是战术,本地重造推理是战略,中间还夹着 dsh 和 codex 的订阅绑定。判断很直接,成本层的创新速度会超过模型层,因为它离账单最近。
Skill 生态没有收口,还在高震
昨天凌晨版我写过 Skill 生态开始收口的判断,晚间数据要求修正这个结论。证据很直接,收口叙事的标志性项目 VoltAgent 聚合器一天之内掉榜,anthropics 官方插件市场也没了踪影,可另一边 karpathy 四规则升到第 10 位总星 207,037,ponytail 第 8 位 110,630,新进场的还有 archify、claude-obsidian、headlong 三种完全不同形态的 Skill 项目。说明什么,说明单日 trending 测的是瞬时热度,不是生态格局,Skill 品类的新陈代谢周期已经短到以天计。坦白讲,这个速度下任何「格局已定」的判断都活不过一个快照周期,能确定的只有一件事,这个品类的内容供给过剩了,缺的仍然是有粘性的分发和真正解决痛点的技能。
CEO 们开始在 trending 上交作业
今天榜单上有个隐含名单。tobi 用 3 个 commit 的 walgit 教科书级实现 Cursor 的 Continuity 架构,basecamp 的 omarchy 排名 7 连续第二天在榜冲向 31,000 星,创作者 Bilawal Sidhu 用 4 个 commit 换 2,786 星。三位都是各自领域有存量信誉的人,开源仓库成了他们信誉的直接变现通道,星数增速远超普通项目。怎么说呢,名人开源不新鲜,新鲜的是他们交的作业不再是玩具,walgit 的 CAS 共识和 omarchy 的发行级完成度都是硬货。判断是,个人信誉流量会持续注入开源市场,中小项目在 trending 上的曝光竞争会因此更卷,护城河只能来自持续的工程交付而不是首发声量。
值得关注的潜力项目
AgriciDaniel/claude-obsidian · Python · +810 · 12,491
基于 Karpathy 的 LLM Wiki 模式给 Claude Code 做的第二大脑,任何来源丢进 inbox,原始件先做内容寻址的不可变存档,然后 LLM 阅读建链归档成你拥有的纯 Markdown 知识图谱。工程自觉拉满,声明账本要求高风险论断有两个独立来源,无支撑论断保持可见而不是静默丢弃,所有写入走事务,并行 Agent 只交草稿,单一编排者合并后按 approved_plan_sha256 哈希审核才落盘,vault 锁加原子替换加日志化备份。检索用确定性的 BM25 加可选重排,默认不出网。12,491 星还在爬。
tt-a1i/archify · HTML · +676 · 15,924
一个专门出图的 Agent Skill,做架构图、工作流、时序图、数据流图、生命周期图,产物是自带动效的自包含 HTML,导出清晰。定位踩得很准,Agent 写代码在行画图翻车,而架构沟通恰恰是工程协作里最高频的图需求。15,924 星说明这个痛点足够普遍,值得盯它能不能成为图表类 Skill 的事实标准。
laude-institute/headlong · Shell · +457 · 530
自称 Agent 微 harness,卖点是持久 agency 和递归 LLM,口号直接引用林肯句式,of bash, by bash, for bash, it's shells all the way down。Laude Institute 出品,Shell 写的,总星才 530 刚起步。在所有 harness 都在做重客户端的时候,反其道用纯 bash 做持久化 Agent 运行时,这个极端路线要么死掉要么成为传奇,值得提前放进观察列表。
完整榜单
写在最后
三点收束。
第一,快照会骗人,全天数据才会说话。凌晨版和晚间版换血 12 席,昨天关于收口的判断今天就被打脸。做趋势分析的人要记住,trending 是热度的微分,不是格局的积分,单日榜单上的任何叙事都标着保质期。
第二,token 成本已经是一个独立工程学科。FreeToken 在硅上重写推理栈,freellmapi 在云端堆免费层,两条路线同榜说明需求侧足够宽。对做 Agent 产品的人,成本层的设计该提到和模型选型同一优先级。
第三,个人信誉正在成为开源市场的新货币。tobi 三个 commit 换 1,450 星,Bilawal Sidhu 四个 commit 换 2,786 星,omarchy 靠 basecamp 的招牌连续霸榜。声量可以借,交付还不了,这些仓库的共同点是第一次亮相就带着完成度。
一个总判断。这期榜单真正的主题不是哪个项目冲得高,是速度本身,生态换血以天计,叙事保质期以小时计,大佬和学生在同一张榜上抢位置。在这样的市场里,能带走的方法论只有一条,别把任何单日结论当资产,把可复算的数据管道和快速修正的写作流程当资产。这份榜单日报自己也在实践这件事,凌晨版发出去,晚间版推倒重来,错就认,认了就改。

评论互动