AI Builders Digest 0818:Cursor Origin 踩着 GitHub 宕机上线,无护城河时代评测成了显学

发布于 · 3,135 字 · 约 8 分钟#Follow Builders#创业
AI Builders Digest 0818:Cursor Origin 踩着 GitHub 宕机上线,无护城河时代评测成了显学 封面图
  • Cursor Origin 趁 GitHub 宕机上线,完成编辑器、托管、部署闭环
  • 无护城河时代,AI 栈各层均缺乏壁垒,品牌营销成差异化资产
  • 评测从幕后走向台前,方法论强调清晰定义与可重复自动化
  • Token 预算成为稀缺资源分配,算力驱动新一代资本配置问题

今天的 AI Builders Digest 主线是 无护城河时代的基础设施卡位:Cursor 推出代码托管 Origin,Rauch 趁 GitHub 大宕机官宣「Unlike GitHub, it's online」,3600 赞背后是编辑器、托管、部署被一家公司闭环;Nikunj 的清单把模型、IDE、harness、推理厂商挨个数了一遍「都没有护城河,除了风投」;当壁垒难寻,评测成了新的显学,Madhu Guru 的方法论和 Inspect AI + Harbor 的教程同日出现;No Priors 里 Elad 和 Sarah 把话题拉到五年三家万亿公司之后,钱该往哪去。

今日总结

主线:当每一层都喊不出护城河,竞争就变成迭代速度和 token 预算的分配。

托管层开战,时机即弹药。 Cursor 推出 Origin,Rauch 官宣「你的仓库现在可以托管在 Cursor Origin,并部署到 Vercel,而 Origin 本身也跑在 Vercel 上」,随即补刀正处在大规模宕机中的 GitHub:Unlike GitHub, it's online。这条推拿下 3600 赞,是当日互动之王。编辑器吃掉托管再直连部署,git 工作流的关键三环正在被一家公司缝合。同一天,Boris Cherny 晒出 Claude Code 的连番质量改进(739 赞、678 赞),Thibault 用一条 3726 赞的推文向社区征集「明明 100% 做得到却还没做的 obvious thing」:三家公司同时在用公开迭代抢开发者注意力。

评测从幕后走到了台前。 Madhu Guru 的 198 赞长推给出完整路径:从你最熟悉的工作流入手,把质量变成可测量的东西;研究真实 traces(典型用户的提示序列、每一步的好答案长什么样、端到端的成败),把产品失败的场景(混乱的工具调用返回、缺失的上下文)做成用例;再让它可重复、可自动运行,并持续校准它是否还映射线上流量。配合 AI Hot 当天的评测设计教程(开源框架 Inspect AI + Harbor,Google Sheets 与 Data Studio 可视化),「先求清晰,再谈可视化」,evals 正在变成一门公开课。

无护城河时代,钱和算力往哪去。 Nikunj 的清单横扫 models、IDEs、harnesses、app builders、wrappers、inference、voice、数据标注、infra、neoclouds、生成媒体,结论是「AI 里没人有护城河,除了风投」,1483 赞;他另一条 789 赞的推断言品牌营销将成为未来十年最被低估的差异化资产。Levie 说数据该作为资产进资产负债表。No Priors 播客里,Elad 指出五年内三家从近零到万亿(Anthropic、OpenAI、SpaceX)是史无前例的断点式均衡,接下来三五年很难成批再现;Sarah Guo 给出「return on invested tokens」的视角:当算力成为真正的稀缺品,几十个研究员产出 80% 的成果,token 预算分给谁,就是新一代的资本配置问题。

今日关键词: Cursor Origin · 无护城河 · Evals · Token 预算


官方博客

AI Hot:OpenAI 推出 ChatGPT for Teens,学习优先于答案

AI Hot·2026-08-18 19:00 CST·原文链接

OpenAI 发布 ChatGPT for Teens,为 13-17 岁用户自动启用,内置更强的安全保护与家长控制。产品取向很明确:Study Mode 引导分步解题而非直接给答案,附带负责任作业提醒、测验与学习可视化,以及可设定默认开启时段的 Study Hours。OpenAI 同时宣布与 CodeAI 合作,帮助青少年理解、质疑并创造性地使用 AI。当青少年市场成为用户增量的最后大池子之一,「怎么用」比「能不能用」率先成为产品设计题。

AI Hot:设计 AI 评测,先求清晰再谈可视化

AI Hot·2026-08-18 15:00 CST·原文链接

一篇评测工程实践:用开源评测框架 Inspect AI 和 Harbor 评估 agent 技能,再借助 Google Sheets 和 Data Studio 做可视化分析。文章的隐含观点和 Madhu Guru 当天的推文互为印证:评测的第一性问题不是图表好看,而是把「什么是好」定义清楚;可视化只是让结论可以被争论。工具链全部开源,意味着中小团队也能搭起像样的评测管线。


播客精选

No Priors:万亿公司、退出决策与 token 预算 — Sarah Guo(Conviction)与 Elad Gil

No Priors·2026-08-06 18:00 CST·原文链接

Conviction 创始人 Sarah Guo 与投资人 Elad Gil 的双人对话,聊风险管理、RSI、万亿公司数量与监管捕获。

五年三家万亿,是断点不是常态。 Anthropic 五年前基本不存在,OpenAI 还在早期,SpaceX 当时估值 800 到 1000 亿美元;而万亿公司通常需要 15 到 20 年的弧线。Elad 用进化论的「间断平衡」作解:大爆炸之后是巩固期,接下来三五年也许还能再出一两家,但不会是一批,很多人对「下一批万亿公司」的预期需要校准。

每半年理性地问一次「要不要卖」。 Elad 引 Ben Horowitz 的做法:预设一个不带情绪的董事会,专门讨论「未来六个月要不要考虑退出」,不是创始人推动也不是投资人推动。AI 时间里一年顶三四年,三年就是一个时代。Sarah 给出这个时代独有的检验问题:「当成本下降、能力上升时,你在捕获价值吗?」答不上来,就该卖。

Return on invested tokens。 实验室发现几十个研究员驱动了 80% 的成果,这是一条人力幂律;当算力成为真正稀缺的资源,人的成本不再是人本身,而是他身后的算力,于是有实验室放慢了研究员招聘。企业侧同理:从「大家都去用 AI」转向计量 token 花费、把负载搬到开源,下一波是「哪些项目和人才配得上超额的 token 预算」。SaaS 之死被高估了,因为同样的 token 投在核心产品上回报更高,这正是内部工具团队永远缺资源的老故事重演。

「七十年代的安全游说,基本上替我们杀死了充足而清洁的能源。」

监管捕获的旧案与新地。 法国 70% 的电力来自核电,几十年无事发生;美国 18%,四十年没建过新反应堆。Elad 把它当作 AI 安全光谱的参照系:安全有其真实价值,但过度也会杀死充裕。德州能源与硬件生态的崛起不是因为它更宜居,而是监管把人和实验赶了过去。


X/Twitter 动态

Guillermo Rauch(Vercel CEO):Cursor Origin 上线,趁 GitHub 宕机补刀

Guillermo Rauch(rauchg)·2026-08-18 01:48 CST·原文链接1·原文链接2

Rauch 这条 3600 赞的推文是当日互动之王。仓库现在可以托管在 Cursor Origin 并部署到 Vercel,而 Origin 本身也跑在 Vercel 上;他给 GitHub 的临门一脚是「Unlike GitHub, it's online」,正好踩在 GitHub 大规模宕机的窗口期。编辑器、托管、部署的三环闭环,加上时机即弹药的市场打法,这一战的开局相当漂亮。

Nikunj Kothari(FPV Ventures 合伙人):AI 没有人有护城河,除了风投

Nikunj Kothari(nikunj)·2026-08-18 06:57 CST·原文链接1·原文链接2

Kothari 这条 1483 赞的清单体推文横扫整个 AI 栈:models(OpenAI、Anthropic、xAI)、IDEs(Cursor、Windsurf)、harnesses(Cognition、Factory、LangChain)、app builders(Replit、Lovable、Bolt)、wrappers(Harvey、Abridge)、推理(Together、Fireworks、Groq)、voice(Sierra、Decagon、ElevenLabs)、数据标注(Scale、Surge、Mercor)、infra(Baseten、Modal)、neoclouds(CoreWeave、Lambda、Crusoe)、生成媒体(Runway、Suno),结论是「AI 里没人有护城河,除了风投」。他另一条 789 赞的推断言:如果 agent 成了大多数产品的主要用户,品牌营销将成未来十年最稀缺的差异化资产,长期被压成二号位的品牌操盘手会坐上主桌。

Thibault Sottiaux(OpenAI Codex/ChatGPT 负责人):征集「明明能做到却没做」的事

Thibault Sottiaux(thsottiaux)·2026-08-18 07:53 CST·原文链接1·原文链接2

Sottiaux 这条 3726 赞的推文直接向社区要需求:「Codex、API 或我们的模型,有什么 obvious 到 100% 做得到、却还没做的事?」产品负责人公开征集低垂果实,本身就是竞争白热化的信号。他另一条 971 赞的推文把 ABBA 的《Gimme! Gimme! Gimme!》改成 Codex 版:「午夜之后给我 Codex,让失败的测试统统消失,天亮前把它 ship 出去」。

Thariq:用 Claude Code 直接做设计,代码模型比扩散模型更会创作

Thariq(trq212)·2026-08-18 09:48 CST·原文链接1·原文链接2

Thariq 两条推文(880 赞与 470 赞)。第一条是实操召唤:进 Claude Code 输入 /design 加上你想设计的东西,直接出图。第二条是认知更新:最近的程序化生成艺术、视频剪辑和 3D 游戏演示,让他把判断改为「LLM 编码模型在很多创意工作上已经强过扩散模型」,毕竟代码更容易编辑、微调和导出,能与既有工具链无缝衔接。

Boris Cherny(Anthropic,Claude Code):小改进在叠加,更多在路上

Boris Cherny(bcherny)·2026-08-18 10:24 CST·原文链接1·原文链接2

Cherny 双连发(678 赞与 739 赞):一条晒 Claude Code 的新改进,「这种生活质量小改进会不断叠加,更多在路上」;另一条官宣并直接要反馈,「告诉我们你怎么想」。和 Thibault 的征集、Woodward 的清单放在同一天看,头部编码产品的迭代已经进入「周更 + 公开要反馈」的节奏。

Josh Woodward(Google Labs VP):Gemini 十点改进清单,49 个连接器

Josh Woodward(joshwoodward)·2026-08-18 09:12 CST·原文链接

Woodward 这条 467 赞的推文回访用户反馈并给出十点进度:Workspace 工具翻新一到两周内测试,3.7 Flash 的工具调用已见提升且还有后续,全新 Projects 设计完成、正在实现,连接器已支持 49 个(还在增加),另有五项标记 Done、一项修复了最大的过度触发 bug。把 roadmap 用一条推文向用户交账,成了大厂产品负责人的新基本功。

Madhu Guru(Meta AI 高级总监):把最熟悉的工作流变成评测

Madhu Guru(realmadhuguru)·2026-08-18 06:34 CST·原文链接

Guru 这条 198 赞的长推是评测方法论的浓缩版:想擅长 evals,就从你真正熟悉的工作流开始,把质量变成可测量的;研究真实 traces 与端到端成败,把产品失败场景(混乱的工具返回、缺失上下文)做成用例;然后让它可重复自动运行,并持续校准是否仍映射线上流量。文末他问大家要不要把这个写成日更系列。

Aaron Levie(Box CEO):数据该作为资产进资产负债表

Aaron Levie(levie)·2026-08-18 07:49 CST·原文链接

Levie 这条 304 赞的推文借一桩数据交易说事:当人们说数据是新的石油,落到账上就是这个样子。AI 对数据的渴求让几乎任何形态的信息都变得有价值;在 AI 时代,信息应当作为资产出现在资产负债表上,一家公司管理和挖掘自身组织智能的方式,将成为未来竞争力与价值创造的决定因素之一。

Garry Tan(YC CEO):开源 Personal AGI,70 个技能加知识 wiki

Garry Tan(garrytan)·2026-08-18 03:44 CST·原文链接1·原文链接2·原文链接3

Tan 把他在 Startup School 演讲里提过的 Personal AGI 开源了:一个私有 GitHub 仓库,装着 70 个他验证过的 skills 和一座 Karpathy 式知识 wiki 的起点,MIT 许可,免费。上手方式简单到只需新建一个目录,用现有的 Claude Code 或 Codex 订阅,把说明图贴进对话即可完成配置。个人 agent 的「发行包」第一次有了可以 fork 的实体。

Amjad Masad(Replit CEO):没有 AI 字样的团队,跑出 AI 增速

Amjad Masad(amasad)·2026-08-18 09:32 CST·原文链接1·原文链接2

Masad 两条观察。一条 156 赞:有团队的 pitch 里一个「AI」都没有,却跑出了 AI 级增速,要不是足够 AI-pilled,人手得多十倍。另一条 267 赞谈安全实践:只扫描代码漏洞不够,得用渗透测试真正去攻破它。前者是叙事克制派的小样本,后者给所有把 agent 接进生产环境的人提了个醒。

数据采集时间:2026-08-18 15:03 CST

评论互动

© 2026 王若风的技术博客 · Powered by Astro