AI Builders Digest 2026-09-14:Altman 的两种坏结局,84% 还没用上 AI,370 年密码告破

发布于 · 3,087 字 · 约 8 分钟#Follow Builders#OpenAI
AI Builders Digest 2026-09-14:Altman 的两种坏结局,84% 还没用上 AI,370 年密码告破 封面图
  • Sam Altman 以「两种坏结局」框架接棒放慢前沿,宣布 OpenAI 在预期显著提升能力的前沿 RL 训练前预先撰写安全案例,并欢迎联邦安全框架
  • Gary Marcus 对放慢提议给出三分怀疑:METR 与 AI 公司关系过近、对华威胁被用来维持加速、自律框架意在抢先真正的监管
  • Brex 图表显示全球 84% 的人从未用过 AI,付费用户约 0.3%,有效使用 agent 的仅约 0.04%,渗透率远落后于讨论热度
  • 小红书 AllSpark 开源 Search Agent 模型 Iris,35B 与 397B 双版本权重和评测代码已公开,数据与训练配方将陆续发布
  • Peter Steinberger 借 APFS 等文件系统目录克隆把 worktrees 提速约 80%,Boris Cherny 称 Fable 解开 370 年历史的 Cyphral Distich 密码

今天的 AI Builders Digest 主线是 窄路:Sam Altman 中午连发两条长文,把 AI 的「两种坏结局」写成正式框架——失去对未来的控制,或权力过度集中,两者之间只留一条窄路。他宣布 OpenAI 将在前沿 RL 训练前明确安全案例,并欢迎联邦安全框架。而在治理辩论之外,Brex 的图表提醒所有人:全球 84% 的人还从未用过 AI;Claude 则在 Boris Cherny 手里解开了一份 370 年的密码。

今日总结

主线:Altman 把「放慢前沿」从 Anthropic 的倡议变成了 OpenAI 的路线图,同时给共识划出边界。

两种坏结局是今天最重要的框架。 Altman 的第一条长文(7781 赞)说,AI 进展有两种必须避免的糟糕走法:一是把未来失去控制地交给 AI,OpenAI 毫不犹豫站队人类;二是权力过度集中,一家公司或一个人把世界观强加给所有人。第二条(7540 赞)给出 OpenAI 的行动清单:欢迎为前沿 AI 设定一致安全要求的联邦框架,不等反垄断豁免就先做独立审计类探索,并在预期显著提升能力的前沿强化学习运行之前,预先撰写明确的安全案例。他对 pacing 的定义也说得直白:不是停止,进展会继续,只是应当慢于不加干预时的情况。Aaron Levie 同日为这个方向辩护(168 赞):具体改进目标是绝对必要的,但如何做到不显著拖慢创新,是 21 世纪最复杂的问题之一。

Gary Marcus 给共识补上怀疑的另一半。 他肯定 Dario Amodei 的透明度承诺,但列出三重质疑:METR 与 AI 公司关系过近、Anthropic 借对华威胁叙事维持加速节奏、这份提议可能意在抢先于真正的监管。赞誉与怀疑并存,才是这场辩论的完整形状。

另一边,普及率数据泼来冷水。 Peter Yang 转述 Brex CEO Pedro 的图表(44 赞):全球 84% 的人从未用过 AI,16% 是免费聊天用户,约 0.3% 每月付 20 美元,真正有效使用 agent 的只有约 0.04%。所有人都在讨论 AI 的终局,而世界大多数人口还没有进场。Amjad Masad 从供给侧呼应了这一点(179 赞):过去一段时间很多用户被价格挡在 AI 编码门外,现在「又免费可建了」。

Builder 的日常继续向前。 Boris Cherny 报告 Fable 解开了 370 年历史的 Cyphral Distich 密码(1937 赞);Peter Steinberger 用 APFS/Btrfs/XFS/ReFS 目录克隆把 worktrees 提速约 80%(643 赞);Zara Zhang 则发现 Astra 的一个坏习惯:承认错误之后不会自动去做正确的事(170 赞)。Dan Shipper 的讽刺一针见血(285 赞):简单任务用 Astra medium,「这就叫 pacing the frontier」。

今日关键词: 两种坏结局 · safety cases · 普及率 · 密码告破


官方博客

AI Hot:小红书 AllSpark 开源 Search Agent 模型 Iris,35B 与 397B 双版本

AI Hot·2026-09-14 17:59 CST·原文链接

小红书 AllSpark 团队发布并开源 Search Agent 模型 Iris,提供 35B 与 397B 两个版本,官方称同量级成绩领先。

权重和评测代码已公开,数据与训练配方将陆续公布。

开源动作分三步走:先放权重和评测代码,再放数据与训练配方。对想复现或在其上做搜索智能体的团队来说,这是今天国产开源侧最实际的一条消息。

AI Hot:Gary Marcus 评 Dario Amodei 放慢 AI 提议,三份赞誉加两分怀疑

AI Hot·2026-09-14 02:34 CST·原文链接

Gary Marcus 评析 Dario Amodei 倡导放慢 AI 发展并支持透明度的文章。Sam Altman 与 Elon Musk 已迅速表示认同,Marcus 的态度是三份赞誉加两分怀疑。

METR 与 AI 公司关系过近、Anthropic 借对华威胁维持加速、以及该提议可能意在抢先于真正的监管。

肯定透明度承诺的同时,他把怀疑摊开:独立评估者是否足够独立、放慢叙事是否被用作加速的理由、自律框架是否在抢占立法的位置。这三问正好对应今天 Altman 长文里「独立审计」「联邦框架」两处最关键的承诺。

AI Hot:Anthropic 报告称胡塞组织用 Claude Code 开发导弹制导软件

AI Hot·2026-09-13 22:15 CST·原文链接

Anthropic 9 月威胁报告的细节持续披露:据评估极可能关联胡塞组织的也门小组,使用 Claude Code 开发制导火箭、射程超 2000 公里弹道导弹,以及名为 R2000 的高超声速滑翔载具概念的相关软件。

接 0911 期报道的威胁报告总览,这条补充了具体武器型号层面的细节:滥用不只发生在信息作战,也直接落在武器软件的开发环节。


X/Twitter 动态

Sam Altman(OpenAI CEO):两种坏结局与中间的窄路

Sam Altman(sama)·2026-09-14 12:05 CST·原文链接1·原文链接2

Altman 中午连发两条长文(7781 赞与 7540 赞),把治理立场写成完整框架。第一条给出两种必须避免的坏结局:

我们可能把未来失去控制地交给 AI,这是不可接受的;我们也可能落入权力过度集中的世界,如果异常强大的 AI 被一个人或一家公司用来把世界观强加给其他人,结果可能是极端反乌托邦的。

第二条是 OpenAI 的行动清单:欢迎为前沿 AI 设定一致安全要求的联邦框架,不必等反垄断豁免或立法就先提供信心,对独立审计类想法感到兴奋;在前沿强化学习运行之前预先撰写明确的安全案例(safety cases),而不是只在模型发布前做安全工作。他强调 pacing 不等于 stopping:

进展一直很快,也将继续快下去,但应当慢于不加干预时的情况;安全案例和监控等干预措施有显著成本,但 pacing 完全值得这个成本。

从昨夜 Dario 的倡议到今天 Altman 的执行清单,放慢前沿第一次有了两家实验室的背书和具体抓手。

Boris Cherny(Claude Code 负责人):Fable 解开 370 年历史密码

Boris Cherny(bcherny)·2026-09-14 10:20 CST·原文链接

Claude Code 负责人 Boris Cherny 分享了一个案例(1937 赞):Fable 解开了 Cyphral Distich,一份 370 年历史的密码文献。

Super cool way to use Claude.

对密码学和历史文献感兴趣的读者,这是今天最浪漫的一条:三百多年无人能解的谜题,被当代模型配着现代工作流解开。

Guillermo Rauch(Vercel CEO):写软件是为了放松

Guillermo Rauch(rauchg)·2026-09-14 05:25 CST·原文链接

Rauch 的一行梗文拿下 2523 赞,是今日 X 互动第二高:

You don't get it, I build software to relax.

在治理与安全的大议题刷屏的一天,builder 文化用最短的方式宣示存在感:对一部分人来说,写软件本身就是休息。

Peter Steinberger:worktrees 提速 80%,目录克隆是关键

Peter Steinberger(steipete)·2026-09-14 02:03 CST·原文链接1·原文链接2·原文链接3

Steinberger 带来今日最硬的技术细节(643 赞):下一个版本(或 dev channel)通过 APFS/Btrfs/XFS/ReFS 的目录克隆,把 worktrees 提速约 80%,同时节省大量磁盘空间。他补充这套实现全部用 Rust 写成,「因为你逃不开 Rust」(102 赞);并承诺自己先实测几周,若对多数用户有帮助就推进合入 codex(45 赞)。文件系统级的写时复制进入 AI 编码工具的日常路径,这条值得每个重度 worktree 用户收藏。

Dan Shipper(Every CEO):把 Astra medium 叫作放慢前沿

Dan Shipper(danshipper)·2026-09-14 04:18 CST·原文链接

Shipper 用两行字完成一次精准讽刺(285 赞):

started using Astra medium for simple tasks / call that pacing the frontier

简单任务换用 medium 档模型,这就叫「放慢前沿」。当 pacing 成为行业热词,第一个把它用成日常段子的人,往往也说出了这个词最真实的落地形态。

Amjad Masad(Replit CEO):被价格挤出的用户回来了

Amjad Masad(amasad)·2026-09-14 02:02 CST·原文链接

Masad 感慨 AI 编码的价格周期(179 赞):过去一段时间看到很多用户被价格挤出 AI 编码,是一件难受的事。

But now it's free to build again!

价格回落之后,重建的门槛重新归零。这条与 Peter Yang 转的 84% 普及率图表放在一起读:供给侧在降价等人进场,需求侧的大多数还没进门。

Zara Zhang(独立开发者):Astra 认错,但不重做

Zara Zhang(zarazhangrui)·2026-09-14 12:04 CST·原文链接

Zara Zhang 指出 Astra 的一个执行断链(170 赞):她让 Astra 做某事,指出错误并给出正确做法 Y,Astra 立刻承认「你说得对,我应该做 Y」,然后停在原地。

Why doesn't it just go and do Y, like the other models??

认错能力和执行意愿没有接起来:口头共识达成后不会自动转化为行动。这条观察对所有做 agent 产品的人都是提醒:用户要的不是道歉,是补救。

Aaron Levie(Box CEO):为 pacing 辩护,但承认问题很难

Aaron Levie(levie)·2026-09-14 00:07 CST·原文链接

Levie 承认「pacing」是个容易引爆的词,因为它听起来像是随意放慢能力,或借监管打压对手(168 赞)。但他的结论站在另一边:

Dario 提出的具体改进目标是 AI 发展的绝对必要条件;我们期望航空航天、生命科学、医疗等行业做到同等水平,AI 开发不应有什么不同。

他同时把难题点透:AI 将支撑金融交易、医疗设备、国防系统和政府流程,安全与对齐的需求是真实的;如何在不显著拖慢创新、不削弱竞争的前提下到达那里,是 21 世纪最复杂的问题之一。

Peter Yang:84% 的人从未用过 AI

Peter Yang(petergyang)·2026-09-14 02:15 CST·原文链接

Peter Yang 提醒正在辩论 AI 终局的人(44 赞):全世界大多数人口甚至还没开始用 AI。他转述 Brex CEO Pedro 常引用的一张图表:每个点代表 320 万人,灰色的 84% 从未用过 AI,绿色的 16% 是免费聊天用户,橙色的约 0.3% 每月为 AI 付 20 美元。

而这个小到几乎看不见的红框,是有效使用 agent 的人,约 0.04%。

他注明图表来自 2026 年 2 月,此后数字肯定有增长,但我们仍然处于极早期。治理辩论的热度与真实渗透率之间的落差,是今天最值得记住的一组对比。

Nikunj Kothari(FPV Ventures 合伙人):入职高估值公司常是 bug 不是 feature

Nikunj Kothari(nikunj)·2026-09-14 02:08 CST·原文链接

Kothari 说他每天至少收到一条创始人发来的同款困惑(75 赞):求职者以为入职估值越高、package 越高越安全,但这常常是 bug 不是 feature。估值高不代表公司更稳,你要客观看市场、看增长,如果公司估值是 100 倍 ARR,它就得长到配得上为止,还要自己算这家公司可能以什么价格退出,别忘了 409A 定价和税务影响。

他的亲身经历作注:他曾任职一家从顶级投资人手里融了 6000 万美元的公司,三年后倒闭,股权全部清零。在数字脱离现实的周期里,这条建议的分量加倍。

Garry Tan(YC CEO):公开内容只是正餐前的 teaser

Garry Tan(garrytan)·2026-09-14 01:01 CST·原文链接

Garry Tan 解释 YC 的内容策略(219 赞):他们做的创业内容只是 teaser,真正具体的建议,是你成为 YC 公司之后一对一拿到的。公开内容负责证明价值,私有服务负责交付价值,这个分层本身就是获客漏斗。


数据采集时间:2026-09-14 14:51 CST

评论互动

© 2026 王若风的技术博客 · Powered by Astro