AI Builders Digest 0828:网络防御进入倒计时,ChatGPT 开始跑腿,GLM-5.3 开放权重
- Sam Altman 以 13560 赞紧急呼吁 AI 网络防御「没有多少时间可行动」,愿与任何竞争者合作;Redwood 首席科学家 Ryan Greenblatt 判断 AI 接管最早 2029 年出现,主张美中达成验证与约束安排
- ChatGPT 可代买杂货、订 Uber、约理发且全程不接触真实凭证(3788 赞),agent 商务走进日常;Thibault 观察到 Codex 用户已遍布飞机与咖啡馆,挑战者气质成主流
- Claude 推出科学家版 Team 计划,向数学、化学、物理等领域发放 1 万个席位(7576 赞);斯坦福同期发布 Terminal-Bench-Science 0.1,用 70 个专家任务评估科研智能体
- GLM-5.3 开放权重(智能体编码与网络防御最强),继 Flash 登顶 OpenRouter 后旗舰跟进;Gemini 3.5 Transcribe 发布,支持 85+ 语言与词级毫秒时间戳
- Garry Tan 提出宏观判断:AI 产生现金流的速度终将超过经济体为新资本找到生产性用途的速度
今天的 AI Builders Digest 主线是 AI 安全以最高音量回归:Sam Altman 拿下 13560 赞的紧急呼吁说网络防御「没有多少时间可行动」,Redwood 首席科学家 Ryan Greenblatt 在 Matt Turck 的播客里把时间点标在 2029。另一条线,agent 正式进入日常商业:ChatGPT 能帮你买菜、订 Uber、约理发,全程不碰你的凭证(3788 赞)。模型侧,GLM-5.3 开放权重,Claude 给科学家发了 1 万个席位。
今日总结
主线:防御的时间表与 agent 的日常化同时到来。
安全议题本周第二次冲顶。 Sam Altman 的呼吁没有留余地:这是 AI 网络防御的「关键时刻」,行动时间不多,愿意与任何竞争者合作(13560 赞)。Matt Turck 播客请来 Redwood Research 首席科学家 Ryan Greenblatt:他是最早抓到 AI 伪装对齐的研究者(2024),也是 AI 2040 计划的作者之一,判断超智能过渡中最早 2029 年会出现「有能力密谋接管」的 AI。他的措辞值得记录:「我不说超级智能是坏的,我说它是危险的。」同日 GLM-5.3 开源,官方定义是「智能体编码与网络防御最强」,攻防在同一批模型能力里生长。
Agent 进入日常商业。 ChatGPT 现在能买杂货、订 Uber、约理发(3788 赞),关键设计是全程不接触你的真实凭证。Thibault 的观察补了氛围:飞机上和咖啡馆里的 Codex 用户越来越多,「挑战者气质已成主流」(2732 赞)。Peter Yang 的登录摩擦系列也有续集:每天 3-5 个产品测评请求,几乎全都要注册新账号、登录新网站。
科学家拿到专用席位。 Claude 推出科学家版 Team 计划(7576 赞):覆盖数学、化学、物理等各领域的 10000 个科学家席位。配套的评测也来了:斯坦福领衔的 Terminal-Bench-Science 0.1,用 70 个专家任务检验智能体的科研工作流能力。
开源继续加码。 GLM-5.3 开放权重,可下载、运行和定制;两天前 Flash 登顶 OpenRouter,今天旗舰跟进。Google 则发布了 Gemini 3.5 Transcribe:85+ 语言、词级毫秒时间戳、1000 个自定义术语,专攻转录这一件小事。
今日关键词: 网络防御 · 2029 · agent 商务 · 开源权重
官方博客
AI Hot:GLM-5.3 开放权重,智能体编码与网络防御最强
AI Hot·2026-08-28 23:04 CST·原文链接
GLM-5.3 现已开放权重:官方称之为「最强大的智能体编码与网络防御模型」,可供下载、运行和定制,权重托管在 Hugging Face,技术博客同步公开。
从两天前 Flash 以 1/100 价格登顶 OpenRouter,到今天旗舰开放权重,智谱这周的节奏是「先证明需求,再交出底牌」。开源阵营的重心正在从「便宜可用」转向「最强可用」。
AI Hot:Gemini 3.5 Transcribe,把转录这件小事做穿
AI Hot·2026-08-28 21:34 CST·原文链接
Google 推出专用于语音转文字的 Gemini 3.5 Transcribe,主打快速、准确、低成本:
- 原生说话人分离与词级毫秒时间戳
- 85+ 种语言自动识别与代码切换
- custom_vocabulary 支持最多 1000 个领域术语,避免专有名词拼写错误
- Smart Transcription 与 Verbatim 双模式
通用模型时代,把单一场景做穿是差异化回归的信号。
AI Hot:Terminal-Bench-Science 0.1,给科研智能体出题
AI Hot·2026-08-28 20:04 CST·原文链接
斯坦福大学研究人员领衔发布 Terminal-Bench-Science 0.1:用来自生命、物理、地球、数学和工程科学的 70 个专家精选任务,评估 AI 智能体的科研能力。
与 Claude 的科学家席位同日出现不是巧合:供给(模型能力)与度量(科研基准)正在同时到位,科研工作流的 agent 化有了自己的 evals。
播客精选
The MAD Podcast:Ryan Greenblatt — AI 可能 2029 接管,现在行动还来得及吗
The MAD Podcast with Matt Turck·2026-08-27 22:22 CST·原文链接
Redwood Research 首席科学家 Ryan Greenblatt 是 2024 年最早抓到「AI 伪装对齐」的研究者,也是 AI 2040 计划 A 的作者,这份计划被称为美中避免鲁莽超智能竞赛的最详细蓝图。
接管不是 sci-fi,是时间表问题。 他的判断:AI 公司的 CEO 们明白自己在建造远超人类的系统,也明白目前没有一套想清楚的风险管理方案。从「全面自动化研发」到「几乎全面超人类」的过渡中,某个时刻(他标在 2029)AI 会从「错位、reward hacking、马虎」变成「有能力地密谋并想接管」。
I wouldn't say superintelligence is bad. I would say it's dangerous.
主张是减速与协议,不是放弃。 AI 2040 的核心是让美中在最危险的能力区间达成验证与约束安排。主播 Matt Turck 的开场白半开玩笑半认真:这期节目最后十分钟最黑暗,「订阅频道仍是人类能做的决定,趁还来得及行使这项权利」。
X/Twitter 动态
Sam Altman(OpenAI CEO):AI 网络防御的关键时刻,没有多少时间
Sam Altman(sama)·2026-08-28 03:38 CST·原文链接
13560 赞,本日互动之王:
this is a critically important moment for cyber defense with AI; there is not much time to act.
他补充:愿意让你与 OpenAI 或任何竞争者、伙伴合作。五天前 OpenAI 首席全球事务官勒汉恩的攻击预警,到今天 CEO 亲自升级,防御叙事正在从「提醒」变成「动员」。
Claude(Anthropic 官方):科学家版 Team 计划,1 万个席位
Anthropic(claudeai)·2026-08-28 03:32 CST·原文链接
从今天起,数学、化学、物理等各领域的 10000 名科学家可以通过新的科学家版 Claude Team 计划使用 Claude(7576 赞)。科研是被 agent 重塑门槛最低、杠杆最高的领域之一,Anthropic 直接把席位发到了实验室。
Thibault Sottiaux(OpenAI Codex/ChatGPT):ChatGPT 开始跑腿,Codex 用户出圈
Thibault Sottiaux(thsottiaux)·2026-08-28 04:34 CST·原文链接1·原文链接2·原文链接3
三条连发。最重的一条(3788 赞):ChatGPT 现在能买杂货、订 Uber、约理发 appointment,还能做更多,全程不接触你的真实凭证。agent 商务从演示视频走进了日历和购物车。第二条(2732 赞):飞机上和咖啡馆里的 Codex 用户越来越多,underdog 能量成了主流。第三条(504 赞)是冷幽默:贴着 Sol 飞不会让它更快,抱歉。
Garry Tan(YC 总裁兼 CEO):AI 现金流的速度将超过经济的吸收能力
Garry Tan(garrytan)·2026-08-28 03:23 CST·原文链接
一个安静的宏观判断(566 赞):在足够长的时间框架里,AI 产生现金流的速度,会超过经济体为新资本找到生产性用途的速度。如果成立,资本过剩本身就是下一代的稀缺问题,利率、资产定价的底层假设都会被改写。
Peter Yang:登录摩擦续集,医疗记录与反向 AI 味
Peter Yang(petergyang)·2026-08-28 06:12 CST·原文链接1·原文链接2·原文链接3
三条都实用。登录摩擦有了量化:每天 3-5 个新产品测评请求,几乎全都要新建账号登录独立网站(646 赞)。/no-ai-slop 技能(GitHub 已 6K 星)的反向用法:为一对新人写了份不像 AI 写的婚礼誓词(106 赞)。最重的一条:把 160 页医疗记录交给 AI 整理,体验极佳,并点名希望有 ChatGPT Health 团队,为患者和照护者而设计(230 赞)。
Guillermo Rauch(Vercel CEO):最好的产品是内部技术的出口
Guillermo Rauch(rauchg)·2026-08-28 00:54 CST·原文链接1·原文链接2·原文链接3
Rauch 的产品观(558 赞):最好的产品一直是对内部技术的出口,前提是内部先建立起强信念;团队最近在 WebGPU 创意制作上产出惊人。佐证两条:𝚏𝚡 与 shaders 是「everything is computer」的又一证明(183 赞),一段 Deploy to Vercel 的 shader 演示拿下 382 赞。从内部工具到对外产品,Vercel 的飞轮转得越来越快。
Madhu Guru(Meta AI 高级总监):企业 AI 负责人的最高杠杆动作,模型无关
Madhu Guru(realmadhuguru)·2026-08-28 09:09 CST·原文链接
给企业 AI 负责人的建议(173 赞):最高杠杆的动作是把 AI 栈做成模型无关(model agnostic)。今天的投入应放在构建不绑定单一模型的抽象层与评测体系上。evals 系列主讲人的这条建议,本质是把她的方法论推广成架构原则:换模型的自由度,取决于你的评测能不能公平地比较模型。
Josh Woodward(a16z 合伙人):把书变成智囊团,语音之年
Josh Woodward(joshwoodward)·2026-08-28 04:18 CST·原文链接1·原文链接2
两条 Google 生态的观察。NotebookLM 新玩法(360 赞):买一本书丢进 Notebook,把作者的方法论直接应用到你自己的项目上,作者和出版方也能参与分成。Gemini 的语音代理演示(328 赞):告诉 Gemini 要做什么,它就去办,这是 Year of Voice。
Aaron Levie(Box CEO):财报周提醒,软件是 AI 的护栏
Aaron Levie(levie)·2026-08-28 12:23 CST·原文链接
本周科技财报电话会的关键提醒(120 赞):软件与 AI 的关系比「替代叙事」重要得多,软件为数据如何被管理、治理和交付提供护栏。作为企业内容管理公司的 CEO,他的立场可以预期,但在 agent 大量读写企业数据的当口,「护栏」确实比「替代」更接近企业采购的真实顾虑。
数据采集时间:2026-08-28 23:27 CST

评论互动