AI Builders Digest 2026-08-26:Claude 记忆全线统一,OpenAI 自研芯片亮相,GLM-5.3-Flash 开源

发布于 · 2,751 字 · 约 7 分钟#Follow Builders#Models
AI Builders Digest 2026-08-26:Claude 记忆全线统一,OpenAI 自研芯片亮相,GLM-5.3-Flash 开源 封面图
  • Anthropic 把 Claude 记忆统一到 Chat 与 Cowork(官方公告 6846 赞),敏感话题默认不进记忆且逐条可管理;Boris Cherny 宣布 Claude Code memory 更简单更强,Thariq 预告 Claude Code 将更可魔改
  • Sam Altman 一句「we made a chip and it is fast」拿下 32803 赞,OpenAI 自研芯片进入官宣节奏;Aditya Agarwal 提醒 AI 主要惠及高薪群体,公众反感数据中心建设并不意外
  • OpenAI 上线 Team 套餐(2926 赞),类似 Pro 100 美元档但面向团队与小公司,打包全部 ChatGPT/Work/Codex 功能;Thibault 的产品哲学:好产品至少需要 34 天
  • GLM-5.3-Flash 开源:320B 总参数、AA 指数 57 分与 Opus 4.8 持平,定价为 GLM-5.3 的 1/10、限时折扣约 Opus 的 1/40,推理已跑在国产芯片集群
  • 安全侧双重警报:假智库九天 124 篇报告定向污染 ChatGPT 信源;C2PA 相机签名在 Android 端可被 root 提权伪造且无法常规修补

今天的 AI Builders Digest 主线是 记忆成为产品主战场:Anthropic 把 Claude 的记忆统一到 Chat 与 Cowork,官方公告拿下 6846 赞,Boris Cherny 同步宣布 Claude Code 的 memory 更简单也更强,Garry Tan 用 cross-harness memory maxxing 给出用户侧宣言。算力侧,Sam Altman 的「we made a chip and it is fast」以 32803 赞成为本日互动之王,OpenAI 上线 Team 套餐补齐组织市场;模型侧 GLM-5.3-Flash 开源,把价格打到 Opus 4.8 的 1/40。播客区请到前 Twitter CEO Parag Agrawal 讲 Parallel 如何为 agent 重建搜索。

今日总结

主线:记忆从卖点变成标配,算力叙事推进到硅片。

记忆是今天最拥挤的战场。 Claude 的记忆现在跨 Chat 与 Cowork 统一(6846 赞):告诉它记住一次,两边都生效。Boris Cherny 宣布 Claude Code 的 memory「更简单也更强」(1429 赞),Thariq 预告 Claude Code 将更可魔改(1118 赞)。Garry Tan 的四个词最像用户宣言:cross-harness memory maxxing(510 赞)。厂商把记忆做成跨产品的基础设施,用户则要求记忆跨厂商可迁移,两股力量同日出现。

OpenAI 把算力故事讲到了硅片层。 Sam Altman 的「we made a chip and it is fast」拿下 32803 赞,没有参数、没有供应商、没有时间表,但官宣本身是信号。对照昨天 Dylan Patel「2028 年控制全球大部分 FLOPs」的判断,自研芯片是那个预言的物理底座。Aditya Agarwal 补上叙事的另一面:AI 目前主要惠及高薪知识工作者,公众反感数据中心建设并不奇怪。

组织市场补齐,模型价格战开打。 Team 套餐上线(2926 赞):类似 Pro 100 美元档但为团队与小公司设计,打包全部 ChatGPT、ChatGPT Work 和 Codex 功能。模型侧,GLM-5.3-Flash 开源:320B 总参数(A18B 激活),AA 综合智能指数 57 分与 Opus 4.8 持平,定价为 GLM-5.3 的 1/10、限时折扣约为 Opus 的 1/40,推理服务已跑在国产芯片集群上。

信任链的两端同日告急。 一端是信源污染:假智库九天产出 124 篇、56 万字报告,目标是让 ChatGPT 引用其观点;另一端是内容溯源:C2PA 相机签名在 Android 端可被 root 提权伪造。模型引用什么、内容来自谁,AI 的信任问题正从模型内部蔓延到外部世界。

今日关键词: 记忆统一 · 自研芯片 · Team 套餐 · GLM-5.3-Flash


官方博客

AI Hot:GLM-5.3-Flash 开源,320B 总参数,定价约为 Opus 的 1/40

AI Hot·2026-08-26 22:11 CST·原文链接

智谱上线并开源 GLM-5.3-Flash(320B-A18B),GLM-5 系列首个原生多模态模型:

  • AA 综合智能指数 57 分,与 Claude Opus 4.8 持平
  • 定价为 GLM-5.3 的 1/10,限时折扣内约为 Opus 4.8 的 1/40
  • 稀疏注意力与线性注意力混合架构
  • 推理服务已跑在国产芯片集群上,并接入 ZCode 等平台开放 API

开源加激进定价,模型层的竞争从能力比拼进入「能力持平后的成本战」。

AI Hot:以色列资助的假美国智库试图利用 AI 进行宣传

AI Hot·2026-08-26 22:05 CST·原文链接

一个打着「汉诺威公共政策研究所」旗号的亲以色列网站,九天内发布 124 篇、超 56 万字的报告,目标是优化内容以引导 ChatGPT 等 AI 聊天机器人引用其观点。该网站由美国公司 Piro Inc 依据《外国代理人登记法》为以色列政府分发内容,背后是以色列政府数千万美元资助、经 Havas Media 等第三方转手的宣传行动。

这不是伪造内容,而是伪造「被模型引用的资格」:攻击面从信息本身上移到了模型的信源层。

AI Hot:C2PA 相机认证在 Android 端可被伪造

AI Hot·2026-08-26 22:05 CST·原文链接

安全研究员 David Buchanan 指出,C2PA 相机认证在 Android 平台可被攻破:通过 root 权限提升漏洞(如 CVE-2026-43499),攻击者可利用 StrongBox 硬件签名任意数据,伪造 C2PA 签名的图像和视频,全程无需硬件攻击。该问题无法通过常规补丁修复,已提前 90 天向相关方报告。

C2PA 是「AI 时代内容真实性」的支柱方案之一,这条研究说明:硬件背书的信任锚,也架不住操作系统层的提权。


播客精选

Training Data:Parallel 的 Parag Agrawal,为 Agent 构建一张新 Web

Training Data·2026-08-25 17:00 CST·原文链接

前 Twitter CEO Parag Agrawal 回到创始人轨道,Parallel Web Systems 做 agent 时代的搜索与 Web 访问层。

人类的点击数据是 bug。 Parallel 的核心判断:agent 做搜索应该依赖 agent 反馈,而不是继承人类点击反馈;模型擅长的信息压缩能力,可以迁移到搜索的索引与排序上。这个论点过去难以成立,现在因为 agent 的出现变得可行:

Agents, not just as a technology, but as a distinct customer.

赌注是千倍用量。 Parallel 押注 agents 会以千倍于人类的规模使用 Web,因此需要重新发明支撑 agent 搜索的技术,以及配套的商业模式。

Twitter 的经验要反着用。 Twitter 是产品市场契合后的超大规模业务,反馈来自数亿每天用 30 多分钟的用户;创业期的一切都不同,他在主动「反学习」大公司直觉。


X/Twitter 动态

Sam Altman(OpenAI CEO):我们做了颗芯片,它很快

Sam Altman(sama)·2026-08-26 03:53 CST·原文链接

一句话,32803 赞,本日互动之王:

we made a chip and it is fast

没有参数、没有供应商、没有时间表,但官宣本身就是信息:OpenAI 的算力自研从传闻进入发布节奏。与 Dylan Patel 的算力集中判断放在一起读,芯片是那个预言落到物理层的第一块砖。

Thibault Sottiaux(OpenAI Codex/ChatGPT):Team 套餐上线,好产品至少需要 34 天

Thibault Sottiaux(thsottiaux)·2026-08-26 04:16 CST·原文链接1·原文链接2

Team 套餐(2926 赞):定位类似 Pro 100 美元档,但为团队和小公司设计,打包全部 ChatGPT、ChatGPT Work 和 Codex 功能。至此 OpenAI 的订阅矩阵从个人、团队到企业全部补齐。另一条(2034 赞)是产品哲学:

Good products take time. At least 34 days.

Claude(Anthropic 官方):记忆统一,Chat 与 Cowork 共用一个大脑

Anthropic(claudeai)·2026-08-26 01:14 CST·原文链接1·原文链接2

Claude 现在有一条跨 Chat 与 Cowork 的统一记忆(6846 赞):告诉它记住一次,两边都生效;把任务交给 Cowork 时,它带着聊天里已经建立的理解开工。产品侧的 Cat Wu 确认这来自用户反馈(588 赞)。

细节设计克制:健康、宗教等敏感话题默认不进入记忆,需在设置中主动开启;所有记忆以主题列表呈现在设置里,可逐条查看、编辑、删除,也会随对话自动更新。

Boris Cherny(Claude Code 负责人):memory 更简单,也更强

Boris Cherny(bcherny)·2026-08-26 04:57 CST·原文链接

一句小版本公告(1429 赞):

A small improvement: memory is now simpler and more powerful. Enjoy!

结合同日的记忆统一与 Thariq 的可魔改预告,Anthropic 正把记忆做成横跨聊天、协作与编码的同一层基础设施,Claude Code 的 memory 是其中最先被重度使用的一块。

Thariq(Anthropic):Claude Code 将更可魔改

Thariq(trq212)·2026-08-26 01:30 CST·原文链接

Thariq 预告(1118 赞):很快会分享更多关于让 Claude Code 更 hackable 的进展。官方口中的「可魔改」,指向的正是 skills、hooks、自定义工具这条社区最活跃的扩展线。

Garry Tan(YC 总裁兼 CEO):cross-harness memory maxxing

Garry Tan(garrytan)·2026-08-25 23:48 CST·原文链接

在 Anthropic 宣布记忆统一的同一天,Garry Tan 的四个词(510 赞)像一份用户宣言:cross-harness memory maxxing。记忆不该被锁在单一产品里。厂商在做跨产品统一,用户要的是跨厂商可迁移,两边对「记忆归属」的理解并不相同。

swyx:暂时别用 Codex 的 locked use

Swyx(swyx)·2026-08-26 14:02 CST·原文链接

swyx 发出 PSA:先别用 Codex 的「locked use」能力。它依赖尚不稳定的 macOS 特性,已经两次把他完全锁在 macOS 钥匙串之外。涉及系统权限的新功能,尝鲜的代价可能是一次恢复模式。

Peter Yang:开源 /fuck-cancer,给患者和家属的 AI 技能

Peter Yang(petergyang)·2026-08-25 21:53 CST·原文链接1·原文链接2

Peter Yang 兑现了几天前的预告,开源 /fuck-cancer(1389 赞):帮助癌症患者与照护者应对诊断和治疗,为自己和亲人争取权益。设计核心是一份「单一事实源」文档(101 赞的示例):患者信息、问题清单、病程记录集中一处,技能随使用持续更新。

AI 技能的最小而有尊严的应用形态:不解决癌症,但帮人在癌症面前不迷路。

Guillermo Rauch(Vercel CEO):Run SDK 与 Vercel Connect GA

Guillermo Rauch(rauchg)·2026-08-26 04:44 CST·原文链接1·原文链接2

两条产品公告,各补一块 agent 基础设施。Run SDK(419 赞):为动态 Code Mode 执行提供安全的 𝚎𝚟𝚊𝚕,agent 写的代码不必每次都上完整沙箱,可以在轻量环境里 𝚛𝚞𝚗。Vercel Connect GA(214 赞):

The hardest problem in building agents is secure connectivity to services and data.

𝚟𝚎𝚛𝚌𝚎𝚕 𝚌𝚘𝚗𝚗𝚎𝚌𝚝 𝚌𝚛𝚎𝚊𝚝𝚎 一行命令接通 Notion 等服务。执行与连接,agent 的两个标准件同日交付。

Google Labs:Putty,实时协作的 vibe coding

Google Labs(GoogleLabs)·2026-08-26 00:50 CST·原文链接

Google Labs 新实验(1234 赞):Putty 是协作式 vibe coding 工具,多人实时一起搭建工具和网站,口号写着「Great minds think play alike」。从单人对话到多人共建,vibe coding 长出了协作形态,这是 AI 编程工具向「共创」方向的一次明确试探。

Madhu Guru(Meta AI 高级总监):evals 第九讲,Eval Roadmap 问题

Madhu Guru(realmadhuguru)·2026-08-26 09:36 CST·原文链接

系列第九讲(83 赞):Eval Roadmap 问题。大多数 evals 失败,是因为团队把它们当静态产物,而用户的期望和行为一直在漂移。评测需要像产品一样有 roadmap,随演化持续维护,而不是一次性交付。她同时贴出全系列九讲目录,从入门、失败模式分类到 roadmap,evals 手册已经成形。

Aditya Agarwal(SPC 合伙人):公众讨厌数据中心建设,一点也不奇怪

Aditya Agarwal(adityaag)·2026-08-26 00:38 CST·原文链接

对昨天 Garry Tan「数据中心创造就业与繁荣」的冷静补充:AI 今天主要帮到知识工作者和收入最高的群体,普通公众感受不到红利、却要承担代价,反感建设潮并不意外。算力叙事要继续成立,得先回答分配问题。


数据采集时间:2026-08-26 23:28 CST

评论互动

© 2026 王若风的技术博客 · Powered by Astro