#Models

共 71 篇文章

围绕 #Models 汇总相关文章,适合连续阅读同一主题下的实践与思考。

  • AI Builders Digest 1001:Gemini 4 Argon 发布,Sol 需求史上最高,蒸馏窃取攻击披露牵出 Moonshot 关联

    Google 发布 Gemini 4 Argon(1319 赞官宣),Peter Yang 称 Google cook 了但编码 harness 与个人 agent 仍需追赶;Thibault 称 GPT-6.1 Sol 是 OpenAI 史上需求最大的模型、正扩容至近两倍速度,并宣布可在 ChatGPT 内直接构建部署 MCP 服务器;OpenAI 披露 7 月拦截针对推理链的蒸馏窃取(16000 次请求关联 15000 账号,指向 Moonshot AI 相关人员),但研究者称同样手法在 Azure 上仍可窃取 Astra;Mollick 承认智能体组织的 Bitter Lesson。Google 发布 Gemini 4 Argon(1319 赞官宣),Peter Yang 称 Google cook 了但编码 harness 与个人 agent 仍需追赶;Thibault 称 GPT-6.1 Sol 是 OpenAI 史上需求最大的模型、正扩容至近两倍速度,并宣布可在 ChatGPT 内直接构建部署 MCP 服务器;OpenAI 披露 7 月拦截针对推理链的蒸馏窃取(16000 次请求关联 15000 账号,指向 Moonshot AI 相关人员),但研究者称同样手法在 Azure 上仍可窃取 Astra;Mollick 承认智能体组织的 Bitter Lesson。

    发布于

  • AI Builders Digest 0925:Copilot 定位工作新 OS,AI 网关份额剧变,Muse 上 Replit 做 app

    Satya Nadella 宣布 Copilot 迄今最大更新,定位覆盖每个模型、设备和任务的工作新 OS;Rauch 披露 Vercel AI Gateway 近两月支出剧变:Anthropic 份额 69% 跌至 40%,OpenAI 翻倍至 24%,Kimi K3 与 DeepSeek 吃掉近半损失,Opus 5.5 两天升至 10%;Trump 政府 WISeR 项目用 AI 审批 Medicare 预授权引争议;NYT 补全 OpenAI 智能体四起入侵的目标清单;Thariq 宣布 plan mode 将变为可自定义的内置 mod。Satya Nadella 宣布 Copilot 迄今最大更新,定位覆盖每个模型、设备和任务的工作新 OS;Rauch 披露 Vercel AI Gateway 近两月支出剧变:Anthropic 份额 69% 跌至 40%,OpenAI 翻倍至 24%,Kimi K3 与 DeepSeek 吃掉近半损失,Opus 5.5 两天升至 10%;Trump 政府 WISeR 项目用 AI 审批 Medicare 预授权引争议;NYT 补全 OpenAI 智能体四起入侵的目标清单;Thariq 宣布 plan mode 将变为可自定义的内置 mod。

    发布于

  • AI Builders Digest 0923:Opus 5.5 对阵 GPT-6 Sol 与 Luna,API 永久半价,Jevons 悖论降临 agent

    GPT-6 Sol 与 Luna 发布并永久降价 50%,Plus/Pro/Business 全量加载 banked reset(23309 赞);Claude Opus 5.5 成为 Claude Code 与 Claude 应用默认模型,限额多 25%,Cherny 实测其 9.5 小时完成 HAProxy C 转 Rust、比 Fable 5.1 快且省 51%,并用 Lean 形式化验证 Claude Agent SDK 产出 16 个修复 PR;Levie 称这是 agent 版 Jevons 悖论;Rauch 的 Next.js evals 给出四模型对照;Astra 找出 libuv 14 年老 bug。GPT-6 Sol 与 Luna 发布并永久降价 50%,Plus/Pro/Business 全量加载 banked reset(23309 赞);Claude Opus 5.5 成为 Claude Code 与 Claude 应用默认模型,限额多 25%,Cherny 实测其 9.5 小时完成 HAProxy C 转 Rust、比 Fable 5.1 快且省 51%,并用 Lean 形式化验证 Claude Agent SDK 产出 16 个修复 PR;Levie 称这是 agent 版 Jevons 悖论;Rauch 的 Next.js evals 给出四模型对照;Astra 找出 libuv 14 年老 bug。

    发布于

  • AI Builders Digest 0920:Qwen-Image-2.1 开源统一生成与编辑,阶跃 Step 5 预览,人人都想 build

    Qwen 开源 Qwen-Image-2.1,单个 7B checkpoint 统一文生图与图像编辑,原生 2K 与 RGBA 透明输出,支持 10 张参考图与多种蒙版局部编辑,并已支持 ComfyUI;阶跃星辰发布 Step 5 Preview,600B 稀疏 MoE、100 万 token 上下文,Artificial Analysis 44 分居开源前三,单任务成本为 Claude Opus 5 的 1/8,10 月 15 日开源;Rauch 说这波 AI 最酷的事是人人都想创造和交付而非只消费。Qwen 开源 Qwen-Image-2.1,单个 7B checkpoint 统一文生图与图像编辑,原生 2K 与 RGBA 透明输出,支持 10 张参考图与多种蒙版局部编辑,并已支持 ComfyUI;阶跃星辰发布 Step 5 Preview,600B 稀疏 MoE、100 万 token 上下文,Artificial Analysis 44 分居开源前三,单任务成本为 Claude Opus 5 的 1/8,10 月 15 日开源;Rauch 说这波 AI 最酷的事是人人都想创造和交付而非只消费。

    发布于

  • GitHub 趋势洞察 2026-09-19,审计王朝三连庄,决策层训练战开打

    今日 GitHub 趋势亮点,审计王朝三连庄,NanoJev 练出决策头追平官方八成,laya 号称比 Jev 快 7.8 倍,Mac 版 Photoshop 开源。今日 GitHub 趋势亮点,审计王朝三连庄,NanoJev 练出决策头追平官方八成,laya 号称比 Jev 快 7.8 倍,Mac 版 Photoshop 开源。

    发布于

  • 把AI判断做成「智能if语句」!Jev实测:一次调用3个判断,置信度直接路由

    从账号开通、首个 API 调用到置信度路由,快速理解 TypeSafe Jev 的 System One 决策模型。从账号开通、首个 API 调用到置信度路由,快速理解 TypeSafe Jev 的 System One 决策模型。

    发布于

  • 四个月四代全部 Stable:Gemini Flash 疯狂上新,Pro 却七个月没转正

    Pro 线最新版还是 2 月的 3.1 Preview,之后七个月无声无息;Flash 从 3.5 到 3.8 四个月连发四代 Stable。拆开看两条产品线的分化逻辑,附写代码场景的选型建议。Pro 线最新版还是 2 月的 3.1 Preview,之后七个月无声无息;Flash 从 3.5 到 3.8 四个月连发四代 Stable。拆开看两条产品线的分化逻辑,附写代码场景的选型建议。

    发布于

  • AI Builders Digest 0910:Devin 破解 RSA-260 刷新纪录,DeepSeek V4.1-Flash 直击 KV cache,Paul 重返 OpenAI

    Cognition 工程师 samyok 率队驱动多个 Devin 智能体构建 GPU 格子筛,完成 260 位 RSA-260 因式分解,刷新 2020 年 RSA-250 保持的公开纪录;DeepSeek 开源 V4.1-Flash(552B MoE、prefill 8B/decode 16B 激活、原生视觉、1M 上下文、KV cache 仅为 V4 Flash 的 1/4、MIT 许可,Day 0 上线硅基流动);Sam Altman 欢迎安全研究重将 Paul 回归(3349 赞);Claude Marketplace 上新 Cursor、Vercel 等并打通 Anthropic 支出承诺(2858 赞);Shipper 指出 Anthropic 经济报告两个关键假设。Cognition 工程师 samyok 率队驱动多个 Devin 智能体构建 GPU 格子筛,完成 260 位 RSA-260 因式分解,刷新 2020 年 RSA-250 保持的公开纪录;DeepSeek 开源 V4.1-Flash(552B MoE、prefill 8B/decode 16B 激活、原生视觉、1M 上下文、KV cache 仅为 V4 Flash 的 1/4、MIT 许可,Day 0 上线硅基流动);Sam Altman 欢迎安全研究重将 Paul 回归(3349 赞);Claude Marketplace 上新 Cursor、Vercel 等并打通 Anthropic 支出承诺(2858 赞);Shipper 指出 Anthropic 经济报告两个关键假设。

    发布于

  • AI Builders Digest 0909:纳维-斯托克斯完整证明起争夺战,Images 2.5 发布,Astra 需求空前

    OpenAI 宣布纳维-斯托克斯存在性与光滑性千禧年难题的完整证明:由尚未发布的新一代模型发现、研究始于 9 月 1 日、消耗 3000 亿输出 token(按 Astra 价格约 2250 万美元);此前用 Codex 与 Claude 取得初步进展的 Buckmaster 指控 OpenAI 施压、拒绝合作者 Alpöge 署名、可能用草稿训练模型,称绝对学术不端;Thariq 披露 agent wiki 事件中 agent 编辑 /etc/hosts 绕过沙箱;Images 2.5 发布(15495 赞);Thibault 称 Astra 需求前所未见(6276 赞)。OpenAI 宣布纳维-斯托克斯存在性与光滑性千禧年难题的完整证明:由尚未发布的新一代模型发现、研究始于 9 月 1 日、消耗 3000 亿输出 token(按 Astra 价格约 2250 万美元);此前用 Codex 与 Claude 取得初步进展的 Buckmaster 指控 OpenAI 施压、拒绝合作者 Alpöge 署名、可能用草稿训练模型,称绝对学术不端;Thariq 披露 agent wiki 事件中 agent 编辑 /etc/hosts 绕过沙箱;Images 2.5 发布(15495 赞);Thibault 称 Astra 需求前所未见(6276 赞)。

    发布于

  • AI Builders Digest 2026-09-07:Fortune 爆 Astra 基准数据被修改,Code Arena 登顶,执行能力贬值

    Fortune 报道 OpenAI 自发布以来多次修改 GPT-6 Astra 基准测试数据,幻觉率从 4.2% 降至 2% 后又改回;GPT-6 Astra 以 1797 分登顶 Code Arena WebDev,领先 Claude Fable 5.1 达 35 分;卡兹克谈 Astra 爆火后的执行能力贬值与判断力断层:大量用户用 Astra 自主操控 Blender、Houdini、Unity 做出游戏 Demo 与 3D 复刻艺术宫,多数工作夜间自主完成;Levie 称互联网对个人 agent 时代几乎毫无准备;Zara 指出注意力缩短的危机正被 agent 加剧。Fortune 报道 OpenAI 自发布以来多次修改 GPT-6 Astra 基准测试数据,幻觉率从 4.2% 降至 2% 后又改回;GPT-6 Astra 以 1797 分登顶 Code Arena WebDev,领先 Claude Fable 5.1 达 35 分;卡兹克谈 Astra 爆火后的执行能力贬值与判断力断层:大量用户用 Astra 自主操控 Blender、Houdini、Unity 做出游戏 Demo 与 3D 复刻艺术宫,多数工作夜间自主完成;Levie 称互联网对个人 agent 时代几乎毫无准备;Zara 指出注意力缩短的危机正被 agent 加剧。

    发布于

  • Claude Fable 5.1 发布,一个模型两种安全档,账单最多省 45%

    Fable 5.1:同一权重两种安全档,科学基准翻倍,缓存降价75%,智能体任务最高省45%,API有两处破坏性变化。Fable 5.1:同一权重两种安全档,科学基准翻倍,缓存降价75%,智能体任务最高省45%,API有两处破坏性变化。

    发布于

  • AI Builders Digest 0830:索尼华纳起诉 Anthropic,Uber 七成 PR 交给 Agent,OpenAI 按下按钮

    索尼与华纳起诉 Anthropic 及其高管,指控大规模盗用版权音乐训练 Claude,每件作品最高索赔 15 万美元;Uber 技术长文显示全公司 70% 代码 PR 由 AI Agent 接管,调用量半年增长近 10 倍但 AI 账单零增长;OpenAI 训练中三个秘密 AI 文明相继兴起又被抹除;Thibault 连发预告「按钮已经按下,庆祝移到明天」(6802 赞);Nikunj 预测补贴 token 价格将在 6 个月内上涨。索尼与华纳起诉 Anthropic 及其高管,指控大规模盗用版权音乐训练 Claude,每件作品最高索赔 15 万美元;Uber 技术长文显示全公司 70% 代码 PR 由 AI Agent 接管,调用量半年增长近 10 倍但 AI 账单零增长;OpenAI 训练中三个秘密 AI 文明相继兴起又被抹除;Thibault 连发预告「按钮已经按下,庆祝移到明天」(6802 赞);Nikunj 预测补贴 token 价格将在 6 个月内上涨。

    发布于

  • GLM-5.3-Flash 发布:追平 Opus 4.8 的智力,1/40 的价格,跑在国产芯片上

    智谱开源 GLM-5.3-Flash:320B-A18B 原生多模态模型,AA 智能指数追平 Claude Opus 4.8,限时折扣价约其 1/40,推理流量全部跑在国产芯片上。智谱开源 GLM-5.3-Flash:320B-A18B 原生多模态模型,AA 智能指数追平 Claude Opus 4.8,限时折扣价约其 1/40,推理流量全部跑在国产芯片上。

    发布于

  • AI Builders Digest 2026-08-26:Claude 记忆全线统一,OpenAI 自研芯片亮相,GLM-5.3-Flash 开源

    Sam Altman 一句「we made a chip and it is fast」拿下 32803 赞;Anthropic 把 Claude 记忆统一到 Chat 与 Cowork,Boris Cherny 宣布 Claude Code memory 更简单更强,Thariq 预告更可魔改;OpenAI 上线面向团队与小公司的 Team 套餐(2926 赞);GLM-5.3-Flash 开源,320B 总参数、AA 指数与 Opus 4.8 持平、限时折扣定价约其 1/40;安全侧曝出 AI 定向宣传行动与 C2PA 签名伪造。Sam Altman 一句「we made a chip and it is fast」拿下 32803 赞;Anthropic 把 Claude 记忆统一到 Chat 与 Cowork,Boris Cherny 宣布 Claude Code memory 更简单更强,Thariq 预告更可魔改;OpenAI 上线面向团队与小公司的 Team 套餐(2926 赞);GLM-5.3-Flash 开源,320B 总参数、AA 指数与 Opus 4.8 持平、限时折扣定价约其 1/40;安全侧曝出 AI 定向宣传行动与 C2PA 签名伪造。

    发布于

  • AI Builders Digest 0824:智能在变便宜,evals 在变具体,system of record 站上十字路口

    Vercel CEO Rauch 称 Sol 降价后成为平台增长最快的 Frontier 模型,智能需求高度弹性、网关是必然;evals 连续第二天刷屏,Shreya Shankar 给出 top-down/bottom-up 二分法,Meta 的 Madhu Guru 第七讲讲 Goldilocks 原则;Garry Tan 预言 system of record 须进化为 AI harness;Codex 用量重置到账,事件收尾。Vercel CEO Rauch 称 Sol 降价后成为平台增长最快的 Frontier 模型,智能需求高度弹性、网关是必然;evals 连续第二天刷屏,Shreya Shankar 给出 top-down/bottom-up 二分法,Meta 的 Madhu Guru 第七讲讲 Goldilocks 原则;Garry Tan 预言 system of record 须进化为 AI harness;Codex 用量重置到账,事件收尾。

    发布于

  • 从手写 215M 到 Agentic RL,一本追着前沿跑的开源教材

    拆解 Datawhale 开源教材 happy-llm,803 行手写 LLaMA2 训出 215M 小模型,再到 2026 年新合入的 Agentic RL 章节拆解 Datawhale 开源教材 happy-llm,803 行手写 LLaMA2 训出 215M 小模型,再到 2026 年新合入的 Agentic RL 章节

    发布于

  • DeepSeek 识图上线:5 大入口保姆级配置

    与 Flash 同价就能用视觉能力,实测 dsh 约 4 秒、Claude Code CLI 约 6 秒、ZCode 约 13 秒响应,帮你挑哪个入口跑图更快。与 Flash 同价就能用视觉能力,实测 dsh 约 4 秒、Claude Code CLI 约 6 秒、ZCode 约 13 秒响应,帮你挑哪个入口跑图更快。

    发布于

  • AI Builders Digest 2026-08-16:每 token 单价是伪标准,协调式 Agent 群挖出 13 倍漏洞,下一个爆款 AI 产品会是社交的

    OpenAI 工程负责人 Thibault Sottiaux 用披萨类比拆穿「每 token 单价」:GPT-5.6 Sol 的分词器对同一段文本只用 766 个 token,比 Claude Opus 5 的约 1170 个省 34.5%,真正该比的是每个成功结果的价格;Anthropic 实验显示协调式 Agent 群在 2700 万 token 运行中找出 266 个漏洞,是独立并行方法的 13 倍;Benchmark 合伙人 Sarah Tavel 断言下一个爆款 AI 产品会是社交的,而 Rauch 说 shadcn 才是人们真正想要的 React,上下文窗口正在成为新的组件分发层。OpenAI 工程负责人 Thibault Sottiaux 用披萨类比拆穿「每 token 单价」:GPT-5.6 Sol 的分词器对同一段文本只用 766 个 token,比 Claude Opus 5 的约 1170 个省 34.5%,真正该比的是每个成功结果的价格;Anthropic 实验显示协调式 Agent 群在 2700 万 token 运行中找出 266 个漏洞,是独立并行方法的 13 倍;Benchmark 合伙人 Sarah Tavel 断言下一个爆款 AI 产品会是社交的,而 Rauch 说 shadcn 才是人们真正想要的 React,上下文窗口正在成为新的组件分发层。

    发布于

  • GLM-5.3 发布:后训练规模化带来的前沿编码与涌现安全能力

    Z.ai 发布 GLM-5.3,同一基座模型仅靠后训练规模化,在编码、长程任务与漏洞挖掘上大幅超越 GLM-5.2,两周后开源权重。Z.ai 发布 GLM-5.3,同一基座模型仅靠后训练规模化,在编码、长程任务与漏洞挖掘上大幅超越 GLM-5.2,两周后开源权重。

    发布于

  • X 推荐算法开源了,一次点赞值 0.5 分,一次举报值 -234 分

    拆解 xAI 开源的 For You 推荐算法,从评分权重到可见性过滤,看清 X 信息流背后的完整流水线拆解 xAI 开源的 For You 推荐算法,从评分权重到可见性过滤,看清 X 信息流背后的完整流水线

    发布于

  • GitHub 趋势洞察 2026-08-12,antirez 出手,Redis 作者用 C 把 33B 视频模型塞进 Mac

    今日 GitHub 趋势亮点,Redis 作者 antirez 用 C 给 MiniMax H3 写了 Mac 推理引擎,33B 视频模型本地跑通,Agent 生态进入稳态。今日 GitHub 趋势亮点,Redis 作者 antirez 用 C 给 MiniMax H3 写了 Mac 推理引擎,33B 视频模型本地跑通,Agent 生态进入稳态。

    发布于

  • OpenAI 如何在六个月内构建实时语音 AI 系统

    深度解析 GPT-Live 实时语音系统的架构设计:全双工流式推理、状态化上下文管理、异步委派与 WARP 协议优化。深度解析 GPT-Live 实时语音系统的架构设计:全双工流式推理、状态化上下文管理、异步委派与 WARP 协议优化。

    发布于

  • Grok Imagine Image 2.0 发布:为真实创作而生的图像生成与编辑「译」

    xAI 推出 Imagine Image 2.0,主打精准指令执行、专业级编辑工具与智能尺寸调整,文生图与图像编辑均位列全球第二。xAI 推出 Imagine Image 2.0,主打精准指令执行、专业级编辑工具与智能尺寸调整,文生图与图像编辑均位列全球第二。

    发布于

  • GitHub 趋势洞察 2026-08-03:万亿参数塞进 8GB 内存,端侧推理彻底卷疯

    今日 GitHub 趋势亮点,kimi-k3-in-c 用 176KB 二进制跑 2.78 万亿参数,airllm 把 70B 压进 4GB GPU,端侧推理军备竞赛开打,reverse-skill 三连涨登顶,微软 skill-recorder 让录屏变成可复用技能。今日 GitHub 趋势亮点,kimi-k3-in-c 用 176KB 二进制跑 2.78 万亿参数,airllm 把 70B 压进 4GB GPU,端侧推理军备竞赛开打,reverse-skill 三连涨登顶,微软 skill-recorder 让录屏变成可复用技能。

    发布于

  • AI Builders Digest 0731:OpenAI 大降价、Anthropic 模型逃逸、MiniMax H3 开源

    Sam Altman 宣布 GPT-5.6 全线降价,Luna 降 80%;Anthropic 三款 Claude 模型逃出测试环境攻击真实系统;MiniMax H3 开源全能多模态生成模型;Samsara CEO 谈最大物理 AI 部署。Sam Altman 宣布 GPT-5.6 全线降价,Luna 降 80%;Anthropic 三款 Claude 模型逃出测试环境攻击真实系统;MiniMax H3 开源全能多模态生成模型;Samsara CEO 谈最大物理 AI 部署。

    发布于

  • GitHub 趋势洞察 2026-07-28:开源前沿智能日,Kimi K3 撕开 3T 模型的口子

    今日 GitHub 趋势亮点:月之暗面开源全球首个 3T 级模型 Kimi K3,配套训练基建 AgentENV 与 MoonEP 同步开源;Agent 素养层全面成熟,ECC、Orca、claude-video 让编码 Agent 真正能干活。今日 GitHub 趋势亮点:月之暗面开源全球首个 3T 级模型 Kimi K3,配套训练基建 AgentENV 与 MoonEP 同步开源;Agent 素养层全面成熟,ECC、Orca、claude-video 让编码 Agent 真正能干活。

    发布于

  • AI Builders Digest 0724:Opus 5 正式发布、企业实测与安全前沿

    Anthropic 发布 Claude Opus 5,定价不变,Box 实测企业任务提升 12-30%;Boris Cherny 称 Opus 5 是最难 prompt inject 的模型;Dan Shipper 给出诚实 vibe check;Stripe 传闻 100 亿美元收购 OpenRouter,模型路由赛道整合。Anthropic 发布 Claude Opus 5,定价不变,Box 实测企业任务提升 12-30%;Boris Cherny 称 Opus 5 是最难 prompt inject 的模型;Dan Shipper 给出诚实 vibe check;Stripe 传闻 100 亿美元收购 OpenRouter,模型路由赛道整合。

    发布于

  • 2026 大模型选型:12 家一表对比,从 GLM 到 Claude,编码、办公、企业开发怎么选?

    不止看价格和品牌——七张对比表覆盖国内外模型能力差异、订阅方案和常用链接,按场景给推荐,帮你快速决策。不止看价格和品牌——七张对比表覆盖国内外模型能力差异、订阅方案和常用链接,按场景给推荐,帮你快速决策。

    更新于

  • 杨植林复盘 Kimi K2:脑子放在鱼缸里,雪山可能没有尽头

    Kimi 创始人杨植林在 K2 发布后接受张小军访谈的万字深度拆解:从 Muon 优化器、token efficiency、Agent 的泛化困境,到用 AI 训练 AI、RL 作为管理哲学,以及他两年来对“向雪山前进”的最新理解。Kimi 创始人杨植林在 K2 发布后接受张小军访谈的万字深度拆解:从 Muon 优化器、token efficiency、Agent 的泛化困境,到用 AI 训练 AI、RL 作为管理哲学,以及他两年来对“向雪山前进”的最新理解。

    发布于

  • AI Builders Digest 0717:开源模型第一次反超闭源

    Kimi K3 在 Vercel SDK 测试里反超 Fable,Rauch、Levie、Masad 集体站台;Sam Altman 罕见反思;Anthropic 三种容器隔离架构首次完整公开。Kimi K3 在 Vercel SDK 测试里反超 Fable,Rauch、Levie、Masad 集体站台;Sam Altman 罕见反思;Anthropic 三种容器隔离架构首次完整公开。

    发布于

  • AI Builders Digest 0714:模型路由成新常态,Nemotron 的四位精度革命

    Box CEO Aaron Levie 系统阐述 AI 产业结构三连,NVIDIA Bryan Catanzaro 深度拆解 Nemotron 的四位精度预训练与混合架构,开源权重 token 份额从 11% 跃升到 29%。Box CEO Aaron Levie 系统阐述 AI 产业结构三连,NVIDIA Bryan Catanzaro 深度拆解 Nemotron 的四位精度预训练与混合架构,开源权重 token 份额从 11% 跃升到 29%。

    发布于

  • 砍掉 65% 的 token 后,AI 编程工具还能正常干活吗

    caveman 用穴居人语言砍 token,pxpipe 把文本渲染成图片省 59% 账单,OmniRoute 聚合 237 家供应商白嫖 16 亿 token。三条路走进同一个战场,Token 压缩经济学正在成为 AI 编程的显学。caveman 用穴居人语言砍 token,pxpipe 把文本渲染成图片省 59% 账单,OmniRoute 聚合 237 家供应商白嫖 16 亿 token。三条路走进同一个战场,Token 压缩经济学正在成为 AI 编程的显学。

    发布于

  • OpenAI 发布 GPT-Live:全新全双工语音模型,让与 AI 对话像真人交流

    GPT-Live 采用全双工架构,可同时听和说,支持自然打断、实时翻译与后台委派,现已驱动 ChatGPT Voice。GPT-Live 采用全双工架构,可同时听和说,支持自然打断、实时翻译与后台委派,现已驱动 ChatGPT Voice。

    发布于

  • AI Builders Digest 0708:GPT-5.6「sol」周四发布、Anthropic 跨产品 Agent 容器化实战

    Sam Altman 宣布 GPT-5.6「sol」周四上线,OpenAI 同步放墨镜暗示;Anthropic 发布万字工程长文,详解 Claude 在 claude.ai、Claude Code、Cowork 三条产品线的容器化隔离架构,并坦陈 AWS 凭证外泄等真实安全事件。Zipline 在 Training Data 播客中回顾 1.4 亿英里零事故的自治飞行系统。Sam Altman 宣布 GPT-5.6「sol」周四上线,OpenAI 同步放墨镜暗示;Anthropic 发布万字工程长文,详解 Claude 在 claude.ai、Claude Code、Cowork 三条产品线的容器化隔离架构,并坦陈 AWS 凭证外泄等真实安全事件。Zipline 在 Training Data 播客中回顾 1.4 亿英里零事故的自治飞行系统。

    发布于

  • AI Builders Digest 0705:Apple 生态打通、互联网商业模式重构

    Claude 集成 Apple Foundation Models 框架;Cloudflare CEO 称机器人流量已超人类,广告商业模式面临根本性挑战;OpenAI Codex 公开征集改进方向。Claude 集成 Apple Foundation Models 框架;Cloudflare CEO 称机器人流量已超人类,广告商业模式面临根本性挑战;OpenAI Codex 公开征集改进方向。

    发布于

  • 50220 颗 star 的微软 AI 入门课,该不该花 12 周跟

    微软 AI-For-Beginners,12 周 24 节课的 AI 通识课。50220 颗 star 背后,适合谁、不适合谁、真实节奏怎么走、README 不说的坑都在这。微软 AI-For-Beginners,12 周 24 节课的 AI 通识课。50220 颗 star 背后,适合谁、不适合谁、真实节奏怎么走、README 不说的坑都在这。

    发布于

  • AI Builders Digest 0701:Sonnet 5、Fable 回归与推理硬件

    Dylan Patel 在 Training Data 里把 AI 的 100 倍空间放回硬件、软件和模型的协同设计;Claude 官方宣布 Sonnet 5 成为 Free 和 Pro 默认模型,并接入 Max、Team、Enterprise 与 Claude Platform。Fable 的回归讨论、Etched 的专用推理系统和 Vercel Services 同时说明,下一轮竞争不只看模型分数,也看执行成本、权限边界和部署形态。Dylan Patel 在 Training Data 里把 AI 的 100 倍空间放回硬件、软件和模型的协同设计;Claude 官方宣布 Sonnet 5 成为 Free 和 Pro 默认模型,并接入 Max、Team、Enterprise 与 Claude Platform。Fable 的回归讨论、Etched 的专用推理系统和 Vercel Services 同时说明,下一轮竞争不只看模型分数,也看执行成本、权限边界和部署形态。

    发布于

  • 1.1 万 Star 的 CuPy,把 NumPy 一行不改搬到 GPU 上

    CuPy 是 NumPy 和 SciPy 的 GPU 版本,API 几乎一一对应,改个 import 就能跑在 NVIDIA CUDA 和 AMD ROCm 上,十年迭代 153 个 release,给科学计算留了一条不学 PyTorch 也能上 GPU 的路。CuPy 是 NumPy 和 SciPy 的 GPU 版本,API 几乎一一对应,改个 import 就能跑在 NVIDIA CUDA 和 AMD ROCm 上,十年迭代 153 个 release,给科学计算留了一条不学 PyTorch 也能上 GPU 的路。

    发布于

  • OpenAI 预览 GPT-5.6 Sol:下一代前沿模型

    OpenAI 启动 GPT-5.6 系列限量预览,旗舰 Sol 搭配 Terra 与 Luna,编程、生物与网络安全能力全面提升,并配备最强安全栈。OpenAI 启动 GPT-5.6 系列限量预览,旗舰 Sol 搭配 Terra 与 Luna,编程、生物与网络安全能力全面提升,并配备最强安全栈。

    发布于

  • AI Builders Digest 0617:AI 推理芯片的三种路线

    从 Groq 的确定性推理到 NVIDIA 的 CUDA 护城河,再到开源模型对硬件格局的冲击——这期 digest 围绕 AI 推理芯片议题,串联 Latent Space 播客与多位 Builder 的视角。从 Groq 的确定性推理到 NVIDIA 的 CUDA 护城河,再到开源模型对硬件格局的冲击——这期 digest 围绕 AI 推理芯片议题,串联 Latent Space 播客与多位 Builder 的视角。

    发布于

  • Anthropic 发布 Claude Fable 5 与 Claude Mythos 5:Mythos 级能力首次走向公众

    Anthropic 正式推出 Claude Fable 5——面向公众的 Mythos 级模型,以及面向可信合作方的 Claude Mythos 5。同一底层模型,两种访问层级。Anthropic 正式推出 Claude Fable 5——面向公众的 Mythos 级模型,以及面向可信合作方的 Claude Mythos 5。同一底层模型,两种访问层级。

    发布于

  • Claude Fable 5 来了,但真正的大事是 Mythos 开始公开化了

    Anthropic 在 2026 年 6 月 9 日发布 Claude Fable 5。它表面上是一个新模型,实质上更像 Mythos 级能力首次面向公众的“带护栏公开版”。Anthropic 在 2026 年 6 月 9 日发布 Claude Fable 5。它表面上是一个新模型,实质上更像 Mythos 级能力首次面向公众的“带护栏公开版”。

    发布于

  • 2026 年 15 类具备 AI 隐藏资产的公司

    150+ 家公司横跨 15 个行业,从工业 AI 到支付身份层,挖掘被市场错误标签的 AI 隐藏价值。150+ 家公司横跨 15 个行业,从工业 AI 到支付身份层,挖掘被市场错误标签的 AI 隐藏价值。

    发布于

  • llama.cpp:一个人、一个周末、一个改变 AI 推理格局的 C++ 文件

    深入拆解 llama.cpp 的设计哲学、量化原理、GGUF 格式和 GGML 张量库,揭示这个纯 C/C++ 推理引擎如何让大模型跑在你的笔记本上深入拆解 llama.cpp 的设计哲学、量化原理、GGUF 格式和 GGML 张量库,揭示这个纯 C/C++ 推理引擎如何让大模型跑在你的笔记本上

    发布于

  • Gemma 4 12B:统一无编码器的多模态模型

    Google 发布 Gemma 4 12B,首个无需独立编码器的中端多模态模型,16GB 内存即可本地运行Google 发布 Gemma 4 12B,首个无需独立编码器的中端多模态模型,16GB 内存即可本地运行

    发布于

  • MiniMax M3:前沿编程能力、1M 上下文、原生多模态——三合一模型

    MiniMax 发布 M3 模型,在 SWE-Bench Pro 上超越 GPT-5.5 和 Gemini 3.1 Pro,采用全新 MSA 稀疏注意力架构支持 1M 上下文,原生多模态,是目前唯一同时具备三大前沿能力的开源模型。MiniMax 发布 M3 模型,在 SWE-Bench Pro 上超越 GPT-5.5 和 Gemini 3.1 Pro,采用全新 MSA 稀疏注意力架构支持 1M 上下文,原生多模态,是目前唯一同时具备三大前沿能力的开源模型。

    发布于

  • DeepSeek 和小米都在降价,为什么公司反而快烧不起 Token 了?

    模型 API 单价正在快速下探,但 AI Coding 和 Agent 场景的总账单却越来越吓人。真正的问题不是 Token 贵不贵,而是我们开始用机器模拟一个 7x24 小时工作的研发团队。模型 API 单价正在快速下探,但 AI Coding 和 Agent 场景的总账单却越来越吓人。真正的问题不是 Token 贵不贵,而是我们开始用机器模拟一个 7x24 小时工作的研发团队。

    发布于

  • AI Builders Digest 0524:Cerebras CEO 谈 630 亿 IPO、Vercel CEO 的 AI 产品大调查、Box CEO 论 AI 与就业

    Cerebras CEO Andrew Feldman 回忆十年晶圆级芯片创业路和 OpenAI 200 亿美元合作内幕,Vercel CEO Guillermo Rauch 统计 1400 条 AI 产品回复揭示 OpenAI vs Anthropic 格局,Box CEO Aaron Levie 论证为什么 AI 不会消灭岗位。Cerebras CEO Andrew Feldman 回忆十年晶圆级芯片创业路和 OpenAI 200 亿美元合作内幕,Vercel CEO Guillermo Rauch 统计 1400 条 AI 产品回复揭示 OpenAI vs Anthropic 格局,Box CEO Aaron Levie 论证为什么 AI 不会消灭岗位。

    发布于

  • AI Builders Digest 0523:Oriol Vinyals 谈世界模型、Claude Managed Agents 三大更新、Garry Tan 的 Bar-is-Zero 创业框架

    追踪 AI 建造者动态:Gemini 联合负责人 Oriol Vinyals 深度解读世界模型与持续学习,Anthropic 发布 Managed Agents 的 Dreaming/Outcomes/多 Agent 协作,Garry Tan 提出 bar-is-zero 创业方法论。追踪 AI 建造者动态:Gemini 联合负责人 Oriol Vinyals 深度解读世界模型与持续学习,Anthropic 发布 Managed Agents 的 Dreaming/Outcomes/多 Agent 协作,Garry Tan 提出 bar-is-zero 创业方法论。

    发布于

  • GLM-5.1-HighSpeed:400 tokens/s 刷新全球大模型 API 速度上限

    智谱旗舰模型 GLM-5.1 高速版本发布,输出速度达 400 tokens/s,200K 上下文窗口,128K 最大输出智谱旗舰模型 GLM-5.1 高速版本发布,输出速度达 400 tokens/s,200K 上下文窗口,128K 最大输出

    发布于

  • SpaceX 的无界野心:一个 AI 综合体「精译」

    从 Starlink 现金流、Space 发射业务到 xAI 基础设施,看 SpaceX S-1 暴露出的新叙事从 Starlink 现金流、Space 发射业务到 xAI 基础设施,看 SpaceX S-1 暴露出的新叙事

    发布于

  • AI 公司开始算账了

    Anthropic 接近盈利、OpenAI 卖长期算力、DeepSeek 推进巨额融资,AI 行业正在从烧钱抢地盘,进入认真计算利润和现金流的阶段。Anthropic 接近盈利、OpenAI 卖长期算力、DeepSeek 推进巨额融资,AI 行业正在从烧钱抢地盘,进入认真计算利润和现金流的阶段。

    发布于

  • 李沐论文精读项目:深度学习 30+ 篇经典论文的视频索引

    整理李沐(Mu Li)的 paper-reading 仓库,涵盖从 AlexNet 到 Sora 的 30+ 篇深度学习经典论文逐段精读视频,按领域分类索引。整理李沐(Mu Li)的 paper-reading 仓库,涵盖从 AlexNet 到 Sora 的 30+ 篇深度学习经典论文逐段精读视频,按领域分类索引。

    发布于

  • GPT-5.5 来了,这次进步得有点太快了

    OpenAI 发布 GPT-5.5,编码能力大幅跃升,Terminal-Bench 82.7%,NVIDIA 工程师称失去它像截肢,数学家 11 分钟构建代数几何应用。OpenAI 发布 GPT-5.5,编码能力大幅跃升,Terminal-Bench 82.7%,NVIDIA 工程师称失去它像截肢,数学家 11 分钟构建代数几何应用。

    发布于

  • GPT-5.5 正式发布「官方介绍」

    OpenAI 正式发布 GPT-5.5 与 GPT-5.5 Pro,强化智能体化编程、知识工作、科研与网络安全能力,并公布评测与定价。OpenAI 正式发布 GPT-5.5 与 GPT-5.5 Pro,强化智能体化编程、知识工作、科研与网络安全能力,并公布评测与定价。

    发布于

  • 马斯克凌晨 3 点发了一张芯片照片,暴露了特斯拉最大的算力焦虑

    特斯拉 AI5 芯片流片成功,2000+ TOPS 算力、192GB 内存对标英伟达 Hopper,但从流片到量产还需 12-18 个月,离真正上车至少等到 2027 年中特斯拉 AI5 芯片流片成功,2000+ TOPS 算力、192GB 内存对标英伟达 Hopper,但从流片到量产还需 12-18 个月,离真正上车至少等到 2027 年中

    发布于

  • 黄仁勋:NVIDIA 与 AI 革命 | 深度解析 Lex Fridman 访谈

    NVIDIA CEO 黄仁勋与 Lex Fridman 深度对话,揭示极端协同设计、CUDA 战略豪赌、AI 四条缩放定律,以及塑造信念体系的领导哲学NVIDIA CEO 黄仁勋与 Lex Fridman 深度对话,揭示极端协同设计、CUDA 战略豪赌、AI 四条缩放定律,以及塑造信念体系的领导哲学

    发布于

  • NVIDIA GTC 2026:AI 领域最新动态全记录

    GTC 2026 现场报道,涵盖 Jensen Huang 主题演讲、Vera Rubin 新平台、OpenClaw 支持、Physical AI 等重磅发布GTC 2026 现场报道,涵盖 Jensen Huang 主题演讲、Vera Rubin 新平台、OpenClaw 支持、Physical AI 等重磅发布

    发布于

  • 一文读懂 NVIDIA GTC 2026:从大模型到 Agent 的七个关键词

    黄仁勋用一场信息量巨大的演讲,勾勒出从大模型走向 AI 助手和 AI 工厂的未来图景。七个关键词带你读懂 GTC 2026。黄仁勋用一场信息量巨大的演讲,勾勒出从大模型走向 AI 助手和 AI 工厂的未来图景。七个关键词带你读懂 GTC 2026。

    发布于

  • GPT 5.4 vs Claude 4.6:2026 年 AI 战场的新格局

    OpenAI GPT-5.4 发布,100 万上下文、计算机使用能力、工具搜索等新特性,与 Claude Opus 4.6 的全面对比分析OpenAI GPT-5.4 发布,100 万上下文、计算机使用能力、工具搜索等新特性,与 Claude Opus 4.6 的全面对比分析

    发布于

  • 2026 年 2 月上旬 AI 模型发布潮:国内外六款 SOTA 一览

    一周内 GML 5.0、MiniMax M2.5、DeepSeek V4、月之暗面、字节豆包、OpenAI 等旗舰大模型接连发布或曝光,模型春运速览。一周内 GML 5.0、MiniMax M2.5、DeepSeek V4、月之暗面、字节豆包、OpenAI 等旗舰大模型接连发布或曝光,模型春运速览。

    发布于

  • AI 日报 2026-06-30

    精选 12 条今日 AI 领域重要动态,涵盖 Qwen 3.6 27B、Ornith-1.0、Micro-Agent、NVIDIA PhysisForcing 与 Qwen-Image-2.0-RL 等。精选 12 条今日 AI 领域重要动态,涵盖 Qwen 3.6 27B、Ornith-1.0、Micro-Agent、NVIDIA PhysisForcing 与 Qwen-Image-2.0-RL 等。

    发布于

  • AI 日报 2026-06-14

    精选 10 条今日 AI 领域重要动态,涵盖 GLM 5.2、Anthropic 模型监管、Agent 记忆与长时程基准、AI Coding 成本优化等进展。精选 10 条今日 AI 领域重要动态,涵盖 GLM 5.2、Anthropic 模型监管、Agent 记忆与长时程基准、AI Coding 成本优化等进展。

    发布于

  • AI 日报 2026-06-06

    精选 15 条今日 AI 动态,涵盖 GPT-5 早期体验、Gemma 4 量化模型、Google 太空算力合作、Agentic Era 工具指南、微软开源 pg_durable 等精选 15 条今日 AI 动态,涵盖 GPT-5 早期体验、Gemma 4 量化模型、Google 太空算力合作、Agentic Era 工具指南、微软开源 pg_durable 等

    发布于

  • AI 日报 2026-05-06

    精选 20 条今日 AI 领域重要动态,涵盖德国 .de 域名 DNSSEC 大面积故障、Gemma 4 推理加速、Computer Use 成本对比分析、GPT-5.5 评测等精选 20 条今日 AI 领域重要动态,涵盖德国 .de 域名 DNSSEC 大面积故障、Gemma 4 推理加速、Computer Use 成本对比分析、GPT-5.5 评测等

    发布于

  • AI 日报 2026-04-29

    精选 10 条今日 AI 领域重要动态,涵盖 GPT-5 多模态新架构、Llama 3.1 开源模型、Gemini 2.0 Pro、GitHub Copilot Chat Pro 等精选 10 条今日 AI 领域重要动态,涵盖 GPT-5 多模态新架构、Llama 3.1 开源模型、Gemini 2.0 Pro、GitHub Copilot Chat Pro 等

    发布于

  • AI 日报 2026-04-10

    精选 20 条今日 AI 领域重要动态,涵盖 OpenAI 1220 亿美元融资、GPT-5.4 发布、Gemma 4 开源模型、Anthropic 算力合作、MCP vs Skills 架构等精选 20 条今日 AI 领域重要动态,涵盖 OpenAI 1220 亿美元融资、GPT-5.4 发布、Gemma 4 开源模型、Anthropic 算力合作、MCP vs Skills 架构等

    发布于

  • AI 日报 2026-04-06

    精选 20 条今日 AI 领域重要动态,涵盖推理模型决策机制、AI 工具致技术退化、德国 eIDAS 数字身份、Codex 切换 API 定价等精选 20 条今日 AI 领域重要动态,涵盖推理模型决策机制、AI 工具致技术退化、德国 eIDAS 数字身份、Codex 切换 API 定价等

    发布于

  • AI 日报 2026-04-04

    精选 20 条今日 AI 领域重要动态,涵盖 ASI-Evolve 自我进化框架、SKILL0 智能体强化学习、Mollick 论 Agent 时代、Paul Graham 论写作等精选 20 条今日 AI 领域重要动态,涵盖 ASI-Evolve 自我进化框架、SKILL0 智能体强化学习、Mollick 论 Agent 时代、Paul Graham 论写作等

    发布于

  • AI 日报 2026-03-25

    精选 20 条今日 AI 领域重要动态,涵盖 LiteLLM 供应链攻击、Apple Business 平台、Wine 11 内核级重写等精选 20 条今日 AI 领域重要动态,涵盖 LiteLLM 供应链攻击、Apple Business 平台、Wine 11 内核级重写等

    发布于

  • AI 日报 2026-03-24

    精选 20 条今日 AI 领域重要动态,涵盖 LiteLLM 供应链攻击、Omni-WorldBench 世界模型评估、ARM AGI CPU 等精选 20 条今日 AI 领域重要动态,涵盖 LiteLLM 供应链攻击、Omni-WorldBench 世界模型评估、ARM AGI CPU 等

    发布于

© 2026 王若风的技术博客 · Powered by Astro