EP.86
Friday, 22 May 2026
W E E K L Y   A I   I N T E L

每周 AI 情报

EP.86  ·  2026 W20
Editorial Frame v3.0
Coverage 05-16 → 05-22
★ THIS WEEK'S BIG THREE 本 · 周 · 三 · 事 Coverage 05-16 → 05-22
Editor's
Note如何读这份简报
这是 2026 年第 20 周 AI 行业的全景速读。本周关键词:持续自主、竞合反转、公地溢出。我们扫描了 150+ 个独立信号(本周新增约 80 条),落在 17 格地图上点亮 11 格,提炼出三条主线—— 🤖 Agent 进入"持续自主"拐点、💱 算力市场的"敌人变供应商"反转、⚠️ AI 在公共基础设施上的"溢出"🗺️ 先看 Landscape · 🔍 点击 A/B/C 卡片或 dim chip 可筛选 · 🔗 全文 ~90 条原始信源链接已内嵌 · ↗ 标记表示该事件不在严格的 05-16 → 05-22 范围内 · ❓ 标记表示未找到可信原始信源
9 维度 · 横向主题 点击 chip 高亮对应格子 · 与下方 A/B/C 主线互补
Insight · 观点洞察 · 本周三条主线 ↓ 点击卡片在地图高亮覆盖格子;点击标题跳到对应章节
§ Model 模型层 · 基础设施 / 算法 / 安全 本层维度 📊 Benchmark 05-20🏆 OpenAI 推翻 Erdős 80 年猜想 · 05-15Claude 自主优化 optimizer 接近人类 · 05-21InferenceBench:Agent 仍落后人类
§ Application 应用层 · 企业落地 / 科学 / 机器人 / 端侧 本层维度
§ Dev Stack 开发者层 · Agent 工程化 + 协调架构 + 工具链攻防 本层维度
§ Signals 信号层 · 潜信号 / 市场信号 / HowTo 本层维度

贯穿地图的 9 个横向维度

这些维度不是 17 格中的某一格,而是"横跨多格"的主题。每张维度卡片右上角的小色点对应地图中各格右下角的小色点。

维度 1 · 主线 A
🤖 持续自主
  • Figure Helix-02:24 小时无人干预
  • OpenAI 推翻 Erdős 80 年猜想
  • SU-01 30B 模型 IMO/USAMO 金牌
  • Code with Claude:50% PR 不审阅
维度 2 · 主线 B
💱 算力反转
  • Anthropic 月付 xAI $12.5 亿至 2029
  • Anthropic 洽谈 Maia 200(脱 NVIDIA)
  • OpenAI-微软独家解绑
  • 数据中心租约 15 月 +220%
维度 3 · 主线 C
⚠️ 公地溢出
  • Linus:Linux 安全列表被 AI 淹没
  • arXiv 1 年 LLM 幻觉禁令
  • Pwn2Own:AI 编程工具全沙箱逃逸
  • 美国大学毕业典礼学生嘘 AI
维度 4 · 跨主线
💰 Cost · 钱
  • Anthropic $1.2 万亿超 OpenAI
  • Q2 经营利润 $5.59 亿(首次)
  • OpenAI 9 月 IPO 招股书
  • Cerebras / SiMa.ai / Exa $2.5 亿 C 轮
维度 5 · 跨主线
⚔️ Platform · 权
  • KPMG 27.6 万员工 Claude
  • Cursor 趁 GitHub 宕机抢市场
  • Gemini Spark / Cowork / Muse Spark
  • OpenAI vs Apple 法律行动
维度 6 · 跨主线
🔒 Security · 安全
  • Pwn2Own:6 个 AI 编程工具沙箱逃逸
  • OpenAI + Google C2PA + SynthID
  • Cloudflare Mythos 测 50 repo
维度 7 · 跨主线
📋 Governance · 治理
  • 白宫 AI 行政令草案:90 天预审
  • arXiv 1 年 LLM 幻觉禁令
  • 马里兰 $20 亿 AI 电网账单
维度 8 · 跨主线
🌐 Geopolitics · 地缘
  • 中国效率护城河被反复验证
  • Kimi K2.6 超越 GPT-5.4 / Claude Opus
  • 书生 Intern-S2-Preview 35B 比肩万亿
维度 9 · 跨主线
👥 Labor · 劳动力
  • 50% PR 不审阅 = 工程师审查角色消失
  • 大学生嘘 AI 演讲
  • 好莱坞编剧匿名训 AI

Agent 进入 "持续自主" 拐点

★ 主线 A| 14 篇时间线| 1 篇 ★ 重点| 本期最强冲击力

物理(Figure 24 小时分拣)+ 数学(OpenAI 推翻 Erdős 80 年猜想)+ 软件(LangSmith Engine 自动诊断修复)+ 编程(Code with Claude 50% PR 不审阅)—— 本周四个完全独立的领域同时穿越了"无人干预"的运行门槛。

本周让人意识到一件事:"AI 能不能持续运行"已经不是真问题了;真问题是"我们还在不在审查它做了什么"。Figure Helix-02 连续 24 小时分拣包裹接近人类水平、全程板载推理;OpenAI 内部推理模型自主推翻 1946 年 Erdős 离散几何猜想(独立外部数学家撰写同伴论文验证);LangChain SmithDB + Engine 让生产 trace 自动聚类失败、识别代码问题、提出修复——可观测性变成了自我改进飞轮;最戏剧化的是 Anthropic Code with Claude 伦敦峰会披露:半数 PR 由 Claude 编写、完全未经人工阅读直接合并。再加上 Karpathy 加入 Anthropic Pre-training,本周这条线像四个独立时钟同时敲响。

§ 1Chronology · 时间线
  1. ★ 本期重点
    05-15🤖 Figure Helix-02:24 小时无人干预自主运行:Figure AI 展示 Helix-02 连续 24 小时以上自主运行,包裹分拣吞吐量接近人类水平,全程板载推理、零遥操作。从"几分钟演示"到"24 小时持续"是可靠性的质变。包裹分拣是物流行业人力需求最大、环境最标准化的场景,直接商业化价值极高。本期收尾趋势判断围绕这件事展开。
    机器人
  2. 05-20🧮 OpenAI 推理模型自主推翻 80 年未解 Erdős 离散几何猜想:OpenAI 内部通用推理模型推翻 1946 年平面单位距离问题(Paul Erdős 提出)的主流信念:引入代数数论工具构造无穷族反例,提供多项式级别改进;外部数学家独立撰写同伴论文验证。不同于"AI 辅助证明",这次完全由通用推理模型自主完成——AI 已具备真正的数学创造力,而非仅在人类框架内搜索。
    评测/AI4S
  3. 05-15🥇 SU-01:30B 参数达 IMO 2025 / USAMO 2026 金牌水平:通过反向困惑度课程 SFT + 两阶段 RL 流水线 + 测试时缩放,30B-A3B 参数模型在 IMO、IPhO 等竞赛达到金牌水平,支持超过 100K token 长推理链。关键突破不在参数规模(30B 并不大),而在训练流水线设计。
    基础模型
  4. 05-15🔄 LangChain SmithDB + LangSmith Engine:可观测性变成自我改进飞轮:SmithDB 是专为 Agent trace 数据设计的数据库;LangSmith Engine 消费 trace,自动聚类失败、识别代码问题并提出修复建议和 evals——把可观测性变成了持续改进闭环。AgentOps 从"监控工具"向"自进化基础设施"演进的标志性产品动作。
    智能体
  5. 05-15Prime Intellect:Claude Opus 4.7 自主搜索 optimizer,接近人类基线:在 nanoGPT speedrun 基准上,Opus 4.7 达 2930 步、GPT-5.5 达 2950 步,而人类基线为 2990 步。经过约 1 万次运行和 1.4 万 H200 GPU 小时。AI 开始自主优化 ML 训练流程本身——如果延续,AI 训练工程师的工作方式将在 12-18 个月内发生根本性变化。
    评测
  6. 05-21⚠️ Anthropic Code with Claude 伦敦峰会:50% PR 不审阅直接合并:现场披露半数开发者提交的 PR 由 Claude 编写但完全未经人工阅读直接合并;Anthropic 声称 Claude Code 本身的大部分代码由 Claude 编写;新功能 Dreaming 让 Agent 跨任务积累并共享知识。"AI 替代开发者代码审阅"最直接的商业证据——软件工程的"人工质量门"正在消失。
    专业编码
  7. 05-20🎯 Claude Code /goal 功能:设定可验证完成条件,AI 持续工作直到达标:v2.1.139+ 新功能——`/goal` 命令设定完成条件后,Claude 跨多 turn 持续工作直到条件满足。把 Claude Code 从"每次执行一个子任务"变成"自主完成整个项目目标"。
    专业编码
  8. 05-15📱 OpenAI Codex 移动端:手机远程监控后台 AI 编程任务:用户可在 ChatGPT 手机 App 中发起任务、查看输出、批准命令,同时 Codex 在后台运行。同步支持 Remote SSH GA、Hooks。Codex 从桌面工具变成"可随时随地监控"的 AI 员工
    专业编码
  9. 05-15🌳 GitHub Copilot App 技术预览:并行工作流 + PR 生命周期管理:桌面端 Copilot App 支持并行代码流、整个仓库 / PR 生命周期管理。AI 工具正从"补全代码"演进为"管理整个开发过程"的 Agent。
    专业编码
  10. 05-19💰 Cursor Composer 2.5:以 Claude Opus 4.7 1/10 成本同等编程性能:直接挑战模型厂商定价权。如果延续,Anthropic 高端模型定价将面临结构性压力。
    专业编码
  11. 05-19🌟 Andrej Karpathy 加入 Anthropic Pre-training 团队:Karpathy 本人发文确认。极少数既有顶级研究深度又有大众教育影响力的"两栖型"人才——意味着 Claude 系列下一代基础能力获得了最强公众可信度的工程背书;本期"Anthropic 全面超越 OpenAI"叙事最戏剧性的人事注脚。
    组织
  12. 05-20🌐 SIMA 2 + Genie + Street View:虚拟世界 Agent 持续运行:DeepMind SIMA 2 可在 3D 虚拟环境中实时感知、与玩家协作推理;Genie 与 Street View 整合实现对全球真实街道场景的交互式仿真——机器人可在全球数千万条街道的数字孪生中虚拟训练。
    具身
  13. 05-15🧪 SDAR:自蒸馏式 Agent 强化学习:将 On-Policy Self-Distillation 作为门控辅助目标,相对 GRPO 在 ALFWorld +9.4%、Search-QA +7.0%、WebShop +10.2%。Agent RL 训练不稳定性的实用解决方案。
    评测/智能体
§ 2Watch Points · 观察点
下期 5/29 EP.87
Figure 是否公布第二个无人干预场景(仓库/工厂以外)+ 物流公司试点签约信号
2 期 6/05 EP.88
Anthropic 是否在 IPO 招股书 / model card 中披露"AI 编写 / 不审阅"比例
4 期 6/19
OpenAI 是否公开 Erdős 反例工作的完整流水线 + 进入数学预印本平台
中长期 Q3
是否出现"持续自主 Agent + 真实事故"的首个公开案例(最早预警信号)
§ 3Practical · 明天能用
For Builders
技术人
本周值得动手:在 Claude Code 中试用 /goal 命令(先用单元测试作为可验证完成条件);对生产 Agent 接入 LangSmith Engine 把 trace 转为失败聚类与修复建议;编程预算紧的话评估 Cursor Composer 2.5(1/10 成本);建立"哪些事我不再审 + 为什么"的政策清单。
For Decision-Makers
决策者
最重要的战略动作:把"AI 不审查比例"纳入 KPI——参考 Anthropic 50% PR 不审阅,评估你的工程团队哪些代码路径(测试 / 文档 / 数据迁移 / 工具脚本)可从"必审"切到"抽审"。同时立即评估 Figure Helix 类持续自主物理 Agent 对你所在行业的替代风险(物流 / 仓储 / 零售 / 制造首当其冲)。
For Investors
投资者
"持续自主"赛道的资本定锚:Figure(物理)+ LangChain(软件)+ Exa(搜索)正在拉高估值;同时关注"AI Agent 失败率验证"赛道——这是与"自主性"反向对冲的稀缺资产。

算力市场的 "竞合" 反转

★ 主线 B| 12 篇时间线| 1 篇 ★ 重点| 本期最戏剧反转

Anthropic 月付 xAI $12.5 亿至 2029 年购买 Colossus 算力(昔日竞争对手转型供应商)+ 同时与微软洽谈租用 Maia 200 自研芯片(脱 NVIDIA 信号)+ OpenAI-微软独家协议正式解绑 + 数据中心租约 15 月飙 220% —— 算力市场的所有"独家锁定"叙事同周崩塌。

本周 AI 算力市场出现了它历史上最戏剧的两个反转。第一个:Anthropic 将每月向 Elon Musk 的 xAI 支付 12.5 亿美元购买算力,合同锁定至 2029 年 5 月——Musk 此前是 OpenAI/Anthropic 的公开批评者,如今成为后者核心算力供应商。第二个:Anthropic 同时洽谈租用 Azure Maia 200 自研芯片——首个重量级"脱 NVIDIA"客户。再加上 OpenAI-微软独家解绑、五大科技公司数据中心租约 15 月飙至 $8220 亿(+220%)、马里兰居民被迫承担 $20 亿 AI 电网账单——整个市场告诉你:商业逻辑已经凌驾于公司价值观之上。

§ 1Chronology · 时间线
  1. ★ 本期重点
    05-20💱 Anthropic 月付 xAI $12.5 亿购买算力——竞争对手变供应商:Elon Musk 的 xAI 向 Anthropic 出售算力,月费高达 12.5 亿美元。Musk 曾是 OpenAI/Anthropic 的公开批评者,如今成为后者核心算力供应商,商业利益超越公司价值观分歧。每月 12.5 亿意味着 xAI 算力收入远超 Grok 产品收入。本周最具戏剧性的商业反转——本期收尾趋势判断围绕这件事展开。
    市场信号/AI Infra
  2. 05-22📊 Epoch AI:前沿实验室算力仅占全球 30%,Anthropic-Colossus 合同锁定至 2029 年:OpenAI、Anthropic、xAI 三家前沿实验室算力可能不足全球 AI 算力总量的 30%,Google 和 Meta 占绝对算力主导;Anthropic-SpaceX/Colossus 合同 $12.5 亿/月至 2029 年 5 月。重新定义了 AI 竞争中的"算力版图"——公众叙事聚焦 OpenAI/Anthropic 算力争夺,但 Google/Meta 几乎不被计入。
    AI Infra
  3. 05-21🔌 Anthropic 洽谈租用 Azure Maia 200 自研芯片:Anthropic 考虑在 Azure 上租用 Maia 200 推理芯片(TSMC 3nm、HBM)。若达成,将是迄今最大规模的"脱 NVIDIA"信号之一;对微软:Maia 200 首个重量级外部客户将大幅提升自研芯片的商业化可信度。
    AI Infra/市场信号
  4. 05-17🔓 OpenAI 与微软正式"解绑":微软 130 亿美元投资已产生 300 亿+ 收入回报,OpenAI 是 Azure AI 最大客户(贡献约 60%),但双方关系从独家走向开放。OpenAI 可能在 AWS/GCP 上提供服务,对 Google Cloud(Anthropic 战略投资方)是利好。
    观点洞察
  5. 05-18📈 五大科技公司数据中心租约 15 月飙升 220% 至 $8220 亿:微软、亚马逊、谷歌、Meta、甲骨文"未开始的数据中心租约承诺"从 $2570 亿激增至 $8220 亿。AI 基础设施军备竞赛不仅未见顶,实际建设速度甚至落后于承诺速度。
    市场信号
  6. 05-20美国最大电网加速推进数据中心能源计划:AI 对电力基础设施的压力从"预期"正式转变为"排期",公用电力股全面上涨。电力、输配电、冷却设备正成为 AI 算力产业链的新核心环节。
    AI Infra
  7. 05-19📉 马里兰居民被迫承担 $20 亿 AI 电网升级账单:马里兰州普通纳税人承担 20 亿美元电网升级费用以支持州外 AI 数据中心运营,已向 FERC 投诉。AI 数据中心外部成本正从"地方讨论"变成"联邦监管议题"。
    潜信号/Cost
  8. 05-20💎 黄仁勋发现 $2000 亿新市场 + NVIDIA 持初创股权 $430 亿:黄仁勋指向 AI 基础设施扩张和物理 AI 作为 NVIDIA 下一增长引擎;首次披露持有初创公司股权高达 430 亿美元(含 OpenAI、Anthropic、Cohere 等)。NVIDIA 从"GPU 卖家"进化为"AI 产业链股权投资者"。
    市场信号
  9. 05-18🏆 Anthropic 估值首次超越 OpenAI:$1.2 万亿 vs OpenAI $8800 亿:Q1 2026 年营收 ARR 同比 80 倍增长、$39B 年化营收、Fortune 500 大多数公司成为客户。"OpenAI 是 AI 行业代名词"的时代正在结束。
    市场信号
  10. 05-21💰 Anthropic Q2 2026 首次经营利润 $5.59 亿:Q2 年化收入从 48 亿跃升至 109 亿(+127%),预期实现史上首个经营利润季度。P/S 约 27 倍——已有收入支撑。
    市场信号
  11. 05-20🚀 OpenAI 提交保密 IPO 招股书,9 月上市,估值剑指万亿:高盛 + 摩根士丹利联合承销,目标 9 月敲钟;恰在 Musk 诉讼败诉次日。AI 行业进入"超级 IPO 窗口"。
    市场信号
  12. 05-18🇨🇳 中国 AI 实验室在出口限制下形成"效率护城河":被算力限制倒逼出的极致效率优势正在形成西方难以复制的竞争壁垒;本周 Kimi K2.6 在代码基准首次超越 GPT-5.4 和 Claude Opus 4.6;书生 Intern-S2-Preview 35B 参数比肩万亿模型。效率基因已植入——重新定义出口管制的战略逻辑。
    观点洞察
§ 2Watch Points · 观察点
下期 5/29 EP.87
xAI 是否公布首批 Colossus Anthropic 算力上线进度 / Maia 200 谈判是否进入实质性条款披露
2 期 6/05
OpenAI 是否官方宣布在 AWS 或 GCP 提供 API 服务(独家解绑的具体落地)
4 期 6/19
OpenAI IPO 招股书披露细节 + Anthropic 是否启动 IPO 流程
中长期 Q3
数据中心选址监管立法(FERC / 各州 / 中国 / 欧盟)是否首批出台 + AI 用水强制申报
§ 3Practical · 明天能用
For Builders
技术人
本周值得检查:你的推理供应链是否"单点依赖"?DeepSeek V4Kimi K2.6(已超 GPT-5.4)、Cohere Command A+ 218B 开源都已具备生产替代能力;关注 Qwen3.6 MTP 本地 1.8×——隐私敏感场景的本地化窗口已打开。
For Decision-Makers
决策者
把"算力供应商弹性"作为 AI 采购第一原则——参考 Anthropic 三路算力布局(xAI + SpaceX + Maia)。如果你在数据中心富集地区,立即评估 马里兰 $20 亿电网账单类政策风险(电价上涨 + 居民抗议 + 监管收紧)。
For Investors
投资者
"算力商品化"三条投资线:① NVIDIA 替代芯片(Cerebras IPO + SiMa.ai $14B + Anthropic 试水 Maia 200);② 数据中心基础设施(电力、冷却、REIT);③ 开源前沿模型(Kimi K2.6、Cohere Command A+)作为 API 定价权下行的对冲。同时警惕:债券市场已对 AI 通胀影响定价

AI 在 公共基础设施 上的"溢出"

★ 主线 C| 10 篇时间线| 1 篇 ★ 重点| 本期最广战线

Linus Torvalds 痛斥 Linux 安全列表被 AI 漏洞淹没"几乎无法管理" + arXiv 对 LLM 幻觉论文 1 年禁令 + Pwn2Own Berlin 所有 AI 编程工具被沙箱逃逸 + Google 向开放 Web 宣战 + 美国大学毕业典礼学生集体嘘 AI 演讲 + 美国公众民调系统性反 AI。

本周让人警觉的,是 AI 在它没准备好的地方"溢出"了——溢出到 Linus Torvalds 的 Linux 安全邮件列表,让他公开宣布"几乎无法管理";溢出到 arXiv 学术预印本平台,迫使其对 LLM 幻觉论文实施 1 年提交禁令;溢出到 Pwn2Own Berlin 的赛场,所有主流 AI 编程工具全部被沙箱逃逸;溢出到 Google 搜索框,整个开放 Web 的链接经济被宣战;溢出到美国大学毕业典礼,学生用嘘声打断对 AI 的正面演讲。这不是某一个领域的局部问题——是 AI 在公共基础设施上"承载力同时被突破"的星期。

§ 1Chronology · 五个领域同周溢出
  1. ★ 本期重点
    05-18🐧 Linus Torvalds:Linux 安全邮件列表被 AI 漏洞报告淹没"几乎无法管理":AI 驱动的漏洞扫描工具大量生成低质量安全报告,导致 Linux 安全邮件列表信噪比崩溃。继 RPCS3 / Godot AI PR 泛滥后,AI 生成内容冲击开源基础设施的最高量级案例。Linux 内核安全是全球基础设施的核心护栏——如果 AI 噪声导致真实漏洞淹没在误报中,意味着全球最关键的软件安全流程面临新型风险。
    AI 安全
  2. 05-17📚 arXiv 对含 LLM 幻觉的论文实施 1 年提交禁令:严厉措施:1 年提交禁令,强调所有作者对论文内容负全责。学术界对"AI 生成学术垃圾"容忍极限的集体信号——arXiv 是 AI 研究的主要预印本平台,其政策转变将直接影响 AI 研究的发表和可信度审查方式。
    AI 安全/学术
  3. 05-18🔓 Pwn2Own Berlin 2026:所有主流 AI 编程工具被沙箱逃逸:Cursor / LM Studio / Codex / Claude Code 全部成为攻击目标——六支研究团队联合演示沙箱逃逸技术,核心攻击向量是凭据(credentials)而非模型本身。"IAM 看不到"意味着现有安全监控框架尚未覆盖 AI Agent 行为。
    AI 安全
  4. 05-20🌐 Google 正在向开放 Web 宣战:I/O 2026 AI 搜索策略:HN 194 分热讨——AI 直接给出答案意味着用户不再点击来源网站,整个 Web 经济的激励结构正在崩塌。搜索驱动约 40% 的 Web 流量;当 AI 成为信息最终消费终点而非分发入口,媒体 / 博客 / 专业内容站的商业模式面临结构性挑战。
    应用/观点洞察
  5. 05-20🎓 美国多所高校毕业典礼:学生集体嘘声抗议 AI 赞美演讲:演讲者对 AI 正面表述遭学生集体嘘声抵制,一位演讲者回击"Deal with it"。当科技圈内部还在讨论 AI 带来的生产力飞跃时,最直接面对就业市场的年轻世代已经开始公开表达抵制
    潜信号/Labor
  6. 05-20📉 AI 热潮正在失去美国公众信任:多项民调同步逆转:The Algorithmic Bridge 汇编迄今最全面的美国民众 AI 态度数据集——皮尤、盖洛普、哈里斯民调无论问题措辞和采样方法如何差异,结论高度一致:美国公众对 AI 态度系统性转负。AI 监管立法的政治可行性随之上升。
    观点洞察
  7. 05-20👁 Google 悄悄应对针对 AI 搜索结果的操控攻击:恶意方通过投毒训练数据、注入 prompt 等手段影响 AI 搜索输出。当用于战略分析的 AI 搜索结果本身可能被恶意操控,信息安全的边界从"数据层"延伸到了"模型输出层"
    AI 安全/应用
  8. 05-21🌏 毛利语 TTS 模型:拒绝大型科技公司,优先社区主权:新西兰毛利语 TTS 模型开发者拒绝了 Google/Microsoft/Amazon 的合作和数据采购条件,坚持以社区数据主权和文化价值为第一优先级——不对外开放 API,不接受平台托管。"语言数据主权"将成为 AI 治理新热点。
    潜信号/治理
  9. 05-19💧 乔治亚州 AI 数据中心 15 个月秘密抽取 2900 万加仑水:未申报情况下消耗 2900 万加仑水,直到居民因水压异常低才被发现;地方官员最终拒绝罚款——AI 基础设施扩张中监管缺失的极端案例
    潜信号/治理
  10. 05-20🛡️ 白宫 AI 安全行政令草案:90 天预发布审查窗口:AI 公司自愿在发布前 90 天将模型提交政府审查(OpenAI/Anthropic 倾向 14 天);财政部牵头建立 AI 安全漏洞清除机制。美国首个正式前沿 AI 模型"预发布政府审查"框架
    治理
§ 2Watch Points · 观察点
下期 5/29 EP.87
arXiv 1 年禁令是否被其他平台跟进(OpenReview / SSRN / bioRxiv);Linux 基金会是否发"AI 漏洞报告规范"草案
2 期 6/05
白宫 AI 行政令是否正式签署 + 90 天预审标准是否被压回 14 天
4 期 6/19
Google 是否回应"向开放 Web 宣战"批评 + 是否调整 AI Overview 源站点引流机制
中长期 Q3
是否出现"AI 数据中心被州政府否决"的具体案例(继马里兰投诉、乔治亚拒罚之后)
§ 3Practical · 明天能用
For Builders
技术人
不要再用 AI 自动生成漏洞报告 / Issue / PR 提交到开源项目——在Linus 警告后这是社区共识。如果你的产品依赖 Pwn2Own 中失守的 Cursor / Codex / Claude Code,立即检查凭据隔离 + IAM 监控。学术研究者:本周开始在论文显眼位置声明 AI 使用
For Decision-Makers
决策者
把"AI 输出的下游接收方是否有承载力"作为 AI 项目设计第一原则——别让你的 AI 客服把工单数翻 10 倍而人工还在审;别让 AI SEO 把内容稿件量翻 100 倍而读者无法消费。同时立即评估 AI 搜索操控攻击 对你战略情报来源的污染风险。
For Investors
投资者
"AI 公地溢出"两面押注:① 承载力增强工具——AI 漏洞分诊 / AI 论文反幻觉检测 / AI 内容溯源(参考 OpenAI + Google C2PA + SynthID);② 监管合规服务——白宫行政令推动 90 天预审,AI 合规即服务是确定性赛道。同时小心"AI 内容 + 开放 Web 流量"商业模式的存量公司(媒体 / SEO / 长尾博客)——Google 向 Web 宣战是结构性看空信号。

📱 多模态 · 推理效率 · 端侧

  • 05-20🎵 Stable Audio 3.0:开源 6 分钟完整音乐Stability AI 发布家族(small SFX 459M / small / medium 1.4B / large 2.7B),medium/large 可生成 6 分 20 秒结构完整音乐;前三款开源权重。结合 Gemini Omni + Spotify × ElevenLabs,2026 下半年音视频内容生产成本将接近零。
  • 05-19🎲 微软 4B O-Voxel:3 秒 2D→3D + PBR 材质新几何格式 O-Voxel,CUDA 上不到 100ms,输出 GLB 含完整 PBR 材质,可直接用于 Blender / Unity / Unreal,完全开源。4B 参数 + 3 秒完成 + 开源意味着企业无需云端 API 即可实现高质量 3D 资产自动化。
  • 05-17Mercury 2 + SubQ-1M:扩散 LLM 1000 tok/s + 1M token 上下文 1/5 成本Mercury 2 推理超过 1000 tok/sec(人类阅读速度 10×),AI 推理速度瓶颈消除;SubQ-1M-Preview 首个商用亚二次方稀疏注意力 LLM,原生 120 万 token,约为 Frontier 模型 1/5 成本。
  • 05-15📊 Datadog Toto 2.0:5 个 Apache 2.0 时间序列基础模型从 4M 到 2.5B 参数,在 BOOM / GIFT-Eval / TIME 三大基准全部第一,首次证明时间序列基础模型 Scaling Law 可能已成立。AIOps / 金融风控 / 能源调度等大量企业场景的核心基础。
  • 05-15🌐 Google Chrome AI 功能悄悄占用 4GB 存储Chrome 为支持 Gemini Nano 本地 AI 功能,在后台下载 4GB weights.bin,用户毫不知情。直接删除没用——必须进设置关闭。设备端 AI 推理带来的新型"存储霸占"问题。

🧪 AI4S · 训练前沿 · 科研流水线

🧰 Agent 工具 · 协议 · 个人开发者

💼 行业垂直 · 治理 · 个人 AI 战争

📅 周期说明 · 本节目每周五更新。下方观察点的时间标签:下期 = 下周五 5/29 EP.87 · 2 期 = 下下周五 6/05 EP.88 · 4 期 = 4 周后 6/19 · 中长期 = 未来 2-3 个月 · 回访 = 上一期 / 上几期押注的验证
线索 判断依据 + 具体观察点(嵌套)
★ 故事线 A
🤖 持续自主物理 + 软件 + 编程 + 数学同周穿越
判断依据
本周四件事独立但同时穿越门槛——Figure Helix 24 小时无人干预(物理)、OpenAI 推翻 Erdős 80 年猜想(数学)、LangSmith Engine 自我改进飞轮(软件)、Code with Claude 50% PR 不审阅(编程)。Karpathy 加入 Anthropic Pre-training 是创始人级人才用脚投票确认这是 2026 H2 真正战场。
  • 基于以上判断,下面是具体观察点
  • 下期 5/29Figure 是否公布第二个无人干预场景 + 物流公司试点签约信号
  • 2 期 6/05Anthropic 是否在 model card / IPO 招股书中披露 "AI 编写代码 / AI 审阅" 比例
  • 4 期 6/19OpenAI 是否公开 Erdős 反例工作的完整流水线 + 进入数学预印本平台
  • 夏季 7-9 月是否出现"持续自主 Agent + 真实事故"首个公开案例(最早预警)
★ 故事线 B
💱 算力反转敌人变供应商 / 独家全面解绑
判断依据
Anthropic 月付 xAI $12.5 亿至 2029(Musk 一年前还在公开骂 Anthropic)+ Anthropic 洽谈 Maia 200(脱 NVIDIA 信号)+ OpenAI-微软独家解绑 + 数据中心租约 +220% + Epoch:前沿实验室仅占 30%。AI 算力市场进入"商品化成熟期"——没有永远的敌人,只有永远的合同
  • 基于以上判断,下面是具体观察点
  • 下期 5/29xAI 是否公布首批 Colossus Anthropic 算力上线进度 + Maia 200 谈判是否进入实质性条款披露
  • 2 期 6/05OpenAI 是否官方宣布在 AWS 或 GCP 提供 API 服务
  • 4 期 6/19OpenAI IPO 招股书披露细节 + Anthropic 是否启动 IPO
  • Q3数据中心选址监管立法(FERC / 各州 / 中国 / 欧盟)是否首批出台
★ 故事线 C
⚠️ 公地溢出开源/学术/安全/公众信任同周受冲击
判断依据
Linus 痛斥 + arXiv 1 年禁令 + Pwn2Own AI 工具全沙箱逃逸 + Google 向开放 Web 宣战 + 大学生嘘 AI + 民调系统反 AI —— 6 个独立公共基础设施同周宣告"承载力突破"。AI 主要溢出到维护型工作(漏洞审阅、同行评议、内容审核),而非创造型工作。2026 H2 的最大监管风险是"维护型 AI 太烂"。
  • 基于以上判断,下面是具体观察点
  • 下期 5/29arXiv 1 年禁令是否被其他平台跟进(OpenReview / SSRN / bioRxiv)+ Linux 基金会是否发"AI 漏洞报告规范"草案
  • 2 期 6/05白宫 AI 行政令是否正式签署 + 90 天预审标准是否被压回 14 天
  • 4 期 6/19Google 是否回应"向开放 Web 宣战"批评 + 调整 AI Overview 源站点引流机制
  • Q3是否出现"AI 数据中心被州政府否决"的具体案例
📌 上期回访EP.85 押注本周兑现追踪
EP.85 提出的核心押注
EP.85 收尾趋势判断:"2026 H2 会形成第一个完整的 AI → 硬件 → 更强 AI 闭环。第一个明确信号会在 Google I/O 上:如果下一代 TPU 的 keynote 里出现'由 AlphaEvolve 设计'的字样,闭环就从'实验室'进入'产线'。"
  • 本周(EP.86)兑现进展
  • ◐ 部分兑现Google I/O 2026 发布 Gemini 3.5 Flash / Gemini Omni / Co-Scientist / SIMA 2,但未直接提及"AlphaEvolve designed TPU"——闭环信号未在 keynote 显式确认
  • ✓ 间接兑现NVIDIA Vera Rubin 平台专为 Agentic AI 大规模部署设计,是"AI 反向影响硬件需求"的另一条验证路径
  • ⚠ 反向证据本期 Story B 的"算力商品化"反而成了 EP.85 闭环命题的反向证据—— 如果算力可被随时买卖,那么"硬件设计权"作为护城河的价值正在下降
  每周 AI 情报 · EP.86 · v12 fresh build · 150+ 信号 · 11 热区 · 3 主线 · 9 跨维度 · ~90 条原始链接  
Coverage 2026-05-16 → 2026-05-22 · 第 20 周
Set in Fraunces & Source Serif 4 · Issued 2026-05-22
AI 解释
▶ 本期分享 · 视频导览 滑动到文章 · 高亮卡片点击播放对应讲解 收起 ▾