Anthropic 在这场大会上完成了从"模型公司"到"Agent 平台公司"的公开战略身份切换,代价是接受 Colossus 1 算力协议——与三个月前称其"邪恶"的 Musk 签约。
反共识:这场大会最重要的信号不是任何单一功能发布,而是 Anthropic 首次公开承认"瓶颈不是模型能力,而是算力供给"——当 80 倍增长压力迫使它接受有条件算力依赖,安全优先叙事的品牌资本正在被部分兑换为规模执行资本。
这场大会的核心不是任何单一功能,而是 Anthropic 一次公开的战略身份切换。背景数据触目惊心:年化收入从 2025 年底 $90 亿 → 大会前夕 $300 亿(增长 3.3 倍);Q1 2026 实际增长 80 倍,远超内部预测的 10 倍;API 调用量同比 17 倍,token 同比 70 倍。
这种"幸福的危机"迫使 Anthropic 公开承认:瓶颈不再是模型能力,而是算力供给与工作流架构。CPO Ami Vora 的"没有新模型"宣言,是一次刻意为之的叙事颠覆,将竞争平面从模型分数搬到 Agent 运行时和企业合同密度。
一个 Lead Agent 将任务拆分委派给子 Agent,每个子 Agent 拥有独立的模型、提示词、工具与 MCP servers。所有 Agent 运行于同一容器和文件系统,结果汇总回 Lead Agent 的全局上下文。
与 LangGraph、CrewAI 概念重叠,但 Anthropic 将其做成有限制、有可观测性的托管服务。1 层深度限制是关键设计选择——强制扁平化胜于深层递归的失控风险。客户案例:Netflix 平台团队用它并行分析数百次构建日志。
范式转换:从"指令式提示"到"评分式定义"——开发者写 markdown rubric 描述"成功长什么样",一个独立的 Grader Agent 在完全隔离的上下文窗口中评判产出,防止推理路径污染。
默认最多迭代 3 次,上限 20 次。Anthropic 内部测试最多提升 10 个百分点(.docx 生成 +8.4%、.pptx +10.1%)。医疗文档审查公司 Wisedocs 审查时间缩短 50%。
本质是"被产品化的 Ralph 循环"——把社区手写的"循环→评判→重试"模式升级为 API 一等公民,让 Agent 工作变得可验收,而不是"跑完看运气"。
本质:一个异步、调度型的离线内省进程,不修改模型权重。扫描现有 Memory Store + 最多 100 条历史会话,提炼模式、清理重复条目,生成 plain-text notes 和 "playbooks"。
支持模型:claude-opus-4-7 和 claude-sonnet-4-6。需双 Beta 标头:managed-agents-2026-04-01 + dreaming-2026-04-21。
客户案例:法律 AI 公司 Harvey 任务完成率提升约 6 倍——大会被引用最多的客户数据。
Dreaming 的真正价值:给长程 Agent 提供"经验固化"中间层,介于 RAG 和微调之间。它不学新能力,只整理旧笔记——媒体把它包装成"AI 从错误中学习"是过度营销。安全警告:Pluto Security 指出提示注入的"假记忆"可通过 Memory Store 跨 session 持久留存。
Boris Cherny 的判断一针见血:"今后大量代码将以异步方式编写。" Claude Code 的产品边界在本次大会上从 CLI 工具扩展为横跨 CLI、IDE、桌面 GUI、Web、移动端、CI 集成、定时任务的持续运转层。
| 新功能 | 状态 | 核心价值 |
|---|---|---|
| Routines(异步自动化) | Research Preview | 打包 Claude Code 配置于 Anthropic 云执行,支持定时 / API / GitHub 三类触发器,无需本地机器开启 |
| Code Review | Research Preview | 专门 Agent 分析 PR 的逻辑错误、安全漏洞、边缘情况,以行级 inline comments 标注 |
| CI Auto-fix | 已发布 | PR 所有人"永远不会看到红 X"——Claude 在 CI 失败时自动推修复 |
| Remote Agents | 已发布 | 手机控制笔记本上的 Claude Code 进程,文件系统留在本地 |
| Desktop App | 已发布 | 从 CLI 升级为可同时运行多 sessions 的全屏 GUI |
速率限制翻倍(直接福利):Pro/Max/Team/Enterprise 五小时滚动窗口翻倍;取消 Pro/Max 高峰时段降配;Opus API Tier 1 输入 token/分钟 +1500%、输出 +900%。
⚠️ 周限额未提高——Anthropic 工程负责人 Amol Avasare 明确确认。
颠覆"大模型协调小模型"的传统思路:Sonnet 4.6 或 Haiku 4.5 端到端驱动 Agent 循环;Opus 4.6/4.7 在关键判断点被调用,读取完整共享上下文,返回 plan/correction/stop 信号(仅 400–700 tokens),不调用工具、不直接面对用户。启用方式:anthropic-beta: advisor-tool-2026-03-01。
为什么是 Colossus 1:它是 Anthropic 所有算力承诺中唯一能在 2026 年 5 月内交付的产能——Amazon 5GW 年内只到约 1GW;Google/Broadcom 5GW 要到 2027 年。SpaceX 合并 xAI 后 Colossus 1 的 GPU 利用率仅约 11%,训练已迁至 Colossus 2,恰好有整体容量可出租。
附带条款(重要):Musk 保留在"Claude 从事危害人类的行动"时收回算力的权利,但判定标准由 Musk 自定。Simon Willison 评:"这对 Anthropic 是一种新型供应链风险。"
环境争议:Colossus 1 在过去近一年由 30+ 台拖车大小的天然气涡轮机供电,未经 Clean Air Act 许可、未配污染控制设备,靠归类为"临时使用"规避监管。Memphis 已被列为美国"哮喘之都",NAACP 官方声明谴责 Anthropic 对历史性黑人社区的健康漠视。
Ami Vora keynote 开篇案例:Mythos 在 OpenBSD 源码树中发现一个 27 年的 TCP SACK 实现漏洞(1998 年添加的有符号整数溢出 bug,可远程 DOS 任何响应 TCP 的 OpenBSD 主机)。约 1000 次 scaffold 运行,总成本 < $20,000,找到该 bug 的特定运行成本 < $50。
同期发现:FreeBSD CVE-2026-4747 17 年远程代码执行漏洞、FFmpeg 16 年 H.264 codec 漏洞(500 万次 fuzz 测试未发现,Mythos 通过直接代码分析定位)。
Project Glasswing 联盟:12 家创始合作伙伴(含 AWS、Apple、Microsoft、Google、CrowdStrike、Palo Alto Networks),Anthropic 承诺最高 $1 亿使用积分 + $400 万捐款给开源安全组织。
| 旧范式 | 新范式 |
|---|---|
| 单次 prompt → 单次 response | Routines 配置 → 持续运转的云 Agent |
| 开发者编写工具链 harness | Anthropic 托管 Agent 运行时 |
| 会话结束记忆清空 | Memory Store + Dreaming 跨 session 积累 |
| 人工评估输出质量 | Grader Agent 自动评分,执行 Agent 自迭代 |
| 单模型执行 | Lead Agent + 专业子 Agent 编队 |
这种转变的工程本质是:Claude Code 的竞争对手不再只是 Cursor 或 Copilot,而是企业 IT 部门自建的 Agent 脚手架。Anthropic 把"沙盒+状态+工具+MCP+记忆+多 Agent 调度"打包成标准化 SaaS,从而让自建成本不再有竞争力。
这个架构本质上是介于 RAG 和微调之间的中间层——它不修改权重(避免连续学习的灾难性遗忘风险),但通过策展记忆库实现了跨 session 的经验积累。
潜在安全风险:提示注入的"假记忆"可以通过 Memory Store 跨 session 持久留存,这是 RAG 系统中没有的攻击面。
MCP 已捐赠给 Agentic AI Foundation(AAIF,Linux Foundation 旗下),Anthropic、Block、OpenAI 共同发起。安装基数 9700 万(2026 年 3 月),已越过网络效应临界点。
2026 路线图优先项:无状态 HTTP transport(水平扩展)/ Tasks 原语(异步长任务)/ MCP Apps(标准化 UI 组件)/ 集中化注册表。官方 SDK:TypeScript / Python / C# / Java / Swift / Go / Rust。
这是 Kubernetes 与 CNCF 的剧本复现:Anthropic 标准化接口,然后在托管实现上竞争。把 MCP 捐给中立基金会确保竞争对手也采用同一标准——而 Anthropic 的 Managed Agents 作为最完善实现赢得溢价。
| 供应商 | 规模 | 芯片 | 特点 |
|---|---|---|---|
| AWS(Amazon) | 1000 亿美元十年 | Trainium2/3 | 主训练云,Project Rainier |
| Google Cloud | 5 GW,5 年 2000 亿 | TPU(2027 起) | 占 Google Cloud backlog 40%+ |
| Microsoft Azure + NVIDIA | 300 亿 Azure 信用 | NVIDIA GPU | M365 分销捆绑 |
| SpaceX/Colossus 1 | 300 MW,22 万 GPU | H100/H200/GB200 | 月内可用,推理为主 |
Claude 是唯一同时上线 AWS Bedrock、Google Vertex AI、Microsoft Azure Foundry 三大云的前沿模型——三路分销,不被任何一方绑定。
SF(5/6)+ 伦敦(5/19)+ 东京(6/10),每站附带 Extended Day 独立开发者专场,全球免费直播——这是 Anthropic 版"WWDC"的战略卡位。
真正的复利在长期:JetBrains 2026 调查显示 Claude Code 企业采用同比增长 6 倍,在 AI 编码工具中增速最快,这正是持续生态建设的早期回报。
OpenAI:5 月 5–10 日没有针对 Code with Claude 的反向公告(Sam Altman 在法庭作证)。但 4–5 月连发 GPT-5.5、GPT-5.5 Instant、Codex for Chrome,节奏精确卡在 Code with Claude 前后。SpaceX 协议把"容量受限"叙事大半浇灭。
Google:最明显的撞日反击——5 月 6 日同日把 Jules(异步 coding agent)升级为全球公测,无 waitlist。真正回应窗口是 5 月 19 日 Google I/O 2026,恰好撞上 Code with Claude 伦敦站。
xAI/SpaceX:从"对手"转型为"算力房东"。Musk 三个月前骂 Anthropic "邪恶",5 月 6 日整租 Colossus 1——背后是 Colossus 1 约 11% 的 GPU 利用率需要货币化,以及 SpaceX 6 月 IPO 前的"AI 基础设施营收"故事需要 marquee 客户。
Claude Code:异步长程 Agent,终端原生,深度 agentic
Cursor:编辑器体验和多模型路由,UX 护城河
Copilot:企业标准化和采购流程,微软生态
Codex:异步云沙箱和 PR 评审门控
Claude Code 的"最爱率"是 Copilot 的 5 倍,反映开发者深度使用满意度的巨大差距。市场规模 $128 亿(2026)→ 预测 $300 亿(2032),增速支撑四家分层生存。
| 维度 | 美国(Anthropic 主导) | 中国(多厂商分散) |
|---|---|---|
| 基础模型 | Claude Opus 4.7 | GLM-5.1 / Qwen 3.x / DeepSeek V4 |
| 开发工具 | Claude Code + Cursor + Copilot | AutoClaw / ArkClaw / Bailian Plan |
| 运行时 | Managed Agents(托管) | 开源框架主导 |
| 算力 | AWS + Google + SpaceX 多云 | 华为昇腾 + 国产云(监管驱动) |
| 分销渠道 | Microsoft 365 + 三大云 | 钉钉 + 飞书 + 企微 + 信创体系 |
| 市场策略 | 封闭平台,高价值,垂直深耕 | 开放权重,低价格,全球南方渗透 |
Manus 事件(2026/4/27):中国 NDRC 正式禁止 Meta 对 Manus 的 $20–30 亿收购,将 agentic AI / 多步任务执行纳入受控技术目录——这是中国对 agentic AI 实施战略管制的标志性事件,预示跨境 agentic AI 的收购与扩张将面临持续审查。
Google I/O 2026(5/19)将正面回击
时间节点精确撞上 Code with Claude 伦敦站。Gemini 4 发布概率极高;Jules 下一代(代号 Jitro)将主打"KPI 驱动 / 成果导向"开发,直接对标 Outcomes。口号"Manually prompting your agents is so… 2025"已预告进攻方向。
Colossus 1 产能上线缓解但不彻底解决算力问题
周限额问题依然存在。关注 Memphis 环境诉讼进展——若升级至州级禁令,将成为 Anthropic 运营风险。Musk 的"Humanity Clause"条款是需要持续监控的不确定性。
Microsoft Build 2026(6/2–3)是微软的回应窗口
GitHub Copilot 多模型策略将强化;Claude M365 加载项与 Copilot 的渠道博弈将公开化。
Dreaming / Outcomes / Routines 首批真实客户数据
Harvey 6 倍任务完成率是唯一现有参考点。Mercado Libre Q3 2026"90% 自主编码"目标是最重要的观察窗口。若 Dreaming 安全风险被研究者公开验证,将引发治理讨论。
Claude Code 下一主版本发布窗口接近
当前 Sonnet 4.6 在 SWE-bench Verified 达 80.8%;Opus 4.7 Vals AI 金融基准 64.37%。下一主版本预计聚焦 computer use 可靠性(Vercept 团队融合成果)+ 更长连续任务支持。
SpaceX IPO(预计 6–8 月,估值 $1.75–1.8 万亿)
Colossus 1 → Anthropic 合同是 SpaceX S-1 的核心"AI 基础设施营收"故事。IPO 成功将进一步稳定 Anthropic-SpaceX 关系。轨道算力(多吉瓦级卫星数据中心)将成为 IPO 叙事重要组成。
① 算力稀缺将永久改变竞争逻辑
随着 Agent 工作流普及,模型推理需求将远超当前所有产能预测。掌握算力分配权的公司(云巨头、SpaceX、芯片厂商)将拥有前所未有的谈判筹码。Anthropic 的多云多供应商体系是对这一风险最务实的对冲。
② Managed Agents 是最重要的护城河,也是最大的押注
成败取决于两个假设:企业愿意把 Agent 运行时外包给 AI 厂商;Anthropic 的托管服务在可靠性、安全性、可观测性上能持续领先。若成立——Anthropic 成为"Agent 时代的 AWS";若不成立——退回成 token 管道。Mercado Libre Q3 2026 是最重要的早期验证点。
③ "AI 平台战争"的终态是生态联盟,不是单一胜者
MCP 多方采用、Claude 同时上线三大云、Codex 在 Claude Code 里作为插件运行——这些事实都指向:AI 编码市场不会出现 Office Suite 式的胜者通吃。Anthropic 的战略成功取决于它能否成为"最优先选择的 Agent 运行时",而不是"唯一的"。
1.算力是 AI 行业 2026–2027 年的绑定约束(而不是模型能力)
2.Agent 运行时已从开发者自建进入厂商托管竞争阶段
3.AI 编码市场的竞争单位已从"工具"演变为"体系"
它改变了 Anthropic 的一件事:从"安全优先研究机构"到"规模优先平台公司"的公开转型——代价是品牌资本的部分稀释,收益是算力和企业市场的战略纵深。
Code with Claude 2026 不会被记住为某款新模型的发布日,而会被记住为 AI 平台战争从"谁能造出更聪明的模型"切换到"谁能调度更多的电、芯片和工作流"的转折点——Anthropic 用一笔与三个月前还称自己邪恶的 Elon Musk 的算力交易,为这一切换写下了最具戏剧张力的注脚。