← DeepDiveDD · 0009 · 2026-05-10
DEEPDIVE / [LAB] ANTHROPIC · Code with Claude 2026
v1 · 2026 · MAY 10
EVENT ANALYSIS SAN FRANCISCO · 2026-05-06 LONDON 5/19 · TOKYO 6/10

算力切换叙事 Code with Claude 2026

今天没有新模型。今天是关于我们如何让产品更好地服务你。
CPO Ami Vora 这句开场白,是 Anthropic 一次刻意为之的叙事颠覆——
把竞争平面从模型分数搬到Agent 运行时与企业合同密度
然后用一笔与 Elon Musk 的算力交易,为这一切换写下了最具戏剧张力的注脚。
年化收入(ARR)
$300亿
从 $90 亿 · 增长 3.3 倍
Q1 2026 年化增长
80×
内部预测仅 10 倍
Claude Code ARR
~$25亿
单产品贡献
MCP 安装基数
9700万
已越过网络效应临界点

Anthropic 在这场大会上完成了从"模型公司"到"Agent 平台公司"的公开战略身份切换,代价是接受 Colossus 1 算力协议——与三个月前称其"邪恶"的 Musk 签约。

反共识:这场大会最重要的信号不是任何单一功能发布,而是 Anthropic 首次公开承认"瓶颈不是模型能力,而是算力供给"——当 80 倍增长压力迫使它接受有条件算力依赖,安全优先叙事的品牌资本正在被部分兑换为规模执行资本。

§ 01

大会核心发布全景

1.1 · 顶层叙事:从"模型公司"到"Agent 平台公司"

这场大会的核心不是任何单一功能,而是 Anthropic 一次公开的战略身份切换。背景数据触目惊心:年化收入从 2025 年底 $90 亿 → 大会前夕 $300 亿(增长 3.3 倍);Q1 2026 实际增长 80 倍,远超内部预测的 10 倍;API 调用量同比 17 倍,token 同比 70 倍

这种"幸福的危机"迫使 Anthropic 公开承认:瓶颈不再是模型能力,而是算力供给与工作流架构。CPO Ami Vora 的"没有新模型"宣言,是一次刻意为之的叙事颠覆,将竞争平面从模型分数搬到 Agent 运行时和企业合同密度。

1.2 · Claude Managed Agents 三大新特性

PUBLIC BETA Multiagent Orchestration · 多智能体编排
20
最多子 Agent
25
并发线程
1层
派工深度上限
managed-agents
-2026-04-01
Beta 标头

一个 Lead Agent 将任务拆分委派给子 Agent,每个子 Agent 拥有独立的模型、提示词、工具与 MCP servers。所有 Agent 运行于同一容器和文件系统,结果汇总回 Lead Agent 的全局上下文。

与 LangGraph、CrewAI 概念重叠,但 Anthropic 将其做成有限制、有可观测性的托管服务。1 层深度限制是关键设计选择——强制扁平化胜于深层递归的失控风险。客户案例:Netflix 平台团队用它并行分析数百次构建日志。

PUBLIC BETA Outcomes · 结果驱动

范式转换:从"指令式提示"到"评分式定义"——开发者写 markdown rubric 描述"成功长什么样",一个独立的 Grader Agent 在完全隔离的上下文窗口中评判产出,防止推理路径污染。

默认最多迭代 3 次,上限 20 次。Anthropic 内部测试最多提升 10 个百分点(.docx 生成 +8.4%、.pptx +10.1%)。医疗文档审查公司 Wisedocs 审查时间缩短 50%

本质是"被产品化的 Ralph 循环"——把社区手写的"循环→评判→重试"模式升级为 API 一等公民,让 Agent 工作变得可验收,而不是"跑完看运气"。

RESEARCH PREVIEW Dreaming · 异步记忆内省

本质:一个异步、调度型的离线内省进程,不修改模型权重。扫描现有 Memory Store + 最多 100 条历史会话,提炼模式、清理重复条目,生成 plain-text notes 和 "playbooks"。

支持模型:claude-opus-4-7claude-sonnet-4-6。需双 Beta 标头:managed-agents-2026-04-01 + dreaming-2026-04-21

客户案例:法律 AI 公司 Harvey 任务完成率提升约 6 倍——大会被引用最多的客户数据。

Dreaming 的真正价值:给长程 Agent 提供"经验固化"中间层,介于 RAG 和微调之间。它不学新能力,只整理旧笔记——媒体把它包装成"AI 从错误中学习"是过度营销。安全警告:Pluto Security 指出提示注入的"假记忆"可通过 Memory Store 跨 session 持久留存。

1.3 · Claude Code 全栈进化

Boris Cherny 的判断一针见血:"今后大量代码将以异步方式编写。" Claude Code 的产品边界在本次大会上从 CLI 工具扩展为横跨 CLI、IDE、桌面 GUI、Web、移动端、CI 集成、定时任务的持续运转层。

新功能 状态 核心价值
Routines(异步自动化) Research Preview 打包 Claude Code 配置于 Anthropic 云执行,支持定时 / API / GitHub 三类触发器,无需本地机器开启
Code Review Research Preview 专门 Agent 分析 PR 的逻辑错误、安全漏洞、边缘情况,以行级 inline comments 标注
CI Auto-fix 已发布 PR 所有人"永远不会看到红 X"——Claude 在 CI 失败时自动推修复
Remote Agents 已发布 手机控制笔记本上的 Claude Code 进程,文件系统留在本地
Desktop App 已发布 从 CLI 升级为可同时运行多 sessions 的全屏 GUI
Routines vs GitHub Actions 的根本区别:Routines 运行在 Anthropic 云上;GitHub Actions 运行在用户自己的 CI/CD 环境中调用 Claude。前者不需要本地机器开启,是判断密集型工作的归宿;后者是确定性 CI 的归宿。

速率限制翻倍(直接福利):Pro/Max/Team/Enterprise 五小时滚动窗口翻倍;取消 Pro/Max 高峰时段降配;Opus API Tier 1 输入 token/分钟 +1500%、输出 +900%。

⚠️ 周限额未提高——Anthropic 工程负责人 Amol Avasare 明确确认。

1.4 · Advisor Strategy · 双模型协作架构

颠覆"大模型协调小模型"的传统思路:Sonnet 4.6 或 Haiku 4.5 端到端驱动 Agent 循环;Opus 4.6/4.7 在关键判断点被调用,读取完整共享上下文,返回 plan/correction/stop 信号(仅 400–700 tokens),不调用工具、不直接面对用户。启用方式:anthropic-beta: advisor-tool-2026-03-01

SWE-bench Multilingual
74.8%
Sonnet + Opus(vs Sonnet 单飞 72.1%)
成本下降 11.9%
BrowseComp
41.2%
Haiku + Opus(vs 纯 Sonnet 19.7%)
节省 85% 成本
客户 Eve Legal
1/5
结构化文档抽取达前沿质量
成本仅为 Opus 直调的五分之一

1.5 · SpaceX Colossus 1 算力协议

功率
300 MW+
GPU 数量
22 万张
H100/H200/GB200
上线时间
一个月内
推理为主,非训练
SpaceX 年化收入
$30–40亿

为什么是 Colossus 1:它是 Anthropic 所有算力承诺中唯一能在 2026 年 5 月内交付的产能——Amazon 5GW 年内只到约 1GW;Google/Broadcom 5GW 要到 2027 年。SpaceX 合并 xAI 后 Colossus 1 的 GPU 利用率仅约 11%,训练已迁至 Colossus 2,恰好有整体容量可出租。

附带条款(重要):Musk 保留在"Claude 从事危害人类的行动"时收回算力的权利,但判定标准由 Musk 自定。Simon Willison 评:"这对 Anthropic 是一种新型供应链风险。"

环境争议:Colossus 1 在过去近一年由 30+ 台拖车大小的天然气涡轮机供电,未经 Clean Air Act 许可、未配污染控制设备,靠归类为"临时使用"规避监管。Memphis 已被列为美国"哮喘之都",NAACP 官方声明谴责 Anthropic 对历史性黑人社区的健康漠视。

1.6 · 金融行业 与 Microsoft 365 双线落地

金融服务发布会 · 5 月 5 日
  • ·10 个金融行业 Agent 模板:研究侧(Pitch Builder / Meeting Preparer / Earnings Reviewer …)+ 运营合规侧(GL Reconciler / KYC Screener …)
  • ·客户阵容:JPMorganChase(Jamie Dimon 同台)、Goldman Sachs、Citi、Visa、AIG、Citadel、BNY、Carlyle
  • ·Opus 4.7 Vals AI 金融 Agent 基准 64.37%,超过 GPT-5.5(59.96%)
  • ·Goldman + Blackstone + Hellman & Friedman + Apollo 共建 15 亿美元合资基金,把 Claude 嵌入投资组合公司
Microsoft 365 集成
  • ·Word / Excel / PowerPoint 全面 GA
  • ·Outlook 公测("chief of staff"形态做收件箱 triage)
  • ·跨应用 context 自动携带:Outlook 起草 → Word 写文档 → PowerPoint 出图,一气呵成
  • ·对 Pro/Max/Team/Enterprise 订户不另收费——在微软主场正面竞争 Copilot 的核心武器

1.7 · Mythos 安全研究 与 Project Glasswing

Ami Vora keynote 开篇案例:Mythos 在 OpenBSD 源码树中发现一个 27 年的 TCP SACK 实现漏洞(1998 年添加的有符号整数溢出 bug,可远程 DOS 任何响应 TCP 的 OpenBSD 主机)。约 1000 次 scaffold 运行,总成本 < $20,000,找到该 bug 的特定运行成本 < $50

同期发现:FreeBSD CVE-2026-4747 17 年远程代码执行漏洞、FFmpeg 16 年 H.264 codec 漏洞(500 万次 fuzz 测试未发现,Mythos 通过直接代码分析定位)。

Project Glasswing 联盟:12 家创始合作伙伴(含 AWS、Apple、Microsoft、Google、CrowdStrike、Palo Alto Networks),Anthropic 承诺最高 $1 亿使用积分 + $400 万捐款给开源安全组织。

§ 02

技术趋势分析

2.1 · 范式跃迁:从"模型调用"到"Agent 集群运维"

旧范式新范式
单次 prompt → 单次 responseRoutines 配置 → 持续运转的云 Agent
开发者编写工具链 harnessAnthropic 托管 Agent 运行时
会话结束记忆清空Memory Store + Dreaming 跨 session 积累
人工评估输出质量Grader Agent 自动评分,执行 Agent 自迭代
单模型执行Lead Agent + 专业子 Agent 编队

这种转变的工程本质是:Claude Code 的竞争对手不再只是 Cursor 或 Copilot,而是企业 IT 部门自建的 Agent 脚手架。Anthropic 把"沙盒+状态+工具+MCP+记忆+多 Agent 调度"打包成标准化 SaaS,从而让自建成本不再有竞争力。

2.2 · 记忆架构演进:三层结构

Memory Store(存储层)→ Dreaming(策展层)→ Agent Playbooks(执行层)

这个架构本质上是介于 RAG 和微调之间的中间层——它不修改权重(避免连续学习的灾难性遗忘风险),但通过策展记忆库实现了跨 session 的经验积累。

潜在安全风险:提示注入的"假记忆"可以通过 Memory Store 跨 session 持久留存,这是 RAG 系统中没有的攻击面。

2.3 · MCP 生态:从协议到基础设施

MCP 已捐赠给 Agentic AI Foundation(AAIF,Linux Foundation 旗下),Anthropic、Block、OpenAI 共同发起。安装基数 9700 万(2026 年 3 月),已越过网络效应临界点。

2026 路线图优先项:无状态 HTTP transport(水平扩展)/ Tasks 原语(异步长任务)/ MCP Apps(标准化 UI 组件)/ 集中化注册表。官方 SDK:TypeScript / Python / C# / Java / Swift / Go / Rust。

这是 Kubernetes 与 CNCF 的剧本复现:Anthropic 标准化接口,然后在托管实现上竞争。把 MCP 捐给中立基金会确保竞争对手也采用同一标准——而 Anthropic 的 Managed Agents 作为最完善实现赢得溢价。

§ 03

公司战略分析

3.1 · 估值轨迹

2025 / 3
$615亿
2025 / 9
$1830亿
2026 / 2
$3800亿
Q4 2026 传闻
$8500–9000亿
超过 OpenAI $8520亿

3.2 · 算力多元化:四供应商体系

供应商规模芯片特点
AWS(Amazon)1000 亿美元十年Trainium2/3主训练云,Project Rainier
Google Cloud5 GW,5 年 2000 亿TPU(2027 起)占 Google Cloud backlog 40%+
Microsoft Azure + NVIDIA300 亿 Azure 信用NVIDIA GPUM365 分销捆绑
SpaceX/Colossus 1300 MW,22 万 GPUH100/H200/GB200月内可用,推理为主

Claude 是唯一同时上线 AWS Bedrock、Google Vertex AI、Microsoft Azure Foundry 三大云的前沿模型——三路分销,不被任何一方绑定

3.3 · 三城巡回的生态建设意图

SF(5/6)+ 伦敦(5/19)+ 东京(6/10),每站附带 Extended Day 独立开发者专场,全球免费直播——这是 Anthropic 版"WWDC"的战略卡位。

真正的复利在长期:JetBrains 2026 调查显示 Claude Code 企业采用同比增长 6 倍,在 AI 编码工具中增速最快,这正是持续生态建设的早期回报。

§ 04

生态变化分析

4.1 · 竞品格局:从模型战到算力战

旧竞争维度:谁能造出更聪明的模型(MMLU / SWE-bench 排名战)
新竞争维度:谁有电、谁有 GPU、谁有渠道

OpenAI:5 月 5–10 日没有针对 Code with Claude 的反向公告(Sam Altman 在法庭作证)。但 4–5 月连发 GPT-5.5、GPT-5.5 Instant、Codex for Chrome,节奏精确卡在 Code with Claude 前后。SpaceX 协议把"容量受限"叙事大半浇灭。

Google:最明显的撞日反击——5 月 6 日同日把 Jules(异步 coding agent)升级为全球公测,无 waitlist。真正回应窗口是 5 月 19 日 Google I/O 2026,恰好撞上 Code with Claude 伦敦站。

xAI/SpaceX:从"对手"转型为"算力房东"。Musk 三个月前骂 Anthropic "邪恶",5 月 6 日整租 Colossus 1——背后是 Colossus 1 约 11% 的 GPU 利用率需要货币化,以及 SpaceX 6 月 IPO 前的"AI 基础设施营收"故事需要 marquee 客户。

4.2 · AI 编码市场分层共生

JetBrains 2026 / 工作场景使用率
GitHub Copilot29%
Cursor18%
Claude Code18%
JetBrains 2026 / "最爱"率
GitHub Copilot9%
Cursor19%
Claude Code46%
分层共生稳态

Claude Code:异步长程 Agent,终端原生,深度 agentic

Cursor:编辑器体验和多模型路由,UX 护城河

Copilot:企业标准化和采购流程,微软生态

Codex:异步云沙箱和 PR 评审门控

Claude Code 的"最爱率"是 Copilot 的 5 倍,反映开发者深度使用满意度的巨大差距。市场规模 $128 亿(2026)→ 预测 $300 亿(2032),增速支撑四家分层生存。

4.3 · 中国 AI 生态的对称反向策略

维度美国(Anthropic 主导)中国(多厂商分散)
基础模型Claude Opus 4.7GLM-5.1 / Qwen 3.x / DeepSeek V4
开发工具Claude Code + Cursor + CopilotAutoClaw / ArkClaw / Bailian Plan
运行时Managed Agents(托管)开源框架主导
算力AWS + Google + SpaceX 多云华为昇腾 + 国产云(监管驱动)
分销渠道Microsoft 365 + 三大云钉钉 + 飞书 + 企微 + 信创体系
市场策略封闭平台,高价值,垂直深耕开放权重,低价格,全球南方渗透

Manus 事件(2026/4/27):中国 NDRC 正式禁止 Meta 对 Manus 的 $20–30 亿收购,将 agentic AI / 多步任务执行纳入受控技术目录——这是中国对 agentic AI 实施战略管制的标志性事件,预示跨境 agentic AI 的收购与扩张将面临持续审查。

§ 05

下一步预测

短期(0–3 个月)· 6 大确定性信号

Google I/O 2026(5/19)将正面回击

时间节点精确撞上 Code with Claude 伦敦站。Gemini 4 发布概率极高;Jules 下一代(代号 Jitro)将主打"KPI 驱动 / 成果导向"开发,直接对标 Outcomes。口号"Manually prompting your agents is so… 2025"已预告进攻方向。

Colossus 1 产能上线缓解但不彻底解决算力问题

周限额问题依然存在。关注 Memphis 环境诉讼进展——若升级至州级禁令,将成为 Anthropic 运营风险。Musk 的"Humanity Clause"条款是需要持续监控的不确定性。

Microsoft Build 2026(6/2–3)是微软的回应窗口

GitHub Copilot 多模型策略将强化;Claude M365 加载项与 Copilot 的渠道博弈将公开化。

Dreaming / Outcomes / Routines 首批真实客户数据

Harvey 6 倍任务完成率是唯一现有参考点。Mercado Libre Q3 2026"90% 自主编码"目标是最重要的观察窗口。若 Dreaming 安全风险被研究者公开验证,将引发治理讨论。

Claude Code 下一主版本发布窗口接近

当前 Sonnet 4.6 在 SWE-bench Verified 达 80.8%;Opus 4.7 Vals AI 金融基准 64.37%。下一主版本预计聚焦 computer use 可靠性(Vercept 团队融合成果)+ 更长连续任务支持。

SpaceX IPO(预计 6–8 月,估值 $1.75–1.8 万亿)

Colossus 1 → Anthropic 合同是 SpaceX S-1 的核心"AI 基础设施营收"故事。IPO 成功将进一步稳定 Anthropic-SpaceX 关系。轨道算力(多吉瓦级卫星数据中心)将成为 IPO 叙事重要组成。

长期(1–3 年)· 3 个战略判断

① 算力稀缺将永久改变竞争逻辑

随着 Agent 工作流普及,模型推理需求将远超当前所有产能预测。掌握算力分配权的公司(云巨头、SpaceX、芯片厂商)将拥有前所未有的谈判筹码。Anthropic 的多云多供应商体系是对这一风险最务实的对冲。

② Managed Agents 是最重要的护城河,也是最大的押注

成败取决于两个假设:企业愿意把 Agent 运行时外包给 AI 厂商;Anthropic 的托管服务在可靠性、安全性、可观测性上能持续领先。若成立——Anthropic 成为"Agent 时代的 AWS";若不成立——退回成 token 管道。Mercado Libre Q3 2026 是最重要的早期验证点。

③ "AI 平台战争"的终态是生态联盟,不是单一胜者

MCP 多方采用、Claude 同时上线三大云、Codex 在 Claude Code 里作为插件运行——这些事实都指向:AI 编码市场不会出现 Office Suite 式的胜者通吃。Anthropic 的战略成功取决于它能否成为"最优先选择的 Agent 运行时",而不是"唯一的"。

§ 06

核心结论

这场大会确认了三件事

1.算力是 AI 行业 2026–2027 年的绑定约束(而不是模型能力)

2.Agent 运行时已从开发者自建进入厂商托管竞争阶段

3.AI 编码市场的竞争单位已从"工具"演变为"体系"

它改变了 Anthropic 的一件事:从"安全优先研究机构"到"规模优先平台公司"的公开转型——代价是品牌资本的部分稀释,收益是算力和企业市场的战略纵深。

对开发者
  • ·立即测试 Routines:识别现有 cron job 中判断密集型子集,优先迁移
  • ·申请 Dreaming Research Preview:评估长 horizon 记忆策展价值
  • ·Advisor Strategy 的 Haiku+Opus 组合在中等复杂度任务上可能是最优解
  • ·注意 Managed Agents 的锁定风险:在关键系统上保留架构可迁移性
对企业决策者
  • ·Claude M365 加载项值得立即评估,跨应用 context 携带可替代多个单点工具
  • ·金融行业 10 个 Agent 模板是最快落地路径,但需内部合规和数据治理配套
  • ·算力供应链多元化是值得学习的风险管理范式
对中国 AI 从业者
  • ·Anthropic 真正护城河是"MCP 标准 + Claude Code 开发者文化 + M365 分销 + Colossus 算力"四元组合
  • ·本土对应体系的构建需要生态联合,而非单一公司仿制
  • ·Manus 事件确认 agentic AI 跨境扩张的监管红线,出海路径需重新规划

Code with Claude 2026 不会被记住为某款新模型的发布日,而会被记住为 AI 平台战争从"谁能造出更聪明的模型"切换到"谁能调度更多的电、芯片和工作流"的转折点——Anthropic 用一笔与三个月前还称自己邪恶的 Elon Musk 的算力交易,为这一切换写下了最具戏剧张力的注脚。