DeepDive · L5 全球地缘 · 在线讲解

开源包围战
能力护城河消失,算力护城河加高

2026 年 4 月最后一周,AI 行业迎来一组方向完全相反的信号——它们不是矛盾,是同一次产业重组的两面。

文 / 冯小平 · 首发 2026-05-09 · xiaopingfeng.com/deepdive
一句话讲完 · The Short Version
赢家可能既不是开源,也不是闭源,
而是卖底层硬件和云的那批人。
护城河正从「模型能力」整体迁移到「算力获取能力」
开场坐标 · Key Numbers

先记住四个数字

400 亿
Google 计划投资
Anthropic 的美元金额
1.6T / 49B
DeepSeek-V4-Pro
总参数 / 激活参数
1M
V4 默认开启的
上下文长度
+48%
GPU 租赁价格
60 天内的涨幅

同一周里发生:一边能力崩塌,一边资本加码。两个方向,一个结论。

FIG 01 · 全文论点的一张地图

同一周,两条护城河朝相反方向移动

能力护城河 · CAPABILITY MOAT ↓ 正在消失 Agentic Coding 首次开源 SOTA · V4 1M Context 从卖点降为行业基准线 Qwen3.6-27B 超越自家 397B 旗舰 Pro 订阅亏钱 Sam Altman 公开承认 算力护城河 · COMPUTE MOAT ↑ 正在加高 GPU 租赁价 +48% 60 天内涨幅 Stargate 5000 亿 2029 年容量超 9GW Anthropic × Amazon 扩展合作新增高达 5GW NVIDIA 5 万亿 盘中涨 4.6% 重回该市值 同一周内的两组信号 · 上排在塌陷,下排在垒高
上排每一格都在削平「模型能力」的差价,下排每一格都在抬高「算力获取」的门槛 —— 这不是两件事,是同一次重组的两面
第一章 / 01

开源第一次
真正赢了闭源

2026 年 4 月 24 日 · DeepSeek 同步发布并开源 V4 Preview

DeepSeek V4 · Hacker News 1138 点,当周最热帖

单看参数没意义,关键是三层叠加

第一层
Agentic Coding 首次开源 SOTA — 超越 GPT-5 与 Claude Opus 4.7,企业不必再为「最强代码 Agent」付闭源溢价
第二层
1M Context 成为生产默认值 — Token-wise 压缩 + DSA 稀疏注意力,长上下文从卖点降为基准线
第三层
完全开源权重 = 真自部署 — 医疗、金融、政府第一次有了生产级可自部署选项
MIT Technology Review 的判断

效率突破意味着制裁壁垒的实际效果正在减弱——在算力受限的环境下依然做出世界顶级模型,这不只是技术成就,是地缘政治变量。

第二章 / 02

不是 DeepSeek 一家,
是整个阵营在包围

同一周内的开源攻势密度,史无前例

开源阵营 · The Encirclement

五个型号,同一周落地

  • DeepSeek V4 Pro / Flash — Agentic Coding SOTA,1M Context 默认开启
  • Kimi K2.6 — 支持 300 个并行子 Agent 连续运行 12 小时以上
  • Kimi K2.6 的基准成绩 — HuggingFace 代码基准首次超越 GPT-5.4 与 Claude Opus 4.6
  • Qwen3.6-27B — 27B 参数全面超越自家 397B 旗舰,SWE-bench 全面领先
  • Qwen3.6-35B-A3B — MoE 架构仅激活 3B,拿下 HuggingFace 下载量第一
  • Gemma 4 — 声称 byte-for-byte 最强开源
FIG 02 · 参数规模不再是性能 Proxy

真正在跑的,只有那一小截

总参数 激活参数 对数横轴 · LOG SCALE 1B 10B 100B 1T DeepSeek-V4-Pro MoE · 1M Context 默认 1.6T 49B DeepSeek-V4-Flash MoE 284B 13B Qwen3.6-35B-A3B MoE · HF 下载量第一 35B 3B Qwen3.6-27B Dense · 稠密模型 27B 397B 自家旗舰 · 已被超越 数字取自本文正文 · 末行为稠密模型,虚线是它超越的自家 397B 旗舰
1.6T 总参数只激活 49B,35B 只激活 3B —— Qwen3.6-35B-A3B 靠 3B 激活拿下 HuggingFace 下载量第一,参数规模已不再是性能的代理变量
一条被低估的观察 · Counter-Consensus

当前 scaling 的主流不是堆单一超大模型,而是协调大量小模型的星座

Twitter 用户的非共识观察 · 被 MoE + 量化持续验证

直接反例:Qwen3.6-35B-A3B 仅激活 3B 就拿下 HF 下载量第一——参数规模不再是性能 proxy。
下一步或许是 Sakana 的 Fugu:把 Agent 协调本身当作模型能力来训练。

第三章 / 03

闭源定价权侵蚀:
从理论到商业现实

Sam Altman 已经公开承认 Pro 订阅在亏钱

定价权 · The Pricing Playbook

剧本还没演完,对手已经追上

第一步
补贴获客 — 低价甚至亏本换用户规模
第二步
建立生态依赖 — 这一步的时间窗口正在被开源攻势压缩
第三步
后期提价 — 还没等到提价时机,开源就已经追上了
  • a16z:AI 时代软件只剩两条路——成为 AI-native 工作流,或成为纯数据 / 基础设施层
  • a16z 给创业公司的建议:不要卷 token 价格——潜台词是这场仗由开源定价,你赢不了
同一天发生 · Bloomberg 报道

买的不是技术,是算力绑定

400 亿
Google 计划投资
Anthropic 的上限
100 亿
首期注入金额
按 3500 亿估值
1 万亿
Anthropic 估值
超越 OpenAI
  • 表面逻辑 — Google 需要 Anthropic 来抗衡 OpenAI
  • 深层逻辑 — Anthropic 大量使用 Google Cloud TPU,这笔钱本质是帮它买自家算力
  • 算力循环回流 — 钱最终回到 Google Cloud,同时确保它不转投 AWS 或 Azure
Tom Tunguz 的分析框架 · The Castle

商品化补充产品,以保护核心城堡

策略:摧毁 SaaS 的收入潜力
  • Claude Design → Figma 等设计 SaaS
  • Claude Code → GitHub Copilot、Cursor
  • Workspace Agents → RPA、工作流 SaaS
目的:只留一条预算线
  • 每杀掉一个 SaaS 品类,预算就流向 Claude API
  • 确保唯一剩余的预算线是推理算力
  • 这不是产品矩阵扩张,是精确切割

这正是 Google 自己用过的经典剧本,如今被原样搬到模型层。

FIG 03 · 护城河从「能力」转移到「算力」

资本、电力、价格同时在抬升

资本承诺 · 亿美元 · 线性刻度 Stargate · OpenAI 5000 亿 Google → Anthropic 400 亿 Tesla 资本开支 250 亿 Anthropic 首期注入 100 亿 0 2500 5000 算力容量 · GW OpenAI Stargate · 2029 年 超 9GW Anthropic × Amazon 新增 高达 5GW +48% GPU 租赁价 60 天内涨幅 5 万亿 NVIDIA 市值 盘中涨 4.6% 重回 三组信号单位不同,指向同一个约束:算力
Tom Tunguz 的警告因此成立 —— 创业公司的竞争维度正从「迭代速度」转向「基础设施获取」;左右两栏刻度独立,不可跨栏比较
FIG 04 · 终局推演 · Four Corners

谁赢都得买卡

闭源模型 能力护城河消失中 靠生态锁定 + 算力绑定续命 开源模型 能力赢了 但终端用户承担算力成本 NVIDIA 双向通吃 谁赢都要买 GPU 云厂商 · Google / AWS 投资即绑定 把 AI 厂商锁在自家云上
开源赢了能力、闭源失去差异化,但 NVIDIA 与云厂商在两种结局下都是赢家 —— 开源不是免费,是成本中心转移

佐证:NVIDIA 在 Blackwell Ultra 上跑出 DeepSeek V4 的 150+ TPS / 用户——即使开源赢了,它也不会输。

带走的判断框架 · Takeaway
真问题不是「我用谁的模型」,
而是这三个
问题一
我的差异化是否还停留在「用了 GPT-5 / Opus 4.7」?能力平价后它即将清零
问题二
我的护城河是数据飞轮、工作流深度,还是仅仅 API 接入?前两者抗冲击,后者不抗
问题三
若算力成本是未来三年的核心约束,GPU 价格 +50% 时我的模式还活得下来吗
延伸阅读 · Read Further

能力平价不是结束,
是真正商业模式比拼的开始

本幻灯片为《开源包围战:能力护城河消失,算力护城河加高》配套讲解版 · 数据与事实均出自原文,原文内附一手来源链接
文 / 冯小平 · xiaopingfeng.com/deepdive