← Landscape
9 层结构持续更新
从底座模型到部署上线的完整技术栈
开发者搭一个 AI Agent 要经过的完整链条:选哪个底座模型、用什么框架编排、靠什么协议接工具、怎么管理记忆和长上下文、落地成编码助手还是多智能体系统、怎么监控评测、在哪个沙盒里跑代码、最后部署到哪。这张图不追"这周谁发了新模型",追"这一层现在谁在领跑、谁在掉队、格局有没有变"。
最后更新 2026-08-26
当前版本 v1
下次复核 ~2026-09
总览 结构图
9 层大致按"底层→构建→上线"的顺序排布;协议/记忆/可观测性三层是横向贯穿多层的支撑能力,不是严格单向依赖。
底座模型 → 编排框架 → [协议+记忆] → 落地形态 → [评测+沙盒+部署] 三层支撑基础设施
Agent 的智能核心,决定推理、工具调用、长上下文的能力上限。2026 年最大的变化:中国开源模型在 agentic 跑分上已经追到个位数差距,价格却便宜 5-20 倍,月之暗面 Kimi K2.7-Code 是第一个进入 GitHub Copilot 模型选择器的中国开源模型。
Anthropic · 旗舰
100万 token 上下文,自适应思考,面向 agentic/企业场景调优。
Anthropic · 高性价比日常款
Free/Pro 默认模型,SWE-bench Pro 63.2%。
OpenAI · 旗舰家族
三档位:Sol旗舰、Terra均衡、Luna低成本。
Google DeepMind
agentic/多模态主力线,Flash 系列约每3周迭代一次。
阿里 · 国产旗舰
默认100万上下文,驱动阿里"悟空"Agent平台。
深度求索 · MIT协议
压缩稀疏注意力实现100万上下文,3.2万亿+训练token。
月之暗面 · 修改版MIT
1万亿参数MoE(320亿激活),首个进入GitHub Copilot模型选择器的中国开源模型。
智谱/Z.ai · MIT协议
355B/32B激活MoE,另有轻量版GLM-4.7-Flash供本地部署。
MiniMax · 开源
编码能力+百万上下文+原生多模态(图像/视频/桌面操作)三合一。
Mistral · Apache 2.0
明确面向agentic/工具调用场景,ARR已破4亿美元。
把模型包装成能自主决策、调用工具、管理状态的 Agent。2026 年格局:头部整合、腰部分裂——微软把 AutoGen 和 Semantic Kernel 都打入维护模式,统一成 Microsoft Agent Framework;与此同时中国开源 LLMOps 平台(Dify star 数已超 LangChain)成为全球采用量最大的赢家。
LangChain · 企业生产环境领跑
图结构低层运行时,约3400万次/月下载,约400家企业用其托管平台。
角色制多智能体 · 轻资本高增长
Agent/Task/Tool/Crew模型+事件驱动Flows,官方称月执行量14亿+次。
Microsoft Agent Framework
微软 · 统一AutoGen+Semantic Kernel
2026年4月GA,MIT协议,Python+.NET双栈,原生MCP支持。
OpenAI · 官方轻量harness
Swarm的生产化继任者,现兼容100+非OpenAI模型。
Anthropic
由Claude Code的能力泛化而来,含生命周期钩子、Skills、可扩展到大规模编排的Workflow工具。
Google · Apache 2.0
代码优先,同时驱动Agentspace等Google内部产品。
Dify
LangGenius(中国)· 采用量最大
开源可视化LLMOps平台,star数超过LangChain/LangGraph,部署应用超100万个。
让 Agent 能安全、标准化地连接外部工具和其它 Agent。2026 年最大的标准化事件:MCP 与 A2A 的治理权都并入 Linux 基金会新设的中立机构 AAIF,此前"协议战争"的焦虑基本解除。
Anthropic发起 · 事实标准
约9700万次/月SDK下载,约28%的财富500强已在生产环境跑MCP服务器;OpenAI已弃用自家Assistants API转投MCP。
Linux基金会 · 中立治理
2025年12月成立,MCP与A2A的共同治理机构,成员含OpenAI/Anthropic/Google/微软/AWS等250+组织。
Agent2Agent(A2A)
Google发起
跨厂商agent发现/任务交接协议,与MCP互补(MCP管agent连工具,A2A管agent连agent),IBM的ACP协议已并入。
Cisco Outshift发起
身份认证/发现/可观测性的补充层,明确定位为"配合MCP/A2A而非替代",75+组织参与。
让 Agent"记得住"跨会话信息、管好超长上下文。格局正在向上迁移:pgvector 成熟后悄悄吃掉了大部分"够用就行"的检索需求,真正的差异化和融资都转移到了"记忆"这个更高的抽象层。
pgvector
Postgres扩展 · 悄悄的整合者
HNSW索引成熟后,很多团队发现根本不需要单独的向量数据库;OpenAI/Supabase/Neon都在用。
专用记忆层
向量+知识图谱混合,2400万美元种子轮+A轮(YC/Peak XV)。
时序知识图谱记忆
Neo4j驱动的双时态事实模型,Graphiti 2万+ star。
原MemGPT · "LLM的操作系统"
核心/归档/回忆分层记忆架构,2.3万+ star。
目前 Agent 最成熟的落地场景,开发者日常接触最密集的产品。2026 年洗牌很剧烈:Claude Code 在开发者偏好上反超 GitHub Copilot(JetBrains调研:"最受欢迎"46% vs 9%),Windsurf 作为独立品牌已经不存在了(被 Cognition 并入改名 Devin Desktop),Amazon 砍掉 Q Developer 转投 Kiro。估值普遍远超实际用量信号。
Claude Code
Anthropic · 反超者
终端原生agentic编程工具,所有付费方案自带;JetBrains调研中"最受欢迎"46% vs Copilot的9%。
Cursor
Anysphere · 估值与用量背离
8个月内营收10亿→40亿美元年化,估值传闻500-600亿,但JetBrains数据显示用量已从18%软化到12%。
GitHub Copilot
微软 · 相对份额下滑
采用率从29%跌到21%(2026年5-7月),品牌知名度仍最高(79%)。
OpenAI · Gartner认证Leader
2026年Gartner企业级AI编码Agent魔力象限"Leader"。
Devin
Cognition · 高估值
估值从2025年9月102亿一路谈判至2026年8月传闻400亿,年化营收约4.92亿美元(公司自报);已吸收Windsurf品牌与团队。
Replit Agent
浏览器内应用构建
4个月内营收从3亿到5.25亿美元年化,估值90亿美元。
生产环境里"这个 Agent 到底靠不靠谱"的量化答案。安全评测(Inspect AI)和生产监控(LangSmith/Braintrust/Arize)正在成为两条并行赛道。
LangSmith
LangChain · 品类领跑
商业可观测性/评测/部署平台,面临自托管开源方案的定价压力。
评测优先 · 高速增长
8000万美元B轮(Iconiq/a16z/Greylock),估值约8亿美元,客户含Notion/Replit/Cloudflare。
英国AI安全研究院 · 安全评测事实标准
开源安全/能力评测框架,多家AISI和前沿实验室的部署前测试都在用,200+预置评测集。
Arize(Phoenix/AX)
品类领跑
Phoenix开源可自托管,AX为企业级托管版,7000万美元C轮。
给 Agent 一个能放心执行代码/操作的隔离空间。已经成为独立且融资活跃的基础设施品类。
开源 · Firecracker microVM
2100万美元A轮(Insight Partners),据称88%财富100强企业已注册使用。
"每个Agent一台电脑"
冷启动低于90毫秒,2400万美元A轮,star数6.5万+。
Modal
Serverless计算
gVisor隔离沙盒支持GPU,OpenAI Agents SDK官方沙盒供应商。
Browserbase / Stagehand
浏览器自动化
托管无头浏览器基础设施,Stagehand是配套的开源浏览器Agent SDK。
多个 Agent 之间怎么分工、通信、交接任务。行业估计约 70% 的生产级多智能体部署用的是"编排者-执行者"(orchestrator-worker)拓扑。
A2A Protocol
跨厂商标准
150+支持组织,已在供应链/金融科技/保险场景进入生产使用。
CrewAI Crews + Flows
具体产品化实现
无状态角色制Crews + 事件驱动的有状态Flows(含人工介入节点)。
Claude Subagents
Anthropic原生模式
主Agent派生独立上下文的子Agent,Workflow工具可扩展到几十上百个Agent协同。
Agent 最终运行在哪、怎么计费。每家云厂商都在 2026 年推出了专门面向 Agent 的托管产品,计费单元也从"算力时长"细化到了"每次工具调用""每条记忆记录"这类 Agent 原生指标。
AWS Bedrock AgentCore
托管Agent技术栈
Runtime/Gateway/Memory/Identity/Policy等13项能力分别计费,2026年GA。
Google Gemini Enterprise Agent Platform
原Vertex AI Agent Engine + Agentspace
Sessions+Memory Bank作为计费单元,15+项独立计量服务。
Microsoft Foundry Agent Service
原Azure AI Foundry
框架/模型无关,支持A2A(预览)与MCP(1400+工具),Claude已在此平台GA。
Vercel Agent Stack
从前端托管转向Agent基建
2026年6月Ship活动上明确战略转向:"Agent是默认的部署单元"。
Cloudflare Agents SDK
Workers + Durable Objects
持久化有状态Agent运行时,定位"低运维"的长期执行路径。
最近的关键变化
- MCP 赢了,标准治理权收归中立机构。MCP 已是无可争议的工具连接默认协议(约9700万次/月SDK下载,约28%财富500强生产环境在用),与 A2A 一起并入 Linux 基金会新设的 Agentic AI Foundation——此前"协议战争"的焦虑基本解除。
- 编码 Agent 市场剧烈洗牌。Claude Code 在开发者偏好上反超 GitHub Copilot;Windsurf 作为独立产品已不存在(并入 Cognition 改名 Devin Desktop);Amazon 砍掉 Q Developer 转投 Kiro;估值普遍远超实际用量信号(Cursor 传闻500-600亿估值,但用量数据在软化)。
- 框架层"头部整合、腰部分裂"。微软把 AutoGen 和 Semantic Kernel 都打入维护模式,统一成 Microsoft Agent Framework;与此同时中国开源 LLMOps 平台(Dify、Coze、RAGFlow)成为全球采用量最大的赢家。
- 中国开源模型追近 agentic 跑分差距,价格便宜 5-20 倍,且开始进入西方工具链。Kimi K2.7-Code 发布仅19天就进入 GitHub Copilot 模型选择器,是首个做到这一点的中国开源模型。
- "上下文工程"成为独立学科,记忆抽象层成为新战场。pgvector 的成熟把"够用"的检索需求悄悄吃进了 Postgres,真正的差异化和融资转移到了 Mem0/Zep/Letta 这类记忆层产品。
- 沙盒执行与"Agent原生托管"成为独立基础设施品类。E2B/Daytona/Modal 等专做 Agent 代码执行融资活跃,每家云厂商都推出了按 Agent 原生指标计费的托管产品。
2026-08-26
v1
首次建立:覆盖9层、约50个玩家,基于并行研究(4条研究线:底座模型/协议/记忆;编排框架/多智能体;编码Agent/可观测性;沙盒/部署)汇总整理。
方法论:入选门槛——在该层有实际产品/协议落地且有可查证来源(官方公告、融资报道、权威技术媒体),不收录纯传闻或未独立核实的信息。每层只挑选当前最具代表性的一批玩家,不追求穷尽罗列。鉴于本图几乎每层都在以4-6周为周期迭代,建议每1-2个月做一次全面复核;日常更新触发于某期 Buzzwords 故事线发现实质性变化时。