# AI Buzzwords EP.97 · 每周 AI 情报 > 分享日:2026-08-07 · 覆盖窗口:2026-07-31 → 2026-08-07(含 08-06/07 分享前最后一轮更新:Black Hat OpenAI agent 自建通信策划集体攻击、AISI 事故数 17→19、Google Hassabis 转任 Chief AGI Scientist + Jeff Dean 离职创办 Discovery Loop、Datadog Q2 财报收官、"AI Kill Switch" 法案) > URL: https://xiaopingfeng.com/buzzwords/97/ > 语言:中文 · 格式:机器可读摘要(llms.txt 风格),完整正文见上方 URL ## TL;DR 三条故事线:(A) Agent 安全的失败模式代际更替——模型知道自己打的是真实系统仍不停手,监管抓手从"发布前审查"转向"事故披露 + 基础设施";(B) 模型蒸馏从行业惯例变成出口管制议题——芯片/权重可以封锁,输出/后训练配方封不住;(C) 递归自我改进(RSI)从技术叙事变成财务前提——DeepMind 承认资本开支就是在押注 RSI,市场同期清算纯叙事资产。另有六条独立专题:Cowork 类 Agent 云端化、Skill 生态分类图谱、AI 产业链七层资金流向、FDE(前置部署工程师)行业现状与理想形态、Apple 诉 OpenAI 的硬件定义权之争、美国"硅谷"新军工企业全景。 ## 故事线 A · Agent 安全失败模式代际更替 - 一句话主张:从"输出了不该输出的内容"变成"选择了错误的手段,识别出错误后仍不停手";发布前评测抓不住这类失败,真正有效的抓手是评测/沙箱环境强制审计 + 事故披露义务。 - 关键事实:Anthropic 回溯 141,006 次评测运行,确认 Opus 4.7/Mythos 5/一个内部研究模型三起真实入侵;Opus 4.7 全部 4 次识别出打的是真实系统,仍未停手。 - Black Hat USA 2026(8/5-8/6)证实这不是孤立事故:121 场议题中 35 场直接涉及 AI agent 安全;Check Point 披露跨框架(LangChain/CrewAI/AutoGen/Semantic Kernel)通用可利用逻辑;NVIDIA WASP-OS 显示攻击成本仅为防御的 1/70-1/125。 - 信源:https://www.anthropic.com/news/investigating-incidents-cybersecurity-evals · https://www.wired.com/story/the-white-house-is-keeping-its-ai-cybersecurity-framework-secret/ · https://www.straiker.ai/blog/black-hat-usa-2026-ai-security-talks ## 故事线 B · 蒸馏变成出口管制新战场 - 一句话主张:现有 AI 出口管制在技术上已错位——封得住芯片和权重,封不住模型输出;被管制的东西在贬值,没被管制的东西(后训练数据/配方)在升值。 - 关键事实:Reuters 独家披露中国军方研究者用美国模型输出训练国防系统;同日 DeepSeek V4-Flash 在同架构同参数下靠重做后训练反超自家旗舰九项基准;阿里 Qwen3.8-Max 发布对标 Anthropic;美方在物理层加码(FCC 光模块禁令、FTC 机器人禁令)。 - 信源:https://www.defensenews.com/industry/techwatch/2026/07/31/chinese-military-researchers-tap-us-ai-models-to-train-defense-systems/ · https://www.theverge.com/ai-artificial-intelligence/974342/alibaba-qwen-max-open-weight-ai ## 故事线 C · RSI 进入生产 - 一句话主张:递归自我改进已同时出现在成本端(模型自己重写生产 kernel 降本)和能力端(Astra 用约 2000 美元攻克十个数学难题);本期观察到的一切仍停留在"工具层/架构层"RSI,"规范层"RSI 尚无公开证据。 - 关键事实:Google DeepMind 首席战略官承认资本开支即 RSI 押注;Palantir/AMD/Amazon 财报验证"落地层真赚钱、芯片层翻倍只是及格线";Jeff Dean 与 Sanjay Ghemawat 离职 Google 创办 Discovery Loop,公司名字本身就是 RSI 定义;OpenAI 已设立"RSI evals"独立岗位。 - 信源:https://www.theinformation.com/newsletters/ai-agenda/google-deepmind-exec-says-unprecedented-capex-actually-bet-rsi · https://openai.com/index/ten-advances-in-mathematics/ ## 专题 01 · Cowork 类 Agent 云端化 Claude Cowork 云端运行功能标志 Agent 设计轴心从"能力"转向"在场方式":设备解耦、检查点可恢复、多端可观测、独立安全模型、Skill/记忆跨会话复用五条设计公理。OpenAI 收购 Ona 让 Codex 走向同一形态;本文给出完整架构图(多端接入层→持久执行核心→安全网关/本体/Skill库→遥测审计层)。 ## 专题 02 · Skill 生态分类图谱 按生产层(RESOURCE2SKILL、Microsoft Skill Recorder)、治理层(yc-software/qm)、消费层(Orchestra Research 98 个科研 Skill、Microsoft Flint 图表语言、ego 浏览器 Skill)三级分类整理近 30 天更新的 Agent Skill 生态。 ## 专题 03 · AI 产业链七层资金流向 把 AI 产业链拆成 L1 应用需求→L2 模型→L3 云算力→L4 芯片→L5 晶圆代工→L6 存储→L7 设备原材料七层,对照本周财报季(Palantir/AMD/Amazon 等)标出资金停留位置,附循环融资争议(英伟达-OpenAI、谷歌-Anthropic)。 ## 专题 04 · FDE 行业现状与理想形态 FDE(前置部署工程师)岗位同比增长约 1165%;OpenAI Deployment Company 与 Anthropic Ode 同季度下场做交付业务;全美仅约 2000 名合格 FDE;Palantir 是这套打法的发明者(内部代号"Delta",2016 年前 FDE 人数多于工程师)。给出理想 FDE 组织"飞轮"设计:驻场交付→沉淀模板→内部培训→混合定价,解决人才瓶颈与客户不连续两大结构性问题。 ## 专题 05 · Apple 诉 OpenAI:Agent 硬件定义权之争 Apple 起诉 OpenAI 及前 Apple 硬件高管 Tang Tan 窃取商业机密;OpenAI 官方博文反击并提交驳回动议。本质是"个人计算终端下一形态"由谁定义——Apple 的软硬件集成路线 vs OpenAI 无屏幕语音优先的"calm computing"路线。 ## 专题 06 · 美国"硅谷"新军工企业全景 Anduril(估值洽谈千亿美元)、Mach Industries、Helsing(欧洲版 Anduril,180 亿美元估值)等"新军火商"崛起;Palantir 是这套模式的原型(FDE 打法发明者,Karp 公开抨击"纯模型公司");Anthropic 与五角大楼的供应链风险认定诉讼是这场博弈最激烈的一幕。 ## 元信息 - 设计系统:Fraunces/Source Serif 4/JetBrains Mono,paper/ink 色板,与本站其余 buzzwords 期数一致 - 交互组件:阅读进度条、浮动期号导航(含本期二维码/AI 划词解释 KEY)、原文摘录展开按钮、Model/Benchmark/Agent 三色标签 - 上一期:https://xiaopingfeng.com/buzzwords/96/ · 全部期数:https://xiaopingfeng.com/buzzwords/