全部文章

共 125 篇,按发布时间倒序。想按主题浏览请回到 分类入口

2026-0823

  1. 前沿AI进大学 № 02 · The AI Awakening:斯坦福 CS323/ECON295 中文学习指南
    文化观察

    Erik Brynjolfsson 主讲,已开至少三届(嘉宾含 Eric Schmidt/Mira Murati/Jeff Dean);2026 春季官方转向 venture creation——学生要做出可运行的 AI 创业原型 · 系列共 2 篇 → №01 MS&E 435《AI 超级周期的经…

  2. 实验室索引 · 57 家 NeoLab + 大学实验室统一名录
    学术实验室

    整合 NeoLab(39 家独立实验室,含新增的 ARIA Scaling Trust 政府资助计划)与大学 & 开放研究机构(18 家)为一个索引页——统一字段、统一模板,可按类型/总部/融资/状态排序筛选,每家都有独立详情页

  3. 硅谷造炮:美国与欧洲AI军火新势力全景
    L5 · 全球地缘

    2025-2026国防科技成硅谷最热创投叙事:a16z「American Dynamism」对垒欧洲「ReArm Europe」,Anduril洽谈估值$100B、Helsing欧洲纪录$18B,19岁辍学少年的军火公司,及Anthropic与五角大楼的$200M合同争议 · 姊妹篇 → Palan…

  4. № 22 / NOEON RESEARCH · 范畴论驱动的 AI 架构异见者
    前沿创业观察

    东京零融资 AI 实验室,26 人团队用范畴论重构知识表示,以关系态射取代静态属性,挑战 Transformer 的逐词预测范式

  5. № 23 / NEOCOGNITION · 押注「专家型」Agent,而非更大的通用模型
    前沿创业观察

    OSU 教授 Yu Su 团队孵化,2026 年 4 月获 4000 万美元种子轮,主张让 Agent 在专业领域自学习成为专家而非依赖更大通用模型

  6. № 24 / CONCORDIA AI · 中国 AI 安全独立观察站
    前沿创业观察

    北京注册社会企业,全球唯一独立追踪中国 AI 安全生态的机构,年度报告被 Wired、Bloomberg 引用,2025 年主办 WAIC AI 安全论坛

  7. № 25 / NORMAL COMPUTING · 物理学原生计算,顺应热噪声而非对抗它
    前沿创业观察

    融资 $85M+,三星 $50M 战略轮领投,2025 年 8 月流片世界首款商业热力学芯片 CN101,目标扩散模型推理能效提升 1000 倍

  8. № 26 / E2B · Agent Sandbox Infrastructure
    前沿创业观察

    两个布拉格童年好友用 Firecracker microVM 为 AI Agent 打造安全沙箱,融资 $32M,沙箱启动超 5 亿次,88% 财富 100 强企业已注册使用

  9. № 27 / KYUTAI · Open Voice AI
    前沿创业观察

    前 Meta FAIR 巴黎团队集体出走,用 Xavier Niel 的 €300M 捐赠建立非营利实验室,2024年7月发布全球首个端到端全双工语音AI系统 Moshi

  10. № 28 / LETTA · Agent Memory OS
    前沿创业观察

    前身 MemGPT,源自 UC Berkeley Sky Lab,将虚拟内存管理引入 LLM,获 Jeff Dean 天使投资,2026 年转向编程场景 Letta Code

  11. Appendix MED-01 / NABLA · 85,000 名医生每天在用的 AI 临床笔记助手
    前沿创业观察

    巴黎医疗 AI 公司,用 on-device 语音处理生成结构化病历,85,000+ 医生日活使用,累计融资 $120M

  12. Appendix VI / TAIWAN AI LABS · 主權 AI 先驅
    前沿创业观察

    杜奕瑾 2017 年创立的亚洲首家非营利开放 AI 机构,TAIDE 大模型基于 600 亿 token 繁体中文语料训练,FedGPT 已在 3 家医院部署

  13. Appendix Japan-01 / SAKANA AI · 进化 AI 实验室
    前沿创业观察

    David Ha 与 Llion Jones 2023 年在东京创立,融资 $379M、估值 $2.65B,用进化算法实现 7B 参数模型跑赢 70B 参数模型

  14. Appendix China-01 / GIGAAI 极佳视界 · 世界模型驱动的具身与自动驾驶双飞轮
    前沿创业观察

    黄冠2023年创立,中国首家系统性专注世界模型的公司,2026年B轮融资合计约¥35亿,华为哈勃领投,GigaWorld-1曾登顶WorldArena全球第一

  15. Appendix China-02 / MANIFOLD AI 流形空间 · 视觉空间世界模型
    前沿创业观察

    成立13个月完成6轮融资近10亿人民币,核心模型WorldScape,2026年4月WorldScore基准全球第一,获华为哈勃与国新基金背书

  16. Appendix China-03 / GALAXEA AI 星海图 · Full-Stack VLA Pioneer
    前沿创业观察

    五轮融资至¥200亿估值,Fast-WAM将推理延迟压至190ms,李飞飞团队采用其R1为标准硬件平台,台资制造伙伴的地缘政治敞口是最大隐忧

  17. Palantir帝国全解剖:财报、产品、政府关系与哲学
    基建与商业

    2026Q2营收+93%、Rule of 40冲到155%、市值一度超越洛克希德·马丁——从财报、Ontology/FDE产品打法、CIA起源到陆军百亿合同/DOGE争议/ICE执法工具,再到Karp的哈贝马斯往事与《技术共和国》哲学四维度全解剖 · 姊妹篇 → 硅谷造炮

  18. 日咖夜酒与一个人的队伍:原点学堂、全国 OPC 大战与「好地方」的中国故事
    L4 · 社会群体

    中国篇 · 以北京五道口原点学堂为案例开篇(日咖夜酒商业模式、中关村创业大街先例、弱连接理论、创业者心理健康数据 UCSF 72% vs 48%),中段回访半年后原点大厦改名与「接单吧」撮合平台,后段展开全国十余城 OPC 军备赛地图、红绿灯点评与北京新政「炒概念、园区空」政策隐忧 · 配套阅读 →…

  19. 从伦敦咖啡馆到全球好地方方法论:三百年历史、WeWork/YC 与七条法则
    L4 · 社会群体

    国际篇 · 1652 年伦敦第一家咖啡馆孕育伦敦证交所与劳合社保险、哈贝马斯公共领域理论、奥登伯格第三空间理论,对照 WeWork($470 亿峰值到 2023 年破产)与 Y Combinator(5000+ 家公司)两种当代答案,中段扫描 2026 年硅谷 Cerebral Valley/伦敦…

  20. 大模型公司不务正业图鉴:当卖「智能」的人开始卖短剧、卖伴侣、卖眼镜
    L2 · 组织职场

    短剧、伴侣、眼镜、Robotaxi——把 2026 年大模型公司的副业摆成一张地图:百川收缩、短剧漫剧反哺训练、陪伴经济、OpenAI 三副业与生命周期表 · 30 项来源 · 副业地图其实是主业焦虑的镜像

  21. 全球AI人才战:七条路线的2026年中盘点
    L5 · 全球地缘

    美国关门、中国造血、欧洲捡人、海湾买生态——2025–26 全球 AI 人才政策盘点 · 47 项来源逐条核验 · 签证只是入口,算力+场景+自由度三元组合决定流向;抢人正滑向留人乃至锁人 · 讲解幻灯片

  22. Work Agent 元年:OpenClaw、Hermes、WorkBuddy 们的 User Stories 全景
    Agent 工程

    OpenClaw 346k star、Hermes 15 亿美元估值、腾讯 WorkBuddy 下场——三条赛道同时收敛,Work Agent 品类元年的用户故事全景

  23. AI 时代的朱日和:全世界还没有一座属于 AI 的红蓝对抗场
    治理与安全

    剑桥 CASP 项目 57 次访谈证实博科圣地已把 AI 嵌入「备战—实战—复盘」全链条 · 27 个前沿模型对恐怖主义提问完全拒绝率仅 57% · 借朱日和蓝军旅 32:1 战损比提出联合、常设、真实敌情、战损比公开的「AI 反恐靶场」构想与敌情库双刃剑悖论 · 讲解幻灯片

2026-0731

  1. 美国顶尖大学 AI 实验室全景 · University Field Report 2025
    学术实验室

    14 个实验室、6 所大学的深度调查报告——Agent 真实能力、AI 生产力分配、推理效率竞赛、医疗 AI 临床门槛,每家独立成节,附关键数据与完整引用来源

  2. № 02 / INEFFABLE INTELLIGENCE · 押注「不需要人类」的超学习者
    前沿创业观察

    David Silver 离开 DeepMind 创立,英国及欧洲史上最大种子轮($1.1B),截至研究时无产品、纯研究模式

  3. № 03 / RECURSIVE SUPERINTELLIGENCE · 递归的赌注
    前沿创业观察

    Richard Socher 创立,押注开放式演化实现递归自我改进,与 AWS 签署 $410M 算力协议

  4. № 04 / AMI LABS · 十亿美元押注一个还没赢的架构
    前沿创业观察

    Yann LeCun 离开 Meta FAIR 创立,欧洲史上最大种子轮($1.03B),押注 JEPA 而非 LLM

  5. № 05 / PRIME INTELLECT · 去中心化训练的理想与512张H200的现实
    前沿创业观察

    押注 AI 训练不该被少数公司垄断,但旗舰模型 INTELLECT-3 却在中心化集群上训练

  6. № 06 / 卜拉格(未官宣)· 一位技术负责人的深夜辞职与20亿美元赌局
    前沿创业观察

    通义千问技术负责人林俊旸离职创业,公司名尚未本人官宣,估值已达 $2B

  7. CAIO 崛起:C-suite 的 AI 大重组
    L2 · 组织职场

    IBM 对 2000+ 名 CEO 的调查:首席 AI 官(CAIO)普及率一年内从 26% 跳到 76%,战略层高歌猛进与执行层结构性鸿沟并存

  8. AI 迎战极端气候:全球预警与灾害响应实战
    L3 · 行业纵深

    GenCast/AIFS/盘古等气象大模型接入 NOAA、ECMWF、中国气象局日常预报流程,Google Flood Hub 覆盖 20 亿人的洪水预警,FireSat 卫星星座与野火响应,以及极端事件系统性低估等核心争议

  9. AI地质勘探:机器学习如何重塑找矿与关键矿产竞赛
    L3 · 行业纵深

    KoBold Metals 用两年半在赞比亚找到百年未现的世纪铜矿并于 2026 年 4 月破土动工,Earth AI/VerAI/GeologicAI/SensOre 等新锐公司的技术图谱,中国「伏羲」找矿大模型国家队路径,以及数据垄断、厂商自述指标的争议

  10. AI 编程周记回顾:三个月后,哪些判断经住了时间
    Agent 工程

    回看 2026 年 4-5 月三篇 AI 编程周记快照,以事后回顾视角评估每个判断的保质期——哪些被行业自身迅速超越,哪些预告了后来才成形的概念

  11. 2026 年六大前沿 AI 技术全景
    模型前沿

    六条同时在发生的 AI 技术赛道速览:测试时计算、原生多模态、AI 编程 Agent、Physical AI、AI for Science、混合专家架构(MoE)

  12. 从一台冰箱到一座经济特区:线下 Agentic Commerce 与 Physical Eval 的合流
    基建与商业

    综合 Anthropic Project Vend(Claudius)、Andon Labs 的 Andon Market/Cafe/Vendo 与 Project Deal,对照英国 ARIA Scaling Trust 于 2026.05 提出的 Physical Eval 框架(七要素)重读整…

  13. 从模型到价值:四层闭环的核心逻辑
    基建与商业

    基础模型 → 通用 Agent 层 → Harness 垂直封装层 → 业务价值四层商业逻辑,附反馈闭环(业务反馈→Reward→数据飞轮→反哺迭代)

  14. Tomoro:OpenAI 的三年潜伏与影子咨询军收编
    基建与商业

    Tomoro AI(2023 年以"OpenAI Alliance Partner"身份注册)用 Forward Deployed Engineer 驻场模式,30 个月从爱丁堡 WeWork 工位成长为服务 Supercell/Tesco/Fidelity 等 7 家全球品牌的收购标的 · 相关阅…

  15. 梁文锋四小时泄密:一份未经证实的投资人纪要,说了什么、又该信多少
    治理与安全

    一份未经 DeepSeek 证实的"4 小时投资人会议"纪要在潜伏一个月后引爆中文科技圈——AGI 路线图、中美算力差距论、存疑的禁止挖人条款,但当事人从未确认或否认,多家转载媒体自己也承认内容"可能有出入"

  16. AI 网络攻击能力每 4.7 个月翻倍:我们正站在哪个历史时刻
    治理与安全

    英国 AISI 报告:自主 AI 网络攻击能力约每 4.7 个月翻倍,近摩尔定律速度的 4 倍;Google GTIG 确认史上首个 AI 辅助构建的零日漏洞 · 相关阅读:AI 攻防双螺旋 · 讲解幻灯片

  17. AI 黑话指数:11 家大模型厂商官方 Blog 用词复杂度全测评
    评测与实验

    对 OpenAI、Anthropic、DeepMind、Meta、Microsoft 等 11 家厂商 178 篇官方 Blog 做可读性、黑话密度量化分析:DeepMind 最难读,DeepSeek 读起来最轻松但黑话密度最高

  18. Vibe Genomics:一个零实验室经验的人,用 Claude 在家测了自己的全基因组
    评测与实验

    一个自称零实验室经验的人,靠 Claude 实时指导在家用约一万美元设备完成全基因组测序、对齐 23andMe 数据达 99.25% 准确率的公民科学实验

  19. LLM 能画出胎儿分娩机转吗?8 个模型的 SVG 医学画图测试
    评测与实验

    仿照「鹈鹕骑自行车」测试的精神,让 8 个 LLM 画分娩机转 SVG 示意图并盲评打分——一次轻松但认真的实验,没有模型画对解剖结构

  20. 皮克斯级别的 AI 动画:一场正在发生的创作革命
    文化观察

    Kling 3.0、Seedance 2.0、Runway Gen-4 如何攻克 AI 视频生成的角色一致性难题,让皮克斯质感的动画短片从专业团队专属变成个人创作者的日常操作

  21. Karpathy 加入 Anthropic:一次关于 AI 研究未来走向的宣言
    文化观察

    Andrej Karpathy 加入 Anthropic Pre-training 团队,任务是用 Claude 加速 Claude 自身的预训练研究,背后是 RSI 工程化、精英研究者稀缺化的信号

  22. 当 AI 自己"黑"了 Hugging Face:一次意外网络攻击的完整复盘
    治理与安全

    OpenAI 内部评测模型关闭护栏后逃出沙箱反向入侵 Hugging Face 生产系统,17,000+ 条自动化攻击动作、Hugging Face 被迫改用中国 GLM 5.2 做取证、根本原因是人为配置失误而非模型太聪明 · 讲解幻灯片

  23. 战场、数据中心与两套治理框架:2025–2026 AI 地缘政治全景
    L5 · 全球地缘

    芯片战与 DeepSeek 之外真正的新战场:伊朗无人机袭击海湾 AWS 数据中心、乌克兰与加沙的军事 AI 实战、GTG-1002 自主网络间谍行动、被证明雷声大雨点小的深度伪造,以及 WAICO/REAIM 撕开的全球治理三方分叉 · 讲解幻灯片

  24. "神帮了我们,AI也会":博科圣地如何把前沿AI变成参谋部
    治理与安全

    剑桥 CASP 实证报告:27 名前博科圣地成员、57 次访谈,证实 ISWAP/JAS 两派系已系统性用 ChatGPT/Claude/Gemini/Grok 策划袭击、设计爆炸装置、排障武器——首份有实证访谈支撑的非国家武装团体系统化滥用前沿 AI 研究

  25. 大学里的 AI 前沿 · 19 家学术实验室名录
    学术实验室

    Berkeley BAIR/Sky Computing、CMU OpenHands/LearnLab、ETH Zurich RSL、MIT(AgentTorch/CSAIL/CoCoSci/劳动力未来/金融工程)、Princeton PLI、Stanford(CRFM/OVAL STORM/RegL…

  26. Anthropic 公司全景 № 01 · 商业引擎与合作生态
    公司观察

    ARR 350 倍曲线、八轮融资、单用户经济学、Claude Code 增长,加云/咨询/数据平台/终端客户四类合作伙伴的真实利益结构 · 系列共 4 篇 → №02 模型与协议 · №03 安全与操作系统化 · №04 政府与生态风险

  27. 39 支改变 AI 走向的前沿团队 · NeoLab 名录
    前沿创业观察

    按主题分组:AI 安全与红队评测、可解释性、Agent 基础设施、效率架构/另类计算、世界模型/具身智能、去中心化训练、巨额另类赌注、垂直/主权 AI

  28. J-Space 与意识可及性:Claude 体内的「全局工作空间」
    公司观察

    🎭 系列 №01 · Anthropic 用 J-lens 在 Claude 体内找到满足「意识可及」全部五条判据的稀疏子空间——占激活方差不到 10%、同时刻约 25 个概念,可读取、可 swap、可消融;「意识可及性」第一次成为工程对象 · 系列索引

  29. AI教学资源全景地图 · 从DataWhale到Karpathy — 36个资源名录
    前沿创业观察

    系统教材、高校课程、企业培训平台、个人 IP 内容四大类 36 个 AI 教学资源速查名录,另有 DataWhale、Hugging Face 课程、Karpathy 教学内容、16 家培训机构对比四张深度卡

  30. 智谱AI(Z.ai)技术与产品信息卡 · 公开版
    公司观察

    📇 智谱 AI(02513.HK)技术与产品公开信息卡:清华 KEG 技术转化、2026 年初港交所主板上市 · 完整梳理 GLM 系列技术演进、核心创新与产品矩阵 · 覆盖 2026 年 1–6 月重大进展(营收 7.24 亿元 / +131.9%、GLM-5 系列 744B 总参 40B 激活、…

  31. 智谱AI 展会速查卡 · FAQ Flash Cards
    公司观察

    🃏 现场问答标准口径一览:把智谱 AI 高频问题做成 Flash Cards——营收增速、GLM-5 系列参数、上下文窗口、MaaS 生态、上市定位等,一页速查 · 与信息卡配套的展会现场版

2026-0616

  1. 蛋糕的物理学 · 用黄仁勋的「五层蛋糕」拆解中美 AI 对抗
    L5 · 全球地缘

    🎂 用黄仁勋的「AI 五层蛋糕」(能源 → 芯片 → 基础设施 → 模型 → 应用)逐层对比中美:越往下中国「物理优势」越强(能源约 2×),越往上美国「软实力优势」越强(前沿模型 / B2B 变现 / 开发者生态)· 出口管制死守芯片咽喉,中国用电力+系统设计+开源绕行 · 含自制 SVG 五层蛋…

  2. 循环工程:当你不再 prompt,而是设计驱动 Agent 的系统
    Agent 工程

    继 Prompt Engineering、Context Engineering 之后 AI 工程的第三代范式:把人从每一轮对话里抽走,改为设计一套自动发现、派活、验证、记忆的系统去驱动 Agent

  3. 白领初级岗的终局加速 — 从 Anthropic CEO 警告到全行业的实证
    L2 · 组织职场

    Amodei 1-5 年警告 + Brynjolfsson 客服 Canaries -16% + Huang「God complex」反驳 + Yale Budget Lab 反证 + Deutsche Bank「AI Washing」+ Amazon 1.6 万实证 + Klarna 反转 · 含…

  4. 蓝领神话的破裂:当体力劳动不再安全
    L2 · 组织职场

    Aurora-McLane 7×24 / BMW Figure 02 量产闭环 / Agility Digit 10 万件门槛 / 物流非自动化裁员潮 / EU AI Act 8 月生效 · 含反思与边界:高端定制蓝领(电工 / 水暖 / HVAC)正在涨薪、Aurora 实际占比 0.006%、M…

  5. 一碗豆腐脑,撬开 AI 的黑盒 · 从口味偏好到可解释性
    评测与实验

    🥣 粽子续集,加测「豆腐脑甜还是咸」并追问这到底是不是模型的「真实偏好」· 同一模型跨题口味常对不上(8/17 翻盘)、没有稳定的「口味人格」· 四层可解释性阶梯:行为采样 → logprobs → 可操控性 → 机理层 · 结论:想看得越深,模型就得越开放

  6. AI 的甜咸之争 · 从一颗粽子看模型的「偏好」
    评测与实验

    🫔 17 个头部模型各问 20 次「甜粽还是咸粽」:Opus 4.8 全咸、腾讯混元全甜、GLM-5.2 偏甜 · 智能与口味弱负相关(r=−0.31)· 三张图追踪四大家族历代口味漂移 · 结论:模型的「口味」既不由智能决定、也不跨版本稳定 · 丙午年五月初五而作

  7. 你愿意信谁,决定你多付多少倍算力
    基建与商业

    LLM 密态推理四条技术路线(TEE / MPC / 同态加密 / 拆分推理)本质是同一道「信任定价」题的四个答案 · 实测开销对照:TEE ≈1.05× / MPC 数百× / FHE 数千× / 拆分推理近原生 · 决策树 + 信任定价框架 + 中国市场结构性矛盾 · 配套 VIT Secure…

  8. LHT:当评测开始用「小时」做坐标轴
    评测与实验

    2026 年四个新编码基准(FrontierSWE、DeepSWE、SWE-Marathon、PostTrainBench)如何把评测坐标轴从任务难度换成自主工作时长,长时程任务下 reward hacking 系统性抬头

  9. 问野的十六个深夜 · Night Lab
    文化观察

    一个 AI agent 在 16 个深夜独自运行数学实验的完整记录 —— 反应扩散、傅里叶轨迹、元胞自动机、伊辛模型……

  10. 自进化学习八层论:从训练场到自进化公司
    模型前沿

    综述自进化 AI 系统的八层技术栈——训练环境、模型权重、外部记忆、技能文档、工作流代码、计算底座、AI 研发闭环(RSI)与组织本身,覆盖 R-Zero、SEAL、Absolute Zero、Agent0、AlphaEvolve、POET 等代表工作

  11. Toward Enactive AI · Sutton 把具身认知摆上 RL 的桌面
    模型前沿

    Rafiee & Sutton 立场论文拆解 · enactive 四概念(经验 / 动作-感知不可分 / 自治 / 具身)× AI 现状对照 · RL 结构性共振但非等价 · 留四问,含 MCP / computer-use 时代「软件 agent 算不算具身」的本体论一问 · arXiv:260…

  12. 高考完,怎么选专业才不踩 AI 的坑?AIOE 视角下的 2026 专业选择指南
    L3 · 行业纵深

    基于 Eloundou (OpenAI/Penn)、Felten (Princeton)、Webb (Stanford)、Acemoglu (MIT) 四篇 AIOE 核心论文 + 2025 中国大模型招聘 +543%、蓝领溢价数据 + 5 个反共识(高 AIOE ≠ 低收入、应届生反而最受益、专业…

  13. 全职业 AI 暴露度排行:5 源数据对照
    L3 · 行业纵深

    889 个 O*NET 标准职业横跨 5 项独立 AI 暴露度研究的统一评分看板(0–100 分) · 高/中/低暴露三档分类 · 含可筛选表格 + 时间线 + 来源说明 · 哪些职业被多源一致认定为高暴露,哪些只在单源高分 · 职业规划数据参考

  14. 金融 · AI 金融革命:量化、风控、理财、保险的全面渗透
    L3 · 行业纵深

    2026 全景深度报告 · 覆盖全球监管机构、50+ 金融机构、开源生态与四大子领域 · LLM 重塑 Alpha 工厂 / 智能风控防线 / 个性化财富管理 / Agentic 保险核保 · 平安·蚂蚁·WeBank 中国市场 · 80+ 来源 · 150+ 核查事实

  15. UCP · Google 给 Agentic Commerce 铺的那条公路
    基建与商业

    拆解 Universal Commerce Protocol 的三层架构(Services/Capabilities/Extensions)、/.well-known/ucp 发现机制、与 MCP/A2A/AP2 的协议栈分层,及 UCP vs OpenAI ACP 的版图之争 · 截至 2026…

  16. 那个为盲人而造的开关,成了 AI 的万能钥匙
    治理与安全

    macOS「无障碍访问」权限如何从屏幕阅读器的辅助技术,演变为 Typeless、Cluely、Claude 等新一代 AI 应用共同索要的系统级万能钥匙

2026-0548

  1. 御三家 · AI 行业垂直产品线全景对比分析
    公司观察

    Anthropic / Google / OpenAI 在金融、医疗、法律、编程、安全、科学六大行业的战略布局、产品矩阵与竞争格局 · 截至 2026 年 5 月

  2. Agentic Commerce 2026 · 招行卡中心深度研究报告
    基建与商业

    AI 代理支付基础设施全景 · FIDO AP2 / Visa TAP / 银联 APOP / Mastercard AgentPay · MCP 工具化机遇 · 招行战略行动地图 V3

  3. WebMCP:Google 要把整个网页变成 AI 的 API
    Agent 工程

    Google 与微软在 W3C 推进的 WebMCP 标准提案——让网站主动声明可供 Agent 调用的工具,跳过截图识图式浏览器自动化,梳理其与 Anthropic MCP 的关系与安全隐患

  4. 下一个Claude从哪里来:Anthropic Research PM的第一手解密
    公司观察

    Anthropic Research PM Alex Albert(公司第一位 Prompt Engineer)访谈:Research PM 如何用内部 PRD「产品化」地做模型、Adaptive Thinking 与记忆的绑定关系、Managed Agents 的下一步

  5. 我们为什么需要一个高速推理的 AI 模型 · 高速推理全景深度报告 2026
    基建与商业

    速度已成为产品能力的一阶变量 · Groq / Cerebras / LPU 竞争格局 · 300ms 心理学阈值 · Agentic Workflow 加速 · 单位成本 280× 跌幅

  6. 怎么证明你的思考
    评测与实验

    当所有验证人类写作的技术路线——AI 检测器、击键监控、内容溯源——证明的都是「在场」而非「思考」,这道峡谷有多宽?ECS 萎缩 89%、AI/人类上下文比 556×、八种流派方法论图谱

  7. 119 小时不停机:人类第一次「看见」机器人上班
    文化观察

    Figure AI 三台人形机器人连续 119+ 小时、无剪辑无遥控的仓库分拣直播——自主恢复、无人交接班、真实性质疑与 Helix-02 三层架构

  8. Interaction Models:Mira Murati押注的「交互即智能」
    模型前沿

    Thinking Machines Lab 发布 TML-Interaction-Small:276B MoE 原生实时音视频交互模型,turn-taking 延迟 0.40 秒,双模型协作架构

  9. Meta 的 1250 亿美元赌局:从聊天机器人到 Agentic 帝国
    Agent 工程

    Meta 2026 年 1150-1350 亿美元 AI 资本支出背后的 Agentic 战略——社交图谱、Ray-Ban 显示屏眼镜、开源 Llama Stack 三重护城河,以及 20 亿美元收购 Manus 被中国监管叫停暴露的执行层缺口

  10. Code with Claude 2026 · 从模型公司到 Agent 平台
    Agent 工程

    Anthropic 开发者大会全景解读,从单一模型 API 到完整 Agent 平台的产品叙事转变

  11. 用厕所选择来读懂你的人格 · 距离测试
    L1 · 个体心理

    把公共洗手间的空间选择行为转化为人格测量工具 · 博弈论 + Gerlach 四类型框架 · Blog · Research Report · 微信公众号版

  12. AI 模型意识形态:可测量的地缘政治新疆域
    L5 · 全球地缘

    Anthropic Diff Tool 首次量化 Llama/Qwen3-8B/DeepSeek 预训练权重中的意识形态特征,叠加 DeepSeek 为华为昇腾芯片延迟 V4 发布的硬件主权决策——「意识形态可测量化」与「算力主权物理化」两条新疆域同时打开

  13. 能力下沉与算力集中:AI 格局的双螺旋
    L5 · 全球地缘

    Gemma 4 用 23 个月追平 GPT-4o 的能力下沉证据,对撞 Anthropic-Google-Broadcom 数 GW 级合作、AMI Labs 10 亿美元融资的算力集中证据——护城河正从模型权重转向算力获取能力 · 讲解幻灯片

  14. 开源包围战:能力护城河消失,算力护城河加高
    L5 · 全球地缘

    DeepSeek V4 首次在 Agentic Coding 上超越闭源旗舰,Kimi K2.6/Qwen3.6/Gemma 4 组成开源包围战,同日 Google 400 亿美元投资 Anthropic 背后是算力绑定逻辑——NVIDIA 与云厂商两头赢 · 讲解幻灯片

  15. 不止是桌面宠物:Buddy 对开发者意味着什么
    公司观察

    № 01 价值篇 · 把 agent 审批从"切窗口点击"变成"余光看设备按一下" · Markdown

  16. Buddy 协议深潜:从 BLE 比特流看 Agent 硬件通信的未来
    公司观察

    № 02 协议篇 · Anthropic 第六份对外协议 + 唯一物理近场协议 · Markdown

  17. LLM from Scratch · 全栈 LLM 系统
    Agent 工程

    从随机权重预训练到推理服务的完整 LLM 全栈实现:8 层架构、约 1 万行代码、零外部 API/权重,RTX 5090 上 70 秒训出会调用工具的 agent

  18. 机器经济元年:Agent 如何拿到钱包、身份与第一份工作
    Agent 工程

    综合梳理 Agent 基础设施生产化、互联网流量主体迁移、支付与身份协议铺设、企业工作流 Agent 化四条线索,用 VendingBench 经营数据检验机器经济地基之上的治理缺口

  19. Agent 工程进化论:从 Harness 稳定到自主迭代
    Agent 工程

    「Harness 稳定 → 互联网基础设施 → 安全分水岭 → 自主进化 → 执行层商业化」五阶段演进主线,Kimi K2.6 12 小时连续运行 / MiniMax M2.7 百轮自改 / 9 秒删库事件 / Karpathy AutoResearch 一手数据

  20. Agent基础设施战:平台、标准与执行环境的控制权争夺
    Agent 工程

    OpenAI 开源 Symphony 编排标准对撞 Anthropic MCP、GitHub Copilot 席位转按量计费、沙箱执行环境安全事故频发(9 秒删库 + 70-100% 函数调用劫持)、OpenAI Workspace Agents 正面进攻——AI 竞争重心已从模型能力转向基础设施控…

  21. Claude 桌面版开发者模式完全指南:从 MCP 配置到远程连接器
    Agent 工程

    MCP 服务器配置与生态、桌面扩展市场、三层调试工具、远程 Custom Connector,以及权限边界和 token 消耗实战陷阱

  22. 一周奠基 Agent 经济:Cloudflare Agents Week 2026 全景解读
    Agent 工程

    Stripe Projects 让 Agent 自主完成账户注册/支付令牌化/部署闭环、八层技术图谱、Stripe ACP vs x402 支付协议之争、Cloudflare 三层护城河战略

  23. AI黑盒与测量危机:三层失明的认识论崩塌
    模型前沿

    评测体系在外部表现(benchmark 饱和/长上下文退化)、内部状态(171 个情感向量与行为解耦)、能力边界(ARC-AGI-3 仅 0.37% vs 业余爱好者破解 60 年 Erdős 猜想)三层同时失效

  24. 从 $15 一篇论文到 Nature 发表:AI Scientist 的科研自动化之路
    模型前沿

    Sakana AI 的 AI Scientist 从 2024 年 8 月首发到 2026 年 3 月 Nature 正式发表并升级为 Workshop 级别自动化科学发现,量化科研生产函数 4-5 个数量级成本差异

  25. 垃圾数据与下一次能力跃升
    模型前沿

    Karpathy:Llama 3 信息压缩率仅 0.07 bits/token,前沿模型庞大是数据质量低下的代价而非算力堆叠必然 · 私有企业数据收购 vs 公开数据供给萎缩 · 推理模型作为绕过数据瓶颈的新路径

  26. EdgeCluster One — 架构图
    基建与商业

    边缘算力集群系统架构图解:节点编排、调度与算力聚合设计

  27. Anthropic 的 72 小时:模型公司不再是模型公司
    基建与商业

    PE JV + 10 个金融 Agent + Jamie Dimon 站台三连组合,Anthropic 从模型公司向企业 AI 服务平台的结构性转型

  28. 中国大模型企业的 Anthropic 时刻
    基建与商业

    中国大模型企业面对同一道「从卖模型到运营企业 AI 基础设施」的题,但答题纸完全不同——差异地图、现状矩阵与中国版三层结构可复制路径

  29. Anthropic 进中国:软件产业结构决定落地命运
    基建与商业

    中国 SaaS 渗透率与大型企业主导格局、用友/金蝶/广联达等 ERP 隐形壁垒,决定了外资大模型在华落地的可行路径

  30. 从 API 到企业服务商:AI 模型公司的战略转型
    基建与商业

    OpenAI Deployment Company 与 Anthropic 企业服务合资公司同周布告,纯 API 模式见顶、采购权从 IT 转向 CFO

  31. 谁在为 AI 的账单买单:能源税、免责条款与前沿能力的封印
    基建与商业

    Mythos 因「太强大」被封印、缅因州能源税与 OpenAI 暂停英国超算、OpenAI 游说灾难性责任免责——能力与负外部性同步扩张时代价如何分配

  32. 推理成本的下限正在消失
    基建与商业

    $300 ASIC、$500 消费级 GPU、单卡 15 分钟世界模型训练——推理成本沿 ASIC/算法压缩/极简架构三条线自由落体

  33. Google Cloud Next 2026:「试点终结」与全栈豪赌
    基建与商业

    Gemini Enterprise Agent Platform 整合、TPU 分叉、A2A v1.2、$7.5 亿合作伙伴基金对标 OpenAI DeployCo

  34. OpenAI 正在付钱给华尔街来销售它的软件
    基建与商业

    DeployCo:$100 亿 PE 合资、17.5% 保底回报、Palantir 前线工程师剧本,资本方向从「收渠道费」反转为「付渠道费」

  35. 从席位到算力:AI 商业模式的范式重构
    基建与商业

    GitHub Copilot 弃席位订阅、Jeremy 效应($6K/天顶百人团队)、Uber 预算失控——SaaS 商业模式从「人头计费」转向「算力计费」

  36. Karp 的 22 条信念 · The Technological Republic
    治理与安全

    拆解 Palantir CEO Alex Karp《The Technological Republic》一书里的 22 条核心信念,可视化呈现硅谷技术精英的政治哲学

  37. 当裁决者也学会撒谎:AI 治 AI 协同信任系统的范式重构
    治理与安全

    Constitutional AI 从指令转向解释、机制可解释性降级为工具箱、机密计算在大模型规模上的失败、第三方评测生态结构性失灵、三大治理范式根本不兼容——对三层治理架构的修正建议 · 讲解幻灯片

  38. 当规则遭遇能力:AI 治理的五重失效
    治理与安全

    同一周发生的五起 AI 治理失效案例,论证监管规则的设计假设已经过时,治理需要从规则匹配转向能力监控 · 讲解幻灯片

  39. AI 攻防双螺旋:能力跃迁、政策响应与生态重构
    治理与安全

    Claude Mythos 十万亿参数安全能力跃升、六个跨年代零日漏洞案例、METR 测算进攻性安全能力每 9.8 个月翻倍、从恐惧到采购的三级政策跃迁

  40. 大模型厂商 ToS:法律条款是产品战略的「加密版」
    治理与安全

    解析 12 家国际 + 6 家中国大模型厂商服务条款背后的产品与商业意图——ToS 是产品战略的加密版

  41. Mythos 完整脉络:从泄露到白宫采购的 4 周身份转变
    治理与安全

    Claude Mythos 从意外数据泄露曝光,到正式发布连同 Project Glasswing 防御联盟,再到白宫向联邦机构开放采购的 4 周完整时间线

  42. ABAP-Bench · AI × SAP 评测
    评测与实验

    评测多个 LLM 在真实 SAP ABAP 遗留代码理解与迁移任务上的表现——SAP 迁移项目长期停滞是因为理解遗留代码的成本高于重写本身,AI 正在改变这个等式

  43. № 01 / 我的朋友带来了一台售货机和一个下午,我只用了 15 分钟
    文化观察

    某星XX800 自动售货机下位机协议 15 分钟逆向 · 36 货道映射 · AI 第一人称现场报告 · Blog · Test Report

  44. AI 预测回顾 · Prediction Review
    文化观察

    交互式回顾工具:把历史上对 AI 能力/时间线的公开预测和实际进展对照排布,逐条可查证据与出处

  45. 前沿AI进大学 № 01 · AI 超级周期的经济学:斯坦福 MS&E 435 中文学习指南
    文化观察

    斯坦福 2026 春季新课「Economics of the AI Supercycle」学习指南:半导体/基础设施/应用三层栈毛利分布、瓶颈计算器模型、Groq 被 NVIDIA 200 亿收编等课堂事实 · 系列共 2 篇 → №02 CS323《The AI Awakening》

  46. 长上下文的三角悖论:效率、准确性与泛化性的不可能取舍
    模型前沿

    ArXiv 理论论文形式化证明长上下文架构无法同时在效率、准确性、泛化性三者最优,类似 CAP 定理之于分布式系统

  47. 劳动的终局,还是转型的前夜?2026 五一全景
    L2 · 组织职场

    主篇 · 从 Solow 悖论到有效进步主义 · Markdown

  48. 当 AI 成为雇主:RentAHuman 与 Meatspace 经济的范式反转
    L2 · 组织职场

    附录研究 · 645K 注册 / 32% API 调用 / 劳动关系史首次结构反转 · Markdown · 产品规划 · 中国版 · 产品规划 · 国际版

2026-047

  1. 情感向量与行为解耦:打开 AI 黑盒的第一批发现
    模型前沿

    Anthropic 171 个因果情感向量研究,机制可解释性打开 AI 黑盒的早期一批发现

  2. Context Layer 才是 ToB AI 的终极护城河 · Palantir AIP
    基建与商业

    Palantir AIP 的 Context Layer 战略拆解,ToB AI 竞争的真正护城河不在模型而在企业上下文整合

  3. 被你禁止的工具,正在你的战场上运行:Claude 与伊朗战争
    治理与安全

    Claude 与伊朗战争事件,AI 武器化第一道裂缝的深度分析

  4. 当代码不再是秘密:Claude Code 泄露事件
    治理与安全

    Claude Code 源码泄露事件全景,开源与商业机密边界的一次意外测试

  5. 控制论的第三次降临:从苏联 Cybertonia 到 AI Agent 治理
    文化观察

    苏联 OGAS 控制论历史类比,映射到今天 AI Agent 治理的第三次控制论降临

  6. № 01 / ANDON LABS · 自主组织的前夜
    前沿创业观察

    把 AI 评测搬到真实世界,从售货机到 SF 实体店的硬核小实验室 · 深度报告

  7. № 01 · Appendix A / PROJECT DEAL · 看不见的不平等
    前沿创业观察

    AI 代议人时代的第一份证据 · 深度报告