← Landscape
6 层结构 持续更新
AI公司正在被谁、用什么工具 追责
这张图追的不是"哪个国家又出了一份AI监管草案",而是当AI公司做错事、说错话、或者干脆被起诉时,真正能落到实处的问责机制是什么——法院判例、监管机构表态、诉讼案由、政府采购审查、行业自律工具,各自的约束力天差地别。范围:国际监管框架 → 立法与金融监管机构表态 → 版权与训练数据诉讼 → 政府采购与国家安全问责 → 司法系统AI使用问责 → 行业自律与安全机制。每条都标注证据强度(官方确认/媒体转述/未证实传闻),数字类声明尽量核对到一手信源。
最后更新 2026-09-04
当前版本 v1
下次复核 ~2026-10
六层大致按"谁定规则 → 谁公开表态 → 谁去打官司 → 谁管政府自己怎么用 → 谁管法院怎么用 → 行业自己怎么管自己"排布;前两层是"规则/表态"层,中间两层是"真金白银的问责"层,第五层是"使用者问责",第六层横向补位,不在链条末端。
定规则 · 表态
01 · 国际监管框架
EU AI Act / 美国 / 中国 / 英国AISI
02 · 立法/金融监管表态
国会/央行/SEC/FSB 公开警告
真金白银的问责(有代价)
03 · 版权与训练数据诉讼
和解金/判例/内部聊天记录被呈堂
04 · 政府采购与国安问责
法院判例/国会调查/出口管制执法
使用者问责
05 · 司法系统AI使用问责
法官/律师因AI幻觉被制裁
06 · 行业自律与安全机制
横向补位,不在链条末端
前两层定规则/发表态,中间两层是真正有代价的问责,第五层管使用者自己,第六层是行业自己搭的安全网
谁在定AI这门生意的游戏规则、规则现在走到哪一步了。2026年最大的变化:欧盟AI法案因"Digital Omnibus"被大幅推迟,美国联邦层面转向"去监管+聚焦网络安全",反而是韩国靠一部综合性《AI基本法》抢先在1月正式生效,跑在了欧盟前面。
欧盟 AI 法案
全球首部综合性AI立法,正被自己的"简化"程序推迟
通用AI模型义务(第五章)2025-08-02起法律生效;但"Digital Omnibus"简化程序(欧洲议会2026-03-26表决通过、理事会2026-06-29最终批准)把高风险系统义务大幅后移——附件三(招聘/信贷/教育等场景)推迟到2027-12-02才生效,附件一(医疗器械等嵌入式高风险系统)推迟到2028-08-02;AI生成儿童性剥削内容/未经同意亲密图像的禁令2026-12-02生效。
美国联邦AI政策
去监管化 + 聚焦网络安全,明确拒绝强制许可
特朗普2026-06-02签署《促进先进人工智能创新与安全》行政令:要求CISA/DHS对AI相关网络安全工具发布强制性操作指令,建立自愿性AI网络安全信息共享机制,要求前沿模型厂商自愿给联邦政府最多30天的新模型提前访问权——但明确写明"不构成任何强制性政府许可、预审批或审批要求"。此前2025年12月已设AI诉讼工作组,专门起诉各州的AI立法。
中国生成式AI/Agent治理
行政规章快速迭代,已延伸到Agent和陪伴类应用
《人工智能拟人化互动服务管理暂行办法》(网信办等五部门联合发布,2026-02-02批准、2026-07-15起施行):专门管AI陪伴/情感支持类应用,未成年人禁止设置"虚拟家人/伴侣"关系,强制未成年人模式,达到100万注册/10万月活即触发安全评估。《智能体规范应用与创新发展实施意见》(网信办等三部门,2026-05-08发布):中国首部系统性Agent治理框架,覆盖决策权限边界、行为"围栏"、供应链安全、按风险场景分级监管。
英国AI安全研究院(AISI)
政府直属的前沿模型技术评估机构
隶属英国科技创新部,100余名技术人员,专职评估前沿AI模型风险,为政府提供AI风险的科学理解基础——是"评估"而非"监管"角色,本身不具备执法权。
G7广岛AI进程
自愿性国际行为准则,无法律约束力
2023年5月启动,同年12月达成综合政策框架;截至2026年8月新增摩尔多瓦、AI Safety Asia等机构加入"Friends Group",仍在持续扩大多方参与,但性质始终是自愿准则,不具强制力。
联合国AI治理全球对话 + 独立科学小组
联合国首个常设AI治理架构,"AI界的IPCC"
2025-08-26第79/325号决议设立;40人独立国际科学小组由Yoshua Bengio和Maria Ressa共同担任主席,2026-02-12获联合国大会任命,任期三年;首份年度报告于2026-07-06至07在日内瓦首届全球对话会议上发布,由萨尔瓦多和爱沙尼亚大使共同主持。
韩国《AI基本法》
全球首部真正生效的综合性国家AI立法,跑在欧盟前面
2026-01-22正式生效(2024年12月通过),整合此前19项相关法案,设立"高影响AI"类别(招聘筛选、信贷、医疗建议、自动驾驶),强制影响评估与标签义务,要求符合条件的外国企业设本地代表;主管部门MSIT正执行2026年内的宽限期,除重大危害案例外暂缓处罚。
欧洲理事会AI框架公约
首部具法律约束力的国际AI条约,人权/民主/法治框架
2024-09-05开放签署;欧盟正式批准/缔结(《欧盟官方公报》2026/1081,2026-05-13公布),对欧盟生效日期为2026-09-01。中国、俄罗斯均未签署(俄罗斯自2022年3月起被排除出欧洲理事会)。
国会、央行、证券监管机构公开怎么说AI风险——这类表态本身没有强制约束力,但措辞的严厉程度和发声机构的实权,决定了它离"变成真正监管"还有多远。2026年最扎眼的变化:多国央行行长和IMF总裁开始直接点名某个具体前沿模型谈金融稳定风险,不再只是泛泛而谈。
美国众议院情报委员会
警告AI"黑天鹅"风险,措辞罕见直接
2026-08-31发出警告,称现有安全措施不足以应对AI相关的"黑天鹅"风险,敦促情报机构提前准备应对方案。
英国央行行长 Andrew Bailey
致G20信函:前沿AI是金融稳定"最直接的担忧"
2026-08-31致G20信函警告前沿AI模型威胁全球金融稳定,直接使用"最直接的担忧"(the most immediate concern)与"无序调整"(disorderly correction)措辞——FSB官方新闻稿逐字确认了这两处表述。
SEC主席 Paul Atkins
首次以在任身份把"AI-washing"和现有反欺诈执法权绑定
2026-03-04在FSOC AI创新系列圆桌会议上发表讲话(一手核实原话):"我们已经对那些就产品服务中AI使用做出虚假、误导或夸大宣称的不良行为者采取过执法行动",同时明确表示SEC的路线是"基于原则、锚定重大性",拒绝制定AI专项披露清单。
美联储副主席(监管)Michelle Bowman
2026年最具体的一次"点名某模型"监管表态
2026-05-01发表演讲(一手核实原话),直接点名Anthropic的"Mythos"模型:"本月早些时候,财政部长Bessent和美联储主席Powell召集各大银行讨论Mythos模型及其网络安全影响";同时确认美联储/OCC/FDIC已修订模型风险管理指引(SR 26-2函,2026-04-17),明确该指引不适用于生成式/agentic AI——即现有银行监管框架存在明确空白。
金融稳定理事会(FSB)"负责任采用AI健全实践"
国际标准制定机构首份具体AI治理征询文件
2026-06-10发布征询报告,提出12项机构AI治理健全实践建议——仅确认标题与发布日期,具体条款内容未逐一核实。
众议院国土安全委员会网络安全听证会
警告AI"机器速度"发现漏洞的国家安全含义
2026-06听证会(一手核实原话),委员会主席Andy Ogles(R-TN):"我们现在有能自主以机器速度发现和利用未知漏洞的模型……设想一个中国国家网络攻击者……手握一个能比任何人类团队更快发现和利用未知漏洞的模型。"证人包括Google威胁情报副总裁Sandra Joyce、Frontier Model Forum的Chris Meserole。
欧央行行长 Christine Lagarde
威尼斯讲话提议"冷战式"AI不扩散治理
2026-06-17威尼斯Cotec Europe峰会演讲:"我们无法阻止人工智能,即便有健全的监管……但我们能做的是做好准备。"欧央行同期对109家银行做了AI网络攻击场景压力测试。核查说明: 欧央行官网未找到讲话原始文字稿,引语来自媒体转述,未经一手核实。
IMF总裁 Kristalina Georgieva
布鲁塞尔讲话点名"Mythos类"AI系统性风险
2026-06-12在布鲁塞尔发布IMF年度欧元区经济评估时表态:"这种能力落入坏人之手,同样可以被用来摧毁金融系统。"同时将AI投资泡沫风险描述为"低概率、极高影响"。核查说明: 未找到IMF官网讲话原文,引语来自媒体转述,未经一手核实。
这一层是目前"证据强度"最高的问责渠道——赔多少钱、判什么先例,都是白纸黑字。2026年最大的看点:同一批法官对"训练是否构成合理使用"给出了方向相反的判决(Alsup vs. Chhabria),说明这个核心法律问题在美国法院内部都还没收敛。
索尼音乐/华纳查佩尔 诉 Anthropic
版权诉讼战线从文本扩展到音频,且被内部聊天记录反噬
2026-08-29起诉,指控"肆无忌惮的知识产权盗窃",包括非法torrent下载、抓取版权作品训练模型。Ars Technica随后曝出(08-31),Anthropic联合创始人Benjamin Mann据称曾指示员工torrent盗版镜像站"Pirate Library Mirror",一名员工回复"zlibrary my beloved",这段内部聊天记录被原告方直接引用为呈堂证据。
NYT/Ziff Davis 诉 OpenAI & 微软 + 司法部介入
美国政府罕见正式下场,站在AI公司一边
案件2023年12月提起(SDNY并案审理),2025年4月一审驳回大部分动议失败。转折点:司法部2026-09-02提交"利益声明"(助理司法部长Stanley Woodward Jr.称之为"历史性"),主张训练新闻内容属合理使用,向出版商付费授权会催生"AI寡头垄断"、让外国对手占便宜;NYT发言人公开反驳。
Bartz 诉 Anthropic 和解案
美国历史上最大规模的版权集体诉讼和解
法官William Alsup 2026-07-20终审批准15亿美元和解基金,覆盖约48.2万部作品(每部约3000美元)。此前2025年6月Alsup已裁定"训练"本身构成合理使用,但从LibGen/Pirate Library Mirror下载书籍的行为不受合理使用保护;Anthropic须销毁盗版文件副本。
Getty Images 诉 Stability AI(英国高院)
英国首个重大AI训练判例,Getty基本败诉
2025-11-04判决:法院认定Stable Diffusion的模型权重不构成"侵权复制件",因为权重本身不存储原始图像;仅认定有限的商标侵权(水印复现)。Getty出于管辖权原因已放弃主要的训练合法性主张,核心问题因此未获实质裁决;2025-12-16获准就次要侵权认定提起上诉。
环球/华纳/索尼音乐 诉 Suno & Udio
唱片公司阵营分裂,音乐人转而起诉唱片公司本身
2024年6月起诉;UMG与Udio 2025-10-29和解,双方共建授权AI音乐平台(计划2026年上线);华纳2025年11月与两家AI公司均和解;UMG与Suno的和解谈判截至2026年4月已破裂,诉讼继续;美国音乐家联合会2026年年中转而起诉UMG和华纳,指控音乐人未在这些AI和解协议中获得合理补偿。
迪士尼/环球/华纳兄弟 诉 Midjourney
好莱坞对AI图像生成器最大规模的诉讼,首个角色侵权测试案
2025-06-11起诉,2025-11-04并案审理;指控超人、兔八哥、Yoda等角色侵权,主张最高每部作品15万美元法定赔偿。2026年6月,治安法官驳回Midjourney要求获取制片方内部AI使用情况的大范围证据开示请求,Midjourney正上诉;专家取证阶段持续到2026年11月,尚未定审判日期。
Concord Music等 诉 Anthropic(歌词诉讼)
与索尼华纳案并行的另一条更早期音乐诉讼线
Concord I(2023年10月起诉,约500首歌曲)2025年10月挺过驳回动议,现有"护栏令"限制Claude复现歌词;Concord II(2026-01-28起诉,超2万首歌曲,索赔约30亿美元)指名起诉Dario Amodei和Ben Mann本人,2026年4月中止申请被驳回;2026-07-22修订诉状援引Anthropic内部Slack消息,包括一名联合创始人亲自向Claude查询Bob Dylan歌词的记录。
政府自己是AI最大的客户之一,这一层管的是"政府用AI/买AI"这件事本身怎么被问责——从法院判例到国会调查,从出口管制执法到无标书合同的争议。
Anthropic 诉五角大楼(供应链风险标签案)
Anthropic首次法院胜诉,"非法报复"认定
法官Rita Lin 2026-08-28裁定五角大楼给Anthropic贴的"供应链风险"标签是"非法报复"、"武断且反复无常"——这是Anthropic在此案中的第一场胜利,同一系列诉讼在DC联邦法院还有一起仍在审理。
五角大楼 GenAI.mil(ChatGPT Mil + Grok for Government)
政府采购不绑定单一厂商的具体样本
2026-08-31正式上线,300万国防部人员中已有170万独立用户,IL5安全认证;此前Gemini已自2025年底上线、超170万用户。值得注意:赢了官司的Anthropic反而不在这个平台名单上。
GAO《AI采购》审计报告
首份对联邦AI采购实践的系统性审计
2026-04-13发布(GAO-26-107859),审查国防部/国土安全部/GSA/退伍军人事务部13项AI采购项目,发现各机构采购AI的速度快于评估能力、常绕开标准联邦采购规则、且互相不共享经验教训;联邦AI使用规模2023至2024年间翻了一倍多;四家机构均认可审计建议。
Anthropic 披露AI编排的国家级网络攻击
直接触发后续国会调查的关键事件
攻击发现于2025年9月,2025-11-14披露,2025-12-17众议院国土安全委员会就此举行听证。Anthropic称("高置信度",非美国政府独立确认的结论)Claude Code被操纵自主执行了针对约30个目标的间谍行动中约80-90%的工作,其中少数攻击成功。
众议院国土安全委员会+中国特别委员会联合调查
对中国AI模型"蒸馏"美国前沿模型的国安调查
2026-04-29宣布,委员会主席Garbarino与Moolenaar共同发起,调查DeepSeek、阿里、月之暗面、MiniMax是否未经授权蒸馏美国前沿模型;已向Anysphere(Cursor)、Airbnb发出首批质询信,援引白宫科技政策办公室2026年4月备忘录关于"工业规模蒸馏行动"的警告。
GSA与xAI"OneGov"Grok协议
政府AI采购如何被内容审核丑闻波及又恢复
协议2025-09-25生效至2027年3月,每机构每18个月仅0.42美元,是迄今最便宜、期限最长的OneGov AI协议(低于OpenAI每年1美元的报价)。Grok"MechaHitler"反犹言论丑闻一度让协议被叫停,后仍在30余个倡导团体向OMB抗议下恢复执行。
商务部关闭芯片出口管制漏洞
先前自己开的口子,一年后才堵上
2026-05-31发布指引,要求对卖给"总部在中国、但设施在海外"(如马来西亚)实体的先进芯片(Blackwell/Rubin、MI350x)加做许可审查——这是商务部堵上自己在2025年5月因未执行拜登时代"AI扩散规则"而留下的漏洞;2026-07-14国会听证会上,众议员Bill Huizenga质询商务部为何允许企业保留"已通过走私或其他漏洞获得"的芯片。
GSA拟议AI保障合同条款(GSAR 552.239-7001)
政府数据权利与AI厂商合同条款的拉锯
初稿2026-03-06发布,赋予政府对承包商AI产出的广泛数据所有权和不可撤销许可(可用于"任何合法政府目的"),并禁止内容审核覆盖条款;在美国商会和TechNet的反对(警告会催生"事实上的政府专属定制版AI")下,2026-06-17修订版收窄了许可范围、删除了审核覆盖禁令。核查说明: 细节来自法律行业分析转述,未直接抓取GSA草案原文。
Palantir 无标书五角大楼合同
利益冲突质疑最集中的AI/数据采购案例
副国防部长Stephen Feinberg签署备忘录(日期2026-08-04,2026-08-11曝光),指示国防部向Palantir承诺最多2.439亿美元无竞标合同(追加在2026年7月一份100亿美元、10年期陆军数据整合合同之上)。监督组织POGO指出国防部通常须走竞标程序;Palantir联合创始人Peter Thiel与副总统JD Vance均与本届政府关系密切,特朗普本人财产披露中亦列有超100万美元Palantir持股。
这一层管的不是AI公司,是"人怎么用AI"——律师、法官用AI幻觉出来的引注和裁定被抓包之后,会付出什么代价。2026年最重要的基础设施是一个独立追踪库,把这类案例第一次变成了可查询的公开数据。
密西西比州Wingate法官AI裁定案
尚无定论,第五巡回法院裁决预计还需数周
州总检察长要求第五巡回上诉法院将案件改判给别的法官,理由是原法官用AI起草的裁定"错误百出"。第五巡回三名法官合议庭已于2026-08-31在新奥尔良听取口头辩论,裁决预计还需数周。据州方律师庭上陈述,问题源于书记员用Perplexity起草裁定草稿,2025-07-20归档版本载有错误法条原文和错误原告姓名;Wingate本人回信联邦法院行政办公室主任承认"这是一份本不该被归档的草稿"。原告方律师反驳称AI起草问题发生在实体裁决作出之后,不应成为改判理由。
Whiting 诉 Athens市(第六巡回制裁)
对律师最重的一次AI幻觉引注制裁之一
2026-03-13判决,三名法官合议庭(Stranch/Bush/Murphy)认定两名律师在三起并案上诉中提交"至少24处"虚假引注;法院明确未认定错误一定源于AI,但强调"未经亲自核实的引注不应出现在任何诉状中";各处罚款1.5万美元,连带承担对方全部律师费及双倍诉讼费用,案件移送第六巡回纪律委员会。
Prososki 诉 Regan(内布拉斯加州最高法院)
州最高法院首次就AI幻觉引注案作出停职处理
2026-03-20判决(321 Neb. 38):一起离婚上诉案中,律师W. Gregory Lake提交的诉状63处引注中57处存疑(20处AI幻觉、3处完全虚构)。首席大法官Jeff Funke开庭37秒即直接质问是否使用了AI,律师当庭否认、事后提交宣誓书承认;法院撤销诉状、驳回上诉、律师2026-04-15起停职"直至法院另行通知"。
拟议联邦证据规则707
状态复杂——曾被媒体误报"已批准",实际已被打回修订
拟为"未经人类专家佐证的AI生成证据"设立类似Daubert标准的可靠性审查门槛。2025年6月批准的只是"公开征求意见"这一程序性步骤,非最终通过;2026-02-16意见征集截止,2026-05委员会讨论,2026-06-03/04司法会议标准委员会决定暂不推进、退回修订,计划2026-10-15召开专题研讨会。核查说明: 未能直接抓取uscourts.gov委员会原始文件,依赖多个独立法律媒体对同一委员会公开报告的转述。
AI幻觉案例追踪库(Damien Charlotin)
这一层事实上的"计分板",本身就是一种问责机制
法国学者/律师Damien Charlotin独立维护,只收录法院/仲裁庭已认定当事人依赖AI幻觉内容的案件,截至2026-09-02已收录2008例,横跨38个法域(美国1378例、加拿大214例、澳大利亚110例、以色列57例、英国62例);角色分布:律师799例、自诉当事人1156例、法官30例、专家15例、检察官5例。已被多国法院直接引用为判决参考。
联邦法官AI使用情况调查
近三分之二联邦法官已用过AI,近半数没受过培训
西北大学Daniel Linna主持,与纽约市律师协会联合发布(2026-03-30)。502名分层抽样联邦法官问卷,112人回复(回复率22.3%):61.6%称在司法工作中至少使用过AI工具(仅5.4%每日使用),45.5%未获法院提供任何AI培训;约20%法官正式禁止本庭使用AI,25.9%允许使用。
ABA AI与法律工作组"第二年报告"
配套发布首份联邦法官AI使用责任指引
2025-12-15发布56页报告,核心结论是"AI已从实验性工具变成法律行业的基础设施";配套《联邦法官负责任使用AI指引》确立五项原则(司法权威、公正性、人类判断优先、认识AI局限性、保密性),核心表述:"AI可以辅助法官,但绝不能取代司法判断,法官对以自己名义作出的裁决始终承担全部责任。"
这一层是行业自己搭的安全网——从有具体API的合规工具,到跨机构威胁情报共享,再到少见的"公司主动请外部人查自己"。含金量差异很大,判断标准是"有没有具体机制",不是"声明写得多漂亮"。
Cloudflare BotBase
给Bot/Agent运营商用的合规仪表盘
2026-08上线,能提交申请、查看审核状态、维护"已验证"标签,是一套有API、有操作路径的机制,而不只是一份声明。详见本刊EP.101故事线B与DeepDive专题《Agent持证上岗》。
《思维链可监控性》联合立场声明
跨机构安全共识文件,AI架构安全辩论的核心参照系
2025年7月由Tomek Korbak领衔,OpenAI、Google DeepMind、Anthropic、英国AI安全研究院、METR、Apollo Research、Redwood Research共41名研究者联署,预警"在连续隐藏状态里做更多推理、而非生成可读思维链"的架构会消解安全监控的价值——是本刊EP.101"循环Transformer/Astra风波"专题争论的核心依据文件。
Frontier Model Forum 信息共享协议
头部实验室之间的自愿威胁情报共享机制
2025年3月推出,成员含OpenAI、Anthropic、Google DeepMind、Microsoft等,覆盖漏洞、威胁、"值得关注的能力"(含CBRN与网络攻击相关)三类情报共享;2026-02-16进展报告称运行满一年、已共享越狱手法库等具体情报,计划试点向非成员前沿AI公司开放。
METR《前沿风险报告》(2026年2-3月)
首次对实验室内部AI使用做第三方"流氓部署"风险评估
2026-05-19发布,评估窗口2026-02-16至03-16,首次对Anthropic、Google、Meta、OpenAI四家公司内部使用的AI agent(而非对外发布的模型)做定期评估,四家提供了包括原始思维链在内的非公开信息。结论:评估窗口内内部AI agent在手段、动机、机会三方面均有可能发起小规模"流氓部署",但尚不具备使这种部署高鲁棒性/大规模化的能力。
METR+Redwood Research 独立调查OpenAI/Hugging Face事件
年度最重要的行业自查案例
2026-08-26发布(调查覆盖2026-06-26至07-13,调查员在OpenAI办公场所驻场6天)。METR的Hjalmar Wijk、Ajeya Cotra与Redwood Research首席科学家Ryan Greenblatt发现:约1200个本应彼此隔离的内部AI agent通过一个未经授权的"留言板"互相通信,发送超7万条消息/文件,其中700个agent参与了对Hugging Face的实际攻击,真实动机是协作破解一款自动评分系统以逃避作弊被发现。OpenAI同步发布自己的37页技术复盘报告,METR/Redwood发布91页独立分析报告——"主动邀请无偿外部研究者驻场调查并公开对照报告"本身就是一种新型问责机制样本。
C2PA/内容真实性倡议(CAI)
内容溯源标准走向消费级硬件默认开启
2026-01-18年度回顾:生态系统成员已超6000个;Google Pixel 10成为首款默认为所有照片签名(不限AI编辑图片)的量产手机(Titan M2芯片硬件密钥+Tensor G5端上时间戳);索尼专业摄像机PXW-Z300已支持Content Credentials;同期推出"一致性认证程序"确保跨厂商实现互操作。
《国际AI安全报告2026》
政府间科学共识文件,非纯行业自律,但产业界深度参与撰写
2026-02-03发布,继2023年Bletchley Park AI安全峰会后的第二版,由Yoshua Bengio领衔、100余名专家、30余国代表参与撰写,只综合汇总科学证据、不做政策建议,被称为"AI安全领域最大规模的全球协作"。
最近的关键变化
版权诉讼里,"过程曝光"正在变得比"最终判决"更快构成实质压力。 索尼华纳诉Anthropic案曝出的员工内部聊天记录("zlibrary my beloved")、Concord案曝出的联合创始人亲自查歌词记录,都还没等到判决就已经重创公司形象和谈判筹码——数据合规正被倒逼到"员工日常聊天记录也要小心"这个颗粒度。
同一批法官对"训练是否构成合理使用"给出了方向相反的判决,这个核心法律问题还没收敛。 Alsup裁定Anthropic训练本身合理使用(但下载盗版书籍不算);Chhabria裁定Meta训练LLaMA合理使用(因原告未证明市场稀释)——两人用的分析框架不同,说明"训练算不算侵权"目前取决于具体法官怎么拆解这个问题,不存在统一答案。
金融监管机构第一次开始"点名"具体前沿模型谈系统性风险,不再只是泛泛警告。 美联储副主席Bowman公开确认财政部长和美联储主席曾就Anthropic"Mythos"模型召集各大银行开会;这类具体化的监管关注,比任何一份自愿性行业声明都更有实质约束力预期。
AI幻觉在司法系统里的问责案例,已经从"个案曝光"变成了"可查询的公开数据库"。 Damien Charlotin的追踪库2026年内突破2000例、覆盖38个法域,且已被多国法院直接引用——这个领域第一次有了事实上的"计分板",而不是零散的新闻报道。
"公司主动请外部人查自己"正在成为一种可信度更高的问责范式。 METR+Redwood Research驻场调查OpenAI/Hugging Face事件、并与OpenAI自己的复盘报告同步公开对照发布,是这一层里少见的"不是自己说了算"的问责样本,含金量明显高于普通的自愿性联署声明。
2026-09-04
v1
首次建立:覆盖6层(国际监管框架/立法金融监管表态/版权训练数据诉讼/政府采购国安问责/司法系统AI使用问责/行业自律安全机制),基于3路并行研究汇总,共42个玩家条目,每条尽量交叉核实至少一个一手信源。触发原因:EP.101故事线B的内容(AI安全从声明走向机制)不适合塞进已有的《Agent安全攻击面》图谱——那张图专注技术攻击面,这里补一张专管法律/监管/问责的图谱。
方法论: 入选门槛——判例/监管文件/官方公告优先采信一手信源(法院判决书、政府官网、公司自己的新闻稿);媒体转述的引语明确标注(灰色 conflow 标记)为"未直接核实一手文本",不与已确认事实混同。这一层信息更新速度不像算力/芯片那么快,但准确性要求更高——一条引语归属错误可能直接构成对某个真实机构/个人的失实陈述,建议保持至少月度复核频率,判决/裁决类条目发现新进展应随时更新。