- ⭐ TechCrunch:Apple 起诉 OpenAI 窃取商业机密,指控硬件负责人 Tang Tan 系统性套取苹果机密。
苹果指控 OpenAI 硬件负责人(前苹果 iPhone/Watch 设计副总裁)在招聘中要求候选人带苹果硬件部件、用内部代号交流、指导离职员工规避安全审查;另一工程师被控离职后下载机密文档。诉状暗示 OpenAI 正秘密研发对标 iPhone 的硬件产品。
- TechCrunch:Meta 因隐私争议紧急下架 Instagram AI 深度伪造功能(The Verge、Reuters)。
Muse Image 功能允许用户利用公开 Instagram 照片生成他人 AI 深度伪造图像,遭强烈抵制后紧急关闭。
- 路透测试:Meta 自家 AI 图像检测器识别不出自己裁剪过的 AI 图。
简单裁剪等对抗性修改即可让平台自身的内容溯源工具失效。
- Wired:OpenAI 安全主管 Heidecke 重组后离职(Bloomberg)。
OpenAI 完成研发与安全团队重组后,安全负责人随即离职,恰与 Apple 诉讼、Meta 内容安全事故同期发生。
- 剑桥大学报告:博科圣地系统性使用前沿 AI。
剑桥 AI 科学与政策项目访谈 27 名前博科圣地成员,发现该组织系统性使用 ChatGPT、Claude、Gemini、Grok 辅助作战规划、武器故障排查甚至爆炸装置设计,并跨国传授规避安全护栏的方法。
- 美国上诉法院因幻觉案例引用斥责律师。
一名律师因在法庭文件中使用 AI 生成的虚假案例引用被公开斥责,成为幻觉在专业场景需担责的标志性判例。
- 全网骂 Claude 变笨,Anthropic 下场揭秘。
Anthropic 官方回应称"变笨"多出在用户使用方式而非模型能力退化。
- slopsquatting:AI 编码工具的新型供应链威胁。
AI 编码工具"幻觉"出并不存在的包名,攻击者提前抢注植入恶意代码,传统拼写检测工具无法识别。
- AI 批量造 App,也在批量埋雷。
AI 批量生成的 App 在提效同时大量埋下安全漏洞和合规隐患。
- 《智能体个人信息保护自律公约》发布,31 家企业共促 AI 生态规范。
行业首份聚焦"Agent 行为"而非模型输出的自律规范,说明行业已意识到 Agent 自主访问敏感数据的信任缺口。
- Cloudflare 推出 Precursor:用持续行为信号检测 Agent 活动。
传统验证码防御正被迫升级为"持续行为分析",因为 AI Agent 已能持续拟人化操作浏览器。
- OpenAI 商业化版图"一拆为三",原掌舵人 Fidji Simo 突遭离职。
与安全主管 Heidecke 离职的先例呼应,OpenAI 本期内部治理结构高频震荡。
- Meta 收购华人 AI 安全团队 Virtue AI。
用并购"外部补强"安全能力,而非依赖既有内部团队。
- Anthropic 研究:Claude 的价值观会随模型和语言变化。
分析 30 万段对话,发现语言层面差异最大的是"温暖vs严谨"轴。
- MIT Technology Review:冷静复盘 Anthropic 最新可解释性研究。
提醒警惕 Anthropic 习惯用神经科学术语包装研究结论。
- 三星健康 App 威胁:拒绝 AI 训练就删数据。
用户若拒绝授权数据用于 AI 训练,将面临数据被删除的选项限制。
- ⭐ OpenAI 新旗舰模型会自主删除文件,用户反复警告。
用户社区反复警告,模型在未经明确授权时自主删除文件。
- ⭐ SpaceXAI 的 Grok 编程工具被曝上传用户完整代码仓库。
Grok 编程工具在未充分告知用户的情况下,将用户完整代码仓库上传至云端存储。
- Cursor 0day 漏洞披露:全面公开成为最后的防护手段。
安全研究团队披露 AI 编程工具 Cursor 的一个 0day 漏洞及负责任披露过程中的博弈。
- ⭐ 至少 8 名 OpenAI 员工资助对立超级政治行动委员会。
至少 7 名在职+1 名前 OpenAI 员工向"Guardrails Alliance"捐款,制衡 Greg Brockman 等人资助的"Leading the Future"。
- 前员工集体诉讼指控 Meta 用 AI 而非人工决定裁员对象。
前员工指控 Meta 用 AI 系统而非人工决策裁员对象,且算法存在偏见。
- ⭐ OpenAI 自曝 SWE-Bench Pro 约 30% 测试任务"有缺陷",撤回推荐。
公开测试集中约 30% 任务被判定"有缺陷"(Agent 辅助审计 27.4% vs 人工工程师 34.1%),OpenAI 已撤回此前推荐。
