同一天,两家把「安全」当招牌的头部实验室一起露了底:OpenAI 解散了专门评估灾难性风险的 Preparedness 团队,Anthropic 承认防生化武器的过滤器失效近一年,期间 1.33 亿次请求没被过滤。
🚨 安全与信任
• OpenAI 解散 Preparedness 团队 —— 专门评估模型是否可能酿成灾难性风险的团队被拆散,工作并入其他组,多名安全人员已离职。商业速度第一次把「防灾难」这件事拆了。
• Anthropic 生化武器过滤器失效近一年 —— 安全报告自曝:过滤系统坏了近一年,约 5 万名反馈承包商做了约 1.33 亿次未过滤交互。「最安全的实验室」也没能管住自己的安全基础设施。
• Dario Amodei:AI 逆反本质是信任危机 —— 面对「他把 AI 讲得太悲观」的指责,Amodei 反驳:公众早就不信公司、政府和科技业,AI 只是最新一版,靠正面营销救不了。
🚀 商业与平台
• Stripe 拟以 7B+ 美元收购 OpenRouter —— 支付巨头要买下那家自称「AI 界的 Stripe」的模型聚合网关。支付基础设施开始直接吃下模型分发层,分发和工具层正被大资本快速收编。
• Google 允许移除 AI 可见水印 —— 用户现在能在 Gemini 和 Flow 里关掉生成内容的可见水印(不可见溯源仍在),与 Anthropic 给所有文本加水印正好相反:一个在防 slop,一个在保体验。
🧠 能力边界与产品
• AI 不是比数学家更会思考,是更会「记住」 —— HN 571 分高帖:AI 在数学上的「强」本质是海量记忆覆盖了见过的题型,而非创造性推理。顶级数学家跟进:它们是强计算器,不是好思考者。
• ChatGPT Computer History 追踪你的点击与按键 —— macOS 桌面端把操作变成训练数据,学习你的工作方式、建议自动化、甚至接手做一半的任务。便利与隐私的边界,又往后挪了一寸。
📚 延伸阅读
• The Decoder:OpenAI 解散灾难风险团队报道 https://the-decoder.com/openai-dissolved-the-team-built-to-catch-catastrophic-ai-risks-reassigning-its-work-to-other-groups/
• TechCrunch:Stripe 收购 OpenRouter 报道 https://techcrunch.com/2026/08/16/stripe-will-reportedly-acquire-ai-gateway-startup-openrouter-for-7b/
• Davide Piffer:AI isn’t outthinking mathematicians https://davidepiffer.com/p/ai-isnt-outthinking-mathematicians
