正在刊行早报 · Morning Brief
2026-08-17所有内容
随机比特 · Random Bits

Anthropic 防生化武器的过滤器坏了快一年,1.33 亿次请求在裸奔

2026-08-17AI Engineering / Systemsrbits.uk
Anthropic 防生化武器的过滤器坏了快一年,1.33 亿次请求在裸奔

同一天,两家把「安全」当招牌的头部实验室一起露了底:OpenAI 解散了专门评估灾难性风险的 Preparedness 团队,Anthropic 承认防生化武器的过滤器失效近一年,期间 1.33 亿次请求没被过滤。

🚨 安全与信任

OpenAI 解散 Preparedness 团队 —— 专门评估模型是否可能酿成灾难性风险的团队被拆散,工作并入其他组,多名安全人员已离职。商业速度第一次把「防灾难」这件事拆了。

Anthropic 生化武器过滤器失效近一年 —— 安全报告自曝:过滤系统坏了近一年,约 5 万名反馈承包商做了约 1.33 亿次未过滤交互。「最安全的实验室」也没能管住自己的安全基础设施。

Dario Amodei:AI 逆反本质是信任危机 —— 面对「他把 AI 讲得太悲观」的指责,Amodei 反驳:公众早就不信公司、政府和科技业,AI 只是最新一版,靠正面营销救不了。

🚀 商业与平台

Stripe 拟以 7B+ 美元收购 OpenRouter —— 支付巨头要买下那家自称「AI 界的 Stripe」的模型聚合网关。支付基础设施开始直接吃下模型分发层,分发和工具层正被大资本快速收编。

Google 允许移除 AI 可见水印 —— 用户现在能在 Gemini 和 Flow 里关掉生成内容的可见水印(不可见溯源仍在),与 Anthropic 给所有文本加水印正好相反:一个在防 slop,一个在保体验。

🧠 能力边界与产品

AI 不是比数学家更会思考,是更会「记住」 —— HN 571 分高帖:AI 在数学上的「强」本质是海量记忆覆盖了见过的题型,而非创造性推理。顶级数学家跟进:它们是强计算器,不是好思考者。

ChatGPT Computer History 追踪你的点击与按键 —— macOS 桌面端把操作变成训练数据,学习你的工作方式、建议自动化、甚至接手做一半的任务。便利与隐私的边界,又往后挪了一寸。

📚 延伸阅读

• The Decoder:OpenAI 解散灾难风险团队报道 https://the-decoder.com/openai-dissolved-the-team-built-to-catch-catastrophic-ai-risks-reassigning-its-work-to-other-groups/

• TechCrunch:Stripe 收购 OpenRouter 报道 https://techcrunch.com/2026/08/16/stripe-will-reportedly-acquire-ai-gateway-startup-openrouter-for-7b/

• Davide Piffer:AI isn’t outthinking mathematicians https://davidepiffer.com/p/ai-isnt-outthinking-mathematicians

随机比特公众号二维码
公众号 · 随机比特
从 AI 工具热闹里拆工程真相

写边界、控制面、上下文、成本与安全。