正在刊行早报 · Morning Brief
2026-09-02所有内容
随机比特 · Random Bits

OpenAI 首次把模型评为 Critical:越会找漏洞,越不能公开

2026-09-02AI Engineering / Systemsrbits.uk
OpenAI 首次把模型评为 Critical:越会找漏洞,越不能公开

OpenAI 首次把 Astra 列入 Critical 网络安全能力:它能以较少人工干预发现未知漏洞、构建利用链,因此能力越强,发布反而越受限。模型竞争开始从“谁更强”转向“谁有资格使用”。

🚀 模型能力与发布边界

OpenAI 限制发布 Astra —— Astra 是 OpenAI 首个触及 Critical 网络安全能力阈值的模型。前沿模型的发布策略不再只看跑分,还要判断一项能力公开后能否被安全控制。

Claude Fable 5.1 与 Mythos 5.1 发布 —— 新模型已同步进入 Claude Code,迅速影响真实开发工作流。版本升级是否值得切换,仍要用代码质量、延迟和成本实测,而不是只看发布说明。

Runway Solaris 直接生成软件界面 —— 模型像生成视频一样逐帧生成交互画面,不再先编写并运行传统 UI 代码。演示很新鲜,但可测试性、无障碍支持和结果稳定性会成为真正的工程门槛。

🛠️ Agent 工具与软件生产

Codex 文档能力背后是 1.7GB 运行时 —— 本地组件包含 Python、Node.js、Git、Poppler 和完整 LibreOffice。Agent 所谓“会编辑 Office 文档”,本质上是打包了一套可执行工具链,体积、安全更新和供应链都要计入成本。

顶级开源项目开始说“PRs NOT Welcome” —— Vercel AI SDK、Astro、tldraw 等项目正在收紧随手式外部贡献。AI 降低了写代码的成本,却把低质量提交和审查负担集中到了维护者身上。

OpenMAIC 把多智能体组织成课堂 —— 项目当日新增 3122 stars,用老师、同学、讨论和反馈构成互动学习环境。发布日期尚不明确,当前信号更多说明多 Agent 教育产品正在快速获得关注,而非一次刚发生的发布。

🚨 平台规则与内容治理

Claude 将为生成文本加入水印 —— Anthropic 把文本识别从研究议题推进到产品与欧盟合规层。水印能增加透明度,却无法绕开误判、规避和职场写作边界这些现实问题。

Google Play 切断 AnkiDroid 捐赠入口 —— 商店规则不再允许应用内放置 Open Collective 链接。一个开源项目能否获得捐赠,开始取决于平台是否允许用户看见那个按钮。

📚 延伸阅读

• OpenAI:Path to Astra
https://openai.com/index/path-to-astra

• Simon Willison:Codex Desktop Includes LibreOffice
https://simonwillison.net/2026/Sep/1/codex-libreoffice/

• Latent Space:PRs NOT Welcome
https://www.latent.space/p/pr-not-welcome

随机比特公众号二维码
公众号 · 随机比特
从 AI 工具热闹里拆工程真相

写边界、控制面、上下文、成本与安全。