Claude Sonnet 5 今天发布,算是预料之中。没想到的是 Mistral——这家欧洲的「开源 AI 旗手」为 Agent 调用 API 这个基础动作申请了专利。同一天,Tl;dv 被曝 18 万场会议录音裸奔,Meta 的 30B 开源模型在 HN 刷了 920 分。
🚀 模型与科研
• Claude Sonnet 5 发布:定位「最具 Agent 能力的 Sonnet」 —— Anthropic 正式推出 Sonnet 5,在编码和日常专业工作中提供顶级智能。紧随 Opus 5/Fable 5,Claude 家族的产品线正快速填满每个价格带。
• Meta 发布 Muse Glimmer:30B 参数、单张 RTX 3090,常驻本地 Agent 模型 —— 针对始终在线的本地 Agent 工作流优化,发布即 HN 920 分登顶,Reddit r/LocalLLaMA 被刷屏。将 30B Agent 能力压进消费级显卡,Meta 在开源 Agent 方向上甩出一张硬牌。
• Claude 未发布研究版将黎曼零点下界从 41.6% 推至 67.2% —— 160 年未解的开放问题,被 AI 推了四分之一。不同于 AlphaProof 做奥数题,这是对前沿数学边界的直接冲击。
🛡️ 安全与基础设施
• Tl;dv 逾 18 万段 AI 会议录音被公开暴露,可实时闯入他人会议 —— 安全研究员发现 AI 会议记录工具存在严重漏洞,18 万场会议的录音和文字记录裸奔在公网上。HN 467 分。被联系四天后才修复——AI 工具的便利性开着门,安全性还没学会锁门。
• OpenAI 推出 GPT-5.6-Cyber 和 Daybreak 平台:受治理的网络安全模型 —— 面向授权漏洞研究的专用模型,通过 Daybreak Red 向合作伙伴提供。紧随过去一周三起 AI Agent 安全测试失控事件,OpenAI 用「受治理的安全模型」回应「失控的 Agent」。
• Docker 推出 Docker Sandboxes:AI Agent 专用可丢弃沙箱 —— 专为 AI Agent 设计的隔离执行环境,HN 584 分。Agent 安全边界正从模型层的「别让它越狱」延伸到基础设施层的「给它一间跑完就拆的屋子」。
⚖️ 策略与生态
• Mistral 申请「代码实现的工具调用」专利 —— LLM 通过生成代码调用外部工具,这个几乎所有 Agent 的基础动作被写进了专利申请。HN 179 分 148 评论,社区普遍担忧此举阻碍 Agent 生态。同一天 Zuckerberg 在 FT 采访中高调攻击「封闭 AI」——开源阵营内部开始出现裂痕。
• GitHub Models 正式退役 —— 曾被视为 GitHub 原生 LLM 游乐场+API 平台,存活不到两年即关闭。Simon Willison 发现时已进入最终 shutdown。微软/OpenAI 阵营在收缩平台策略,Meta 却在用开源模型攻城略地。
• Claude Code v2.1.224 支持自托管 Runner,OpenRouter 推出市场驱动 Auto 路由器 —— Claude Code 允许用户注册自己的机器为 runner,代码执行不经过 Anthropic 服务器。OpenRouter 新版 Auto 路由器用路由历史数据决定模型选择。Agent 基础设施正从「能跑」走向「跑在哪、跑多贵、谁来管」。
📚 延伸阅读
• BobDaHacker:Tl;dv 逾 18 万场会议录音被公开暴露的完整技术分析 https://bobdahacker.com/blog/tldv-hack
• Anthropic:Claude Sonnet 5 官方发布公告 https://www.anthropic.com/news/claude-sonnet-5
• Anthropic 研究论文:黎曼 zeta 函数零点下界突破 67.2% https://www.anthropic.com/research/riemann-zeta
