OpenAI、Anthropic、DeepMind、Meta 的成员联名签署了一封信:放慢 AI 研发节奏。同一天,有人发现一封 Word 文档里藏着的提示词,会在 Copilot 编辑时自动复制进下一份文件——AI 蠕虫,已经会自己走路了。
🚨 安全与减速
• 多家前沿 AI 实验室成员联名呼吁放慢研发节奏 —— OpenAI、Anthropic、Google DeepMind、Meta、Thinky 等机构的成员共同签署信件,要求调控 AI 研发速度。Latent Space 同日通讯以「The Big Pause is coming」定调,HF 同步公布了全自主 agent 入侵的技术细节。不是外部监管在施压——是造最快模型的人自己先踩了刹车。
• Word 文档提示注入蠕虫:AI 编辑结果会自我传播 —— 研究者将隐藏指令嵌入 Word 文档,Copilot 在编辑时将其当作用户意图,生成结果自动携带同一段恶意提示——新文档变成下一轮载体。从「注入一个 prompt」到「注入会自己复制」,AI 安全威胁从单点攻击进化到链式传播。
• 论文:长篇策略文档不能可靠约束 Agent —— Handbook.md / AGENTS.md 这类规则文件越写越长的团队该警觉了:arXiv 新论文的结论是,更长的政策文本并不能可靠治理 agent 行为。你花在写规则上的时间,可能还不如给 agent 加一层沙箱。
🛠️ 工程与优化
• Turbo Fieldfare:2GB 内存的 M 系 Mac 跑 Gemma 4 26B —— 开源推理引擎声称可在任意 Apple Silicon Mac 上用 2GB 内存运行 Gemma 4 26B,HN 531 分。一个 26B 参数模型塞进一台入门 MacBook 的内存预算——端侧大模型的「能不能跑」正在变成「多快能跑」。
• LangChain Deep Agents v0.7:基础输入 token 暴砍 65% —— 新版简化了底层 agent harness,在性能可比的情况下将每轮携带的脚手架信息压缩了 65%。token 浪费的最大头不是任务本身,而是每轮都重复发送的系统提示——LangChain 第一个动刀了。
• Simon Willison 实测 MCP 跨 Claude / ChatGPT 接入 —— 他记录了将同一自定义 MCP Server 接入两款产品的完整步骤,结论是「流程仍然需要多个配置环节」。MCP 从「有没有」进入了「好不好配」的阶段——跨平台体验的摩擦才是下一个瓶颈。
• book-to-skill:技术书 PDF 一键转 Claude Code Skill —— Python 工具将技术书 PDF 转化为 Claude Code 可调用的技能文件,GitHub 单日新增 1,428 星。Skills 生态从「手写 yaml」到「自动从书里长出来」——知识工程的门槛又降了一级。
🔬 前沿与方法
• OpenAI 详解 GPT-5.6 效率设计 —— 官方文章从模型架构、推理优化和 Agent 工作流三个层面拆解 GPT-5.6 的效率提升路径,核心叙事是提高「每美元有效智能」。模型军备的 KPI 正在从榜单跑分转向单位成本产出——谁能让一美元干更多活,谁才算赢。
• 形式化方法会不会被 AI 带进主流? —— The Pragmatic Engineer 与 Hillel Wayne 84 分钟对谈:当 coding agent 大量产码时,验证系统行为的工具(TLA+ 等)反而变得更紧迫。AI 写得越多,证明写得对的工具越值钱。
📚 延伸阅读
• Enklypesalt:AI Worming Through Word — 文档提示注入蠕虫完整攻击链 https://enklypesalt.com/posts/context-collapse-part3-ai-worming-through-word/
• LangChain:Deep Agents v0.7 发布公告 https://www.langchain.com/blog/deep-agents-v0-7
• The Pragmatic Engineer:Formal Methods with Hillel Wayne https://newsletter.pragmaticengineer.com/p/formal-methods-with-hillel-wayne
