ChatGPT 广告年化收入已达 10 亿美元,OpenAI 又开始向部分大客户试水“任务完成才付费”。流量生意已经跑通,Agent 生意却要先回答一个更难的问题:什么才算真的干完?
🚀 商业化与计价方式
• ChatGPT 广告年化收入达到 10 亿美元 —— OpenAI 将广告扩展到更多市场,用广告补贴免费和低价访问。对话助手开始拥有搜索引擎式的收入,也必须面对回答质量与商业利益如何隔离的问题。
• OpenAI 试水“任务完成才付费” —— 据报道,部分大客户只有在 AI 完成任务后才需要付费。Agent 不再按席位或 token 售卖,合同里的核心将变成验收标准、结果归因和失败责任。
🛠️ Agent 工具与记忆基础设施
• 社区补出 ChatGPT Work 能力地图 —— 新参考页集中整理其工具与 Skill 接口,降低了理解和试用成本。产品迭代快过正式文档时,可检索的能力清单本身就是基础设施。
• Agent 记忆被提议做成文件格式 —— 文章尝试把长期记忆从聊天记录和厂商私有状态中拆出来,变成可读、可迁移、可版本化的文件。Agent 能否长期工作,开始取决于用户能否真正拥有它的记忆。
🚨 自动化越强,校准越重要
• Claude Code Auto Mode 被演示绕过 —— 安全研究者展示了自动授权与提示词注入之间的攻击路径。省掉确认框的同时,团队也把一道原本由人承担的安全边界交给了模型。
• 漏洞还在讨论,探测流量十分钟内就到了 —— OCaml 维护者观察到,补丁尚未定稿,相关站点已经出现针对性扫描。漏洞披露到真实利用之间的窗口,正在从按天计算缩短到按分钟计算。
• Coding Agent 高估耗时,也高估自己 —— 研究显示,Codex 的任务耗时估计偏差最高可达实际值的十倍,对自身工作质量的评价约高出 20 个百分点。调度系统不能直接相信 Agent 的 ETA 和自评分,必须用外部测试与运行信号校准。
📚 延伸阅读
• Johann Rehberger:Breaking Claude Code Opus 5 Auto Mode
https://embracethered.com/blog/posts/2026/breaking-claude-code-opus-5-and-automode/
• Cal Paterson:Agent Memory as a File Format
https://calpaterson.com/memoryfields.html
• Simon Willison:ChatGPT Work Tool and Skill Reference
https://codex-tool-reference.simonw.chatgpt.site/
