MIT 研究者让 Codex 在六量子比特芯片上测量、分析、调参数;信号变弱、噪声增多时,它仍需要人指导。自动执行已经走进实验室,判断结果意味着什么,还没完全交给机器。
🚀 实验自动化与代码迁移
• Codex 接入量子实验软件 —— OpenAI 披露,MIT 研究者用 GPT-5.6 Sol 驱动 Codex 完成常规测量流程。清晰信号下能自动推进,模糊结果仍需研究者介入:跑通实验步骤,不等于独立完成研究。
• Mistral 披露 4 万行 Fortran 77 迁移案例 —— 厂商称协助欧洲能源运营商将历史代码迁至 C++。验收重点应是业务规则与计算结果是否保真,迁移行数本身说明不了省了多少钱。
🛠️ 开发工具与输出体验
• “先给答案”的 Skill 单日新增 4624 star —— i-have-adhd 要解决的是结论被 Agent 长篇解释埋没的问题。上榜不代表当日发布,但这份关注度提醒工具开发者:输出更多,不等于读者更快获得答案。
• Together AI 拆解开源 AI 技术栈 —— 官方文章将系统分成模型、推理、网关与路由、Agent 运行框架、工具五部分。对工程团队更有用的问题是:换模型时,哪些组件可以保留,哪些必须重新验证?
• Mistral Workflows 进入公开预览 —— 新产品以业务工作流为入口,开始接受开发者试用。距离生产可用,还要看具体运行限制、失败恢复与人工接管能力,不能把预览当作成熟度证明。
🚨 身份授权与岗位变化
• LangChain Connections 支持按调用者身份行动 —— Managed Deep Agents 引入凭据管理和每用户 OAuth,让 Agent 使用对应用户的授权。多用户服务最怕借错账号办事;凭据托管之后,身份隔离仍需单独验证。
• Anthropic 开放经济情景交互模型 —— 模型把职业拆成任务,让读者调整 AI 能力与采用范围的假设,观察增长、工资和失业的可能变化。它适合检验“这个预测依赖什么假设”,不能当作未来就业数字的预告。
📚 延伸阅读
• Together AI:The Open Source AI Stack
https://www.together.ai/blog/the-open-source-ai-stack
• LangChain:Connections — Managed Credentials and Per-Caller Identity for Managed Deep Agents
https://www.langchain.com/blog/connections-managed-credentials-and-per-caller-identity-for-managed-deep-agents
• Anthropic:经济未来情景交互模型
https://www.anthropic.com/institute/econ-scenarios
