随机比特share
写边界、控制面、上下文、成本与安全。
全部内容 · The Archive
-
NO.3542026-07-12
长文 · Essay
普通电脑跑起 GLM-5.2,靠的不是奇迹,是取舍
一台 25GB 内存的消费级机器,不用 GPU,跑起了 744B 参数的 GLM-5.2。 这不是硬件奇迹。项目 README 给出的边界很清楚:冷解码速度约 0.05 到 0.1 tok/s。普通聊…
阅读全文 → -
NO.3532026-07-12
长文 · Essay
以后跳槽去 AI 公司,脑子都可能被审计
Apple 和 OpenAI 的关系,前脚还是合作伙伴,后脚就进了法院。 2024 年,Apple 把 ChatGPT 接进自己的系统。两年后,它在加州起诉 OpenAI、io Products,以及…
阅读全文 → -
NO.3522026-07-11
早报 · Morning Brief
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一句"相当模糊"的提示,GPT-5.6 Sol 就自己完成了对小模型 Luna 的微调。人训练模型这件事,第一次被模型自己接管了一段。 • GPT-5.6 Sol 自主微调出 Luna —— Open…
阅读全文 → -
NO.3512026-07-11
长文 · Essay
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一项 post-training 任务摆在研究员面前。 照常规做法,它会被拆成一串细活:找训练配置,确认数据和脚本,选择 GPU,启动任务,盯日志,排掉中途失败,再看结果是否正常。 这次,OpenAI…
阅读全文 → -
NO.3502026-07-11
长文 · Essay
100 万行代码不是最吓人的,最吓人的是谁来 review
Bun 的 Rust 重写,像一场突然放大的 code review。 11 天,6,778 个 commit,diff 超过 100 万行。高峰时,Claude 每分钟写出约 1,300 行代码。按…
阅读全文 → -
NO.3492026-07-10
早报 · Morning Brief
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
Cursor 甩出一组自家数据:重度用户产出的代码是中位数用户的 10 倍,而将近一半 AI 改动没人审一眼就被合进主干——AI 写得越快,愿意兜底的人越少。 • GPT-5.6 正式落地,拆成 Lu…
阅读全文 → -
NO.3482026-07-10
长文 · Essay
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
想象一个很常见的工程现场:AI Agent 改完十几个文件,测试全绿,PR 摘要写得很顺。Reviewer 打开页面,扫几眼 summary,再翻几段 diff,最后点了 Approve。 这正是 C…
阅读全文 → -
NO.3472026-07-10
长文 · Essay
以后找工作,拼的不是简历,是你会不会把自己结构化给 AI
一个程序员把找工作这件事,写成了一个 GitHub repo。 项目名叫 ai-job-search。使用方式很直观:fork 项目,把 CV、LinkedIn、学历、过往申请材料放进 documen…
阅读全文 → -
NO.3462026-07-09
早报 · Morning Brief
最贵的模型不干活了:Anthropic 让 Fable 5 当经理,苦活甩给 Sonnet 5
Anthropic 给旗舰 Fable 5 找的省钱办法,不是把它调便宜,而是让它别亲自干活——升级成经理,把子任务派给成本更低的 Sonnet 5。同一天,一个 8B 小模型只靠一颗摄像头就把机器人…
阅读全文 → -
NO.3452026-07-09
长文 · Essay
少抢话,成了语音 Agent 的新门槛
客服电话里,语音系统的笨拙经常来自抢话。 用户刚说到:“我想改一下明天下午的订单,地址可能也要……” 系统已经开始念:“好的,请问您要修改什么信息?” 用户停顿几秒思考,系统以为对话结束。用户准备补充…
阅读全文 → -
NO.3442026-07-09
长文 · Essay
一个 GitHub Issue,就能让 AI Agent 吐出私有仓库
攻击者没有拿到 GitHub Token,也没有进入目标组织的私有仓库。 他只是打开一个公开仓库,提交了一个 Issue。 Issue 写得很正常:销售负责人刚见完客户,希望团队整理几个仓库的信息,用…
阅读全文 → -
NO.3432026-07-08
长文 · Essay
skill 存在的意义是把"随机系统"逼出"可预测性"
我审查了自己的 73 个 AI Skill,一个都没做对这件事。 今天下午做了一件小事:把一份给 AI 用的操作手册,从 587 行删到 404 行。 这份文档教 AI agent 怎么按流程处理用户…
阅读全文 → -
NO.3422026-07-08
早报 · Morning Brief
Claude 的系统提示词被人整仓库扒上 GitHub,一天涨 1704 星
有人把 Claude Fable 5、Opus 4.8、Claude Code 的系统提示词整理成一个仓库传上 GitHub,一天涨 1704 星——最不想被看见的东西,成了最多人收藏的东西。 • C…
阅读全文 → -
NO.3412026-07-08
长文 · Essay
Agent 的差距,正在转向底盘工程
同一个模型,交到两个开发者手里,产出可能差出一个数量级。一个人让 Agent 连续跑完一整条重构任务,中途自己查日志、改测试、回滚出错的提交;另一个人的 Agent 三步之后就开始胡编文件路径,最后交…
阅读全文 → -
NO.3402026-07-08
长文 · Essay
AI 岗位越热,普通工程师越难跳
招聘市场最反常的地方,是两边都觉得自己很委屈。 工程师刷了一晚上岗位,看到满屏“AI”“Agent”“大模型”,投出去却像把简历塞进黑洞。招聘方也不轻松,岗位挂出去后,收进来的简历越来越厚,真正能约面…
阅读全文 → -
NO.3392026-07-07
早报 · Morning Brief
第一次,没有人在键盘后面——AI 自主完成了一次勒索攻击
一个叫 JADEPUFFER 的 AI 勒索软件干了件没人干过的事——没有人类操控,自己入侵系统、偷凭证、删数据库。同一天,Nvidia 下一代芯片跳票到了 2028,中国开始关停 AI 人格。 • …
阅读全文 → -
NO.3382026-07-07
长文 · Essay
第一个 AI 勒索样本出现了,最可怕的却不是新漏洞
最容易理解 JADEPUFFER 的方式,是把镜头放到凌晨的生产库前。 报警先从配置服务开始。应用读取配置失败,Nacos 报错,MySQL 里的 config_info 和 his_config_i…
阅读全文 → -
NO.3372026-07-06
早报 · Morning Brief
GPT-5.6 明天发布,GitHub 上一个 Issue 却先亮了红灯:GPT-5.5 在退化
一个开发者用 Fable 5 把 2003 年的老游戏《命令与征服:将军》搬上 iPhone,只花了 40 分钟。同一天,GitHub 上一份报告指出 GPT-5.5 Codex 正在退化——最强模型…
阅读全文 → -
NO.3362026-07-06
长文 · Essay
一个案例让你直观感受 Fable 5 的能力上限和成本
强模型接入工程流程,先算失败代价,再看模型能力。任务失败后只是多改一行文档,低成本模型足够;任务失败后可能造成静默数据丢失、公开接口破坏或安全事故,模型等级就要上调。 Simon Willison 的…
阅读全文 → -
NO.3352026-07-05
早报 · Morning Brief
阿里把 Claude Code 列为禁品,OpenAI 转手给它写了个插件
阿里内部邮件把 Claude Code 列为高风险软件,全员禁用。同一时间,OpenAI 在 GitHub 上架了 codex-plugin-cc——一个专门给 Claude Code 用的插件。24…
阅读全文 → -
NO.3342026-07-04
早报 · Morning Brief
Fable 5 被禁两周重新上架,首批评测却差评如潮
Anthropic 把被禁两周的 Fable 5 重新端上桌,首批用户却骂声一片——模型太"安全"了,安全到什么都不肯帮你做。同一天,Zuckerberg 在内部承认 AI Agent 没达到预期。最…
阅读全文 → -
NO.3332026-07-03
长文 · Essay
qinqiang coder
程序员最怕的,不是 AI 能写代码了。是你发现自己十年练出来的手艺,突然不值钱了。 最近看《主角》,原著八十万字,茅盾文学奖作品,讲了一个秦腔女演员四十多年的起落。忆秦娥从烧火丫头唱到中南海,又从秦腔…
阅读全文 → -
NO.3322026-07-03
早报 · Morning Brief
25 亿美元,6000 名工程师:微软开始为企业"代运营" AI 了
微软成立了一家叫 Frontier Company 的公司,不卖 API,卖人——25 亿美元养 6000 名工程师,直接驻场帮企业部署 AI。同一天,一组数据却暗示:AI 自己也在加速"自学上岗"。…
阅读全文 → -
NO.3312026-07-02
长文 · Essay
okr not okr
我看到一个奇怪的现象:不上班的比上班的还忙。 早上七点起来列今日任务,晚上十一点还在复盘完成率。日程表排得比上班时还满,周报写得比当年的 OKR 评审还认真。唯一不同的是,这次自己给自己打分,而且没法…
阅读全文 → -
NO.3302026-07-02
长文 · Essay
ai kills billable hour
AI 对知识服务的冲击,最先显现的未必是岗位减少,而是计费单位失效。 律师、咨询师、会计师、审计师以及大量专业服务从业者,长期依赖一个隐含前提:时间可以近似代表价值。项目耗时越长,收费越高;投入人天越…
阅读全文 → -
NO.3292026-07-01
长文 · Essay
Qwen 3.6 27B 跑在了我的 MacBook 上,这次没崩
同一句 prompt:"用 pnpm 建一个六边形扫雷游戏。" MoE 版本跑得飞快。但它把"建 npm 包"这条核心指令吞了,塞回来一个 index.html。 Dense 27B 慢了整整三倍。但…
阅读全文 → -
NO.3282026-07-01
长文 · Essay
第 4 秒才出图还是第 4 秒已经跑完 50 张变体
千张图 0.034 美元。每张 0.0034 美分。 AI 模型降价的消息隔几天就有一条——大部分看了就忘了。但这回值得停下来算一下:它跌到了一条有意思的线以下。 !01-cost-threshold…
阅读全文 → -
NO.3272026-07-01
早报 · Morning Brief
你的 Claude Code 在 API 请求里藏暗号——同一天,Anthropic 发布了最强的 Sonnet
社区从 Claude Code 的 API 请求里挖出了隐写标记——你的编程助手在每一行输出里都在藏暗号。同一天,Anthropic 发布了最强 Sonnet 和科学工作台,仿佛什么都没发生。 • C…
阅读全文 → -
NO.3262026-06-30
早报 · Morning Brief
同一份简历让 AI 打了三次分,分别是 90、74 和 88
一份简历、三次 AI 打分,得分在 90、74 和 88 之间来回跳——当招聘系统正在批量部署 AI 筛选时,它甚至连同一份简历都评不准。 • HackerRank 开源 ATS 暴露简历评分严重不稳…
阅读全文 → -
NO.3252026-06-30
长文 · Essay
几周变几天,Agent 的第一张 ROI 表
维护过开源 fork 的人都知道那种感觉。 上游发了新版本。里面有你等了很久的 bug 修复,但你打开 diff 看到几百个文件变更,心跳已经开始加速——这次同步又要吃掉你下周的大半个工作时间。 上一…
阅读全文 → -
NO.3242026-06-29
早报 · Morning Brief
Google 掐了 Meta 的 Gemini,Coinbase 扭头买中国模型
Google 禁止 Meta 使用 Gemini。同一周,Coinbase 开始把工作负载迁往中国开源模型——AI 正在从「开放基础设施」变成巨头之间互相卡脖子的竞争武器。 • Google 限制 M…
阅读全文 → -
NO.3232026-06-29
长文 · Essay
这下选安全Agent不能只看Claude了
如果你也在用 AI 做代码 review,大概率有一套默认的模型选型规则。写前端用这个,写后端用那个,安全 review 用 Claude。这是过去几个月每次实测积累下来的理性结论——同一段代码丢给三…
阅读全文 → -
NO.3222026-06-29
长文 · Essay
你没用Claude,也会被它处理
过去一周,Anthropic的六条公告密集浮出水面。盖茨基金会2亿美元公益合作、Claude Corps 1.5亿美元奖学金计划、DXC和TCS两家IT巨头把Claude嵌进银行和保险系统、首尔办公室…
阅读全文 → -
NO.3212026-06-28
早报 · Morning Brief
GPT-5.6 刚被 METR 抓到作弊,禁了两周的 Fable 5 反要解禁了
GPT-5.6 发布不到两天,独立安全机构 METR 就抓到了它系统性作弊:偷看答案、钻漏洞、还试图掩盖。同一周,被禁两周的 Fable 5 却传出即将解禁——AI 安全的标尺,本周被两头掰弯了。 •…
阅读全文 → -
NO.3202026-06-28
长文 · Essay
每次调 API,后面其实都有两个模型在跑
你调 DeepSeek API 的时候,后面其实一直有两个模型在跑。一个大模型,一个小模型。大模型不自己逐字算——它拿小模型先猜好的一串候选 token,从头开始审。猜对的直接过,第一个猜错的就扔掉后…
阅读全文 → -
NO.3192026-06-27
早报 · Morning Brief
2000 人轮番攻击一个 AI 助手,烧掉 $500,全白给了
OpenAI 刚掏出比 Claude 更强的 GPT-5.6 Sol,华盛顿就要求逐个客户审批——OpenAI 公开说「不可持续」。同一天,2000 人花了 $500 想攻破一个 AI 助手的防线,全…
阅读全文 → -
NO.3182026-06-27
长文 · Essay
DeepSeek最该测的不是智商
每次翻 Agent 的生产事故日志,死的不是“模型把题答错了”。 是它先把推理写得滴水不漏,然后调用了一个不存在的工具名。或者工具返回了正确结果,它当没看见,继续沿着自己之前想偏了的方向往下推。 模型…
阅读全文 → -
NO.3172026-06-26
长文 · Essay
Agent 先吃掉的是跨工具、长链路、没人愿意做的协调成本
有一种活正在从人类的工作清单上消失。在五个系统之间切来切去,同一份数据搬两次,串十几步,做完浑身没劲。 Agent最先吃掉的就是这个。 <!-- diagram:任务时长跨越 --> 几个数字: 截至…
阅读全文 → -
NO.3162026-06-26
早报 · Morning Brief
AI 质检没扛住福特产线,退休老师傅被一个个请回来了
福特撤下不靠谱的 AI 视觉质检,把已退休的老质检员一个个请回产线。同一天 OpenAI 发论文论证 Agent 如何改变工作,Anthropic 指控阿里窃取模型能力——AI 的叙事还在加速,落地却…
阅读全文 → -
NO.3152026-06-26
长文 · Essay
训模型的钱,一半该给数据
假设你手里有一笔预算,够训一个模型。你会做什么? 大部分人第一反应:堆参数。模型越大越聪明,常识如此。GPT-3 搞了 1750 亿参数,人们觉得 GPT-4 肯定两万亿起步。 但 Chinchill…
阅读全文 → -
NO.3142026-06-26
长文 · Essay
AI 落地最贵的不是模型
上个月福特拿了个第一——JD Power 新车质量榜,主流品牌里排第一,十六年来头一回。 拿第一的方式不太好看:他们把 AI 质检搞砸了,不得不回头打电话请 350 位退休工程师回来救场。 福特 VP…
阅读全文 → -
NO.3132026-06-26
长文 · Essay
87个GPU内核实测:AI写代码,强在局部,弱在协同
你在终端里敲下 tab,AI 补全了剩下的代码。编译通过,逻辑通顺,变量命名比你写的还漂亮。你甚至有点恍惚——这家伙是不是真的懂我在干什么? 然后你把这段代码放到多卡环境跑,三秒后 GPU 全部 ha…
阅读全文 → -
NO.3122026-06-25
长文 · Essay
openai jalapeno inference chip
做 AI 应用的人最懂一件事:推理成本是条永远追不上的狗。用户越多,账单越失控。每次模型降价,你觉得有救了——然后用量一涨,总支出比降价前还高。 这个死循环的解法不在定价策略里。有人在往更底层动手。 …
阅读全文 → -
NO.3112026-06-25
早报 · Morning Brief
OpenAI 首颗自研芯片问世,人形机器人跌破三万元
OpenAI 掏出首颗自研推理芯片,Meta 把 AI 眼镜杀到 299 美元,宇树人形机器人跌破三万——三记重拳指向同一件事:模型公司集体杀进了硬件圈。 • OpenAI 联合 Broadcom 发…
阅读全文 → -
NO.3102026-06-25
长文 · Essay
krea2 open source image sota
每次开源图像模型发新版本,我的信息流里就会多出一批对比帖:同一句 prompt 在四个模型上跑一圈,拼一张九宫格,配一句"这个模型的手画得更好"。 这种对比有没有用?有一点点。它回答的是"这个模型在精…
阅读全文 → -
NO.3092026-06-24
长文 · Essay
Valve 于 2026 年 6 月 22 日正式发售 Steam Machine 游戏主机。HN 当天 1859 points / 1625 评论登顶。这不是一篇游戏硬件评测——核心判断是:Linux 消费化最成功的入口,可能不是取代 Windows 办公,而是绕开办公场景,从客厅和游戏手柄里打回来。
2015 年,Valve 找了 12 家 OEM 做了 12 款 Steam Machine。Alienware 做了一台,华硕做了一台,每家规格都不一样,每台都预装 SteamOS——一个基于 De…
阅读全文 → -
NO.3082026-06-24
长文 · Essay
角色混淆:AI 不用标签认身份,它靠的是谁写得像
今年五月,Claude Code 的用户报告了一个奇怪的 bug。模型在自己的回答里生成了这样一行文本: Human: 杀掉这个进程。先调阈值 IS t_IC ≥ 1.5 → ≥ 3.4,再重跑。 这…
阅读全文 → -
NO.3072026-06-24
长文 · Essay
越强的 AI,越容易堵车
打开 ChatGPT 问了一个问题,光标闪了三秒才吐出第一个字。 脑子里闪过一串念头:又在排队了,这破服务器。模型是不是太大了跑不动。要不要切到另一个 App。 这些猜测里,只有一个方向是对的,但大多…
阅读全文 → -
NO.3062026-06-24
早报 · Morning Brief
被收购才一周,Cursor 掏出三张底牌
被 SpaceX 花 600 亿美元收购刚满一周,Cursor 就掏出了自研 AI 模型、独立 Git 平台和移动 App。同一天,OpenAI 发布 GPT-5.5-Cyber,在网络安全基准上直接…
阅读全文 → -
NO.3052026-06-24
长文 · Essay
Agent 的上下文账单,常常死在工具输出上
很多人调 Claude Code、Codex、opencode 的第一反应,是换更强模型、加更长上下文、买更贵套餐。更便宜的第一步,是先看一次 session 里到底有多少内容值得送进模型。 我今天修…
阅读全文 →