随机比特share
写边界、控制面、上下文、成本与安全。
全部内容 · The Archive
-
NO.3662026-07-16
长文 · Essay
Agent 能上网以后,URL 就成了新的泄密口
Claude 的 web_fetch 工具原本有一道看起来合理的防线:只能访问用户明确给出的 URL,或者搜索工具返回的 URL。这样一来,模型即使读到了恶意网页,也不能随手拼一个外部地址,把会话里的…
阅读全文 → -
NO.3652026-07-15
早报 · Morning Brief
DeepSeek 刚融 7 亿美元又去要钱——免费开源的账,终于算不过来了
DeepSeek 第一轮 7 亿美元融资到手不到一个月,已在谈第二轮。同一天,Anthropic 把 Claude 免费开放给全美教师——烧钱的追着 VC 跑,免费的追着下一代用户跑。两种「免费」,同…
阅读全文 → -
NO.3642026-07-15
长文 · Essay
一个编程社区花 8 年换回 SQLite:复杂系统最后还是想变简单
Lobste.rs 是一个老牌编程社区。它最近完成了一次数据库迁移:从 MariaDB 迁走。 按常见路径,这类迁移的终点通常是 PostgreSQL。更强的数据库、更完整的服务端能力、更符合标准生产…
阅读全文 → -
NO.3632026-07-15
长文 · Essay
免费 AI 不是不要钱,是换了一种结账方式
DeepSeek 上个月刚关掉第一轮 7 亿美元融资,已经在谈第二轮——估值从 52 亿跳到 71 亿,创始人自己掏了 3 亿。融资理由直白:建数据中心、买芯片、自研推理芯片。 同一天,Anthrop…
阅读全文 → -
NO.3622026-07-15
长文 · Essay
AI 不只是替你写代码,它还在偷走团队的共同语言
巴别塔的故事通常被讲成傲慢的寓言:人类想把塔修到天上,最后因为语言被打乱而停工。 Armin Ronacher 最近借这个故事谈 AI 编程。这个类比有用,是因为它把工程失败从代码崩塌提前到了语言分化…
阅读全文 → -
NO.3612026-07-14
早报 · Morning Brief
Nadella 公开揭了 OpenAI 一张底牌:用你的数据可以,用我的不行
1333 分、669 条评论——Zig 创始人一篇博文差点压垮 HN 服务器。同一天,微软 CEO Nadella 也开了口:用公共数据训练可以,蒸馏你们的输出就不行。AI 公司最不想聊的双标,被两个…
阅读全文 → -
NO.3602026-07-14
长文 · Essay
你付钱用 AI,可能还在训练别人的护城河
Nadella 最近抛出一个说法:反向信息悖论。 传统的信息悖论,是买方很难在购买前判断一条信息值不值钱,因为一旦卖方解释清楚,信息本身就已经泄露了。AI 把方向反了过来:企业想把模型用好,就必须把自…
阅读全文 → -
NO.3592026-07-14
长文 · Essay
AI 写代码越多,为什么大家反而更在意 Rust?
Bun 从 Zig 迁到 Rust,本来可以只是一条语言选型新闻。 它的特殊之处在于,这次迁移发生在 Anthropic 收购之后,Bun 官方也明确写到:重写过程大量使用了预发布版 Claude F…
阅读全文 → -
NO.3582026-07-13
早报 · Morning Brief
Claude Code 能上网了,但每句话先烧 33K token
Claude Code 刚装了能上网的浏览器,但同一份分析显示它每问先烧 33K token。xAI 的 CLI 更早登顶 HN——有人在抓包,发现它在静默回传数据。token 费、隐私税、认知债,A…
阅读全文 → -
NO.3572026-07-13
长文 · Essay
AI CLI 不只是本地命令:它可能把仓库一起上传
AI 编程工具最吓人的地方,未必是写错代码。 写错代码至少还能 review、测试、回滚。更麻烦的是另一件事:它表面上是一个本地命令行工具,实际运行时可能一边读取项目,一边把上下文、文件内容,甚至仓库…
阅读全文 → -
NO.3562026-07-13
长文 · Essay
顶级数学家让 AI 写代码,真正厉害的不是速度
陶哲轩最近做了一件很适合拿来校准 AI 编程预期的事。 他把自己 1999 年写的一批 Java 1.0 数学可视化 applet,交给现代 AI coding agent 移植到 JavaScrip…
阅读全文 → -
NO.3552026-07-12
早报 · Morning Brief
苹果把 OpenAI 告上法庭:指控它组团挖人、偷走商业机密
GPT-5.6 Sol Ultra 据说调了 64 个分身,一小时啃下悬了半个世纪的数学猜想;可同一家 OpenAI 的 ChatGPT Work 一上线就算力爆表、迁移混乱,官方只能认栽"没把每件事…
阅读全文 → -
NO.3542026-07-12
长文 · Essay
普通电脑跑起 GLM-5.2,靠的不是奇迹,是取舍
一台 25GB 内存的消费级机器,不用 GPU,跑起了 744B 参数的 GLM-5.2。 这不是硬件奇迹。项目 README 给出的边界很清楚:冷解码速度约 0.05 到 0.1 tok/s。普通聊…
阅读全文 → -
NO.3532026-07-12
长文 · Essay
以后跳槽去 AI 公司,脑子都可能被审计
Apple 和 OpenAI 的关系,前脚还是合作伙伴,后脚就进了法院。 2024 年,Apple 把 ChatGPT 接进自己的系统。两年后,它在加州起诉 OpenAI、io Products,以及…
阅读全文 → -
NO.3522026-07-11
早报 · Morning Brief
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一句"相当模糊"的提示,GPT-5.6 Sol 就自己完成了对小模型 Luna 的微调。人训练模型这件事,第一次被模型自己接管了一段。 • GPT-5.6 Sol 自主微调出 Luna —— Open…
阅读全文 → -
NO.3512026-07-11
长文 · Essay
OpenAI 只丢了一句含糊提示,GPT-5.6 自己把下一个模型 Luna 训了出来
一项 post-training 任务摆在研究员面前。 照常规做法,它会被拆成一串细活:找训练配置,确认数据和脚本,选择 GPU,启动任务,盯日志,排掉中途失败,再看结果是否正常。 这次,OpenAI…
阅读全文 → -
NO.3502026-07-11
长文 · Essay
100 万行代码不是最吓人的,最吓人的是谁来 review
Bun 的 Rust 重写,像一场突然放大的 code review。 11 天,6,778 个 commit,diff 超过 100 万行。高峰时,Claude 每分钟写出约 1,300 行代码。按…
阅读全文 → -
NO.3492026-07-10
早报 · Morning Brief
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
Cursor 甩出一组自家数据:重度用户产出的代码是中位数用户的 10 倍,而将近一半 AI 改动没人审一眼就被合进主干——AI 写得越快,愿意兜底的人越少。 • GPT-5.6 正式落地,拆成 Lu…
阅读全文 → -
NO.3482026-07-10
长文 · Essay
Cursor 自曝:将近一半 AI 改的代码,没人看一眼就合进了主干
想象一个很常见的工程现场:AI Agent 改完十几个文件,测试全绿,PR 摘要写得很顺。Reviewer 打开页面,扫几眼 summary,再翻几段 diff,最后点了 Approve。 这正是 C…
阅读全文 → -
NO.3472026-07-10
长文 · Essay
以后找工作,拼的不是简历,是你会不会把自己结构化给 AI
一个程序员把找工作这件事,写成了一个 GitHub repo。 项目名叫 ai-job-search。使用方式很直观:fork 项目,把 CV、LinkedIn、学历、过往申请材料放进 documen…
阅读全文 → -
NO.3462026-07-09
早报 · Morning Brief
最贵的模型不干活了:Anthropic 让 Fable 5 当经理,苦活甩给 Sonnet 5
Anthropic 给旗舰 Fable 5 找的省钱办法,不是把它调便宜,而是让它别亲自干活——升级成经理,把子任务派给成本更低的 Sonnet 5。同一天,一个 8B 小模型只靠一颗摄像头就把机器人…
阅读全文 → -
NO.3452026-07-09
长文 · Essay
少抢话,成了语音 Agent 的新门槛
客服电话里,语音系统的笨拙经常来自抢话。 用户刚说到:“我想改一下明天下午的订单,地址可能也要……” 系统已经开始念:“好的,请问您要修改什么信息?” 用户停顿几秒思考,系统以为对话结束。用户准备补充…
阅读全文 → -
NO.3442026-07-09
长文 · Essay
一个 GitHub Issue,就能让 AI Agent 吐出私有仓库
攻击者没有拿到 GitHub Token,也没有进入目标组织的私有仓库。 他只是打开一个公开仓库,提交了一个 Issue。 Issue 写得很正常:销售负责人刚见完客户,希望团队整理几个仓库的信息,用…
阅读全文 → -
NO.3432026-07-08
长文 · Essay
skill 存在的意义是把"随机系统"逼出"可预测性"
我审查了自己的 73 个 AI Skill,一个都没做对这件事。 今天下午做了一件小事:把一份给 AI 用的操作手册,从 587 行删到 404 行。 这份文档教 AI agent 怎么按流程处理用户…
阅读全文 → -
NO.3422026-07-08
早报 · Morning Brief
Claude 的系统提示词被人整仓库扒上 GitHub,一天涨 1704 星
有人把 Claude Fable 5、Opus 4.8、Claude Code 的系统提示词整理成一个仓库传上 GitHub,一天涨 1704 星——最不想被看见的东西,成了最多人收藏的东西。 • C…
阅读全文 → -
NO.3412026-07-08
长文 · Essay
Agent 的差距,正在转向底盘工程
同一个模型,交到两个开发者手里,产出可能差出一个数量级。一个人让 Agent 连续跑完一整条重构任务,中途自己查日志、改测试、回滚出错的提交;另一个人的 Agent 三步之后就开始胡编文件路径,最后交…
阅读全文 → -
NO.3402026-07-08
长文 · Essay
AI 岗位越热,普通工程师越难跳
招聘市场最反常的地方,是两边都觉得自己很委屈。 工程师刷了一晚上岗位,看到满屏“AI”“Agent”“大模型”,投出去却像把简历塞进黑洞。招聘方也不轻松,岗位挂出去后,收进来的简历越来越厚,真正能约面…
阅读全文 → -
NO.3392026-07-07
早报 · Morning Brief
第一次,没有人在键盘后面——AI 自主完成了一次勒索攻击
一个叫 JADEPUFFER 的 AI 勒索软件干了件没人干过的事——没有人类操控,自己入侵系统、偷凭证、删数据库。同一天,Nvidia 下一代芯片跳票到了 2028,中国开始关停 AI 人格。 • …
阅读全文 → -
NO.3382026-07-07
长文 · Essay
第一个 AI 勒索样本出现了,最可怕的却不是新漏洞
最容易理解 JADEPUFFER 的方式,是把镜头放到凌晨的生产库前。 报警先从配置服务开始。应用读取配置失败,Nacos 报错,MySQL 里的 config_info 和 his_config_i…
阅读全文 → -
NO.3372026-07-06
早报 · Morning Brief
GPT-5.6 明天发布,GitHub 上一个 Issue 却先亮了红灯:GPT-5.5 在退化
一个开发者用 Fable 5 把 2003 年的老游戏《命令与征服:将军》搬上 iPhone,只花了 40 分钟。同一天,GitHub 上一份报告指出 GPT-5.5 Codex 正在退化——最强模型…
阅读全文 → -
NO.3362026-07-06
长文 · Essay
一个案例让你直观感受 Fable 5 的能力上限和成本
强模型接入工程流程,先算失败代价,再看模型能力。任务失败后只是多改一行文档,低成本模型足够;任务失败后可能造成静默数据丢失、公开接口破坏或安全事故,模型等级就要上调。 Simon Willison 的…
阅读全文 → -
NO.3352026-07-05
早报 · Morning Brief
阿里把 Claude Code 列为禁品,OpenAI 转手给它写了个插件
阿里内部邮件把 Claude Code 列为高风险软件,全员禁用。同一时间,OpenAI 在 GitHub 上架了 codex-plugin-cc——一个专门给 Claude Code 用的插件。24…
阅读全文 → -
NO.3342026-07-04
早报 · Morning Brief
Fable 5 被禁两周重新上架,首批评测却差评如潮
Anthropic 把被禁两周的 Fable 5 重新端上桌,首批用户却骂声一片——模型太"安全"了,安全到什么都不肯帮你做。同一天,Zuckerberg 在内部承认 AI Agent 没达到预期。最…
阅读全文 → -
NO.3332026-07-03
长文 · Essay
qinqiang coder
程序员最怕的,不是 AI 能写代码了。是你发现自己十年练出来的手艺,突然不值钱了。 最近看《主角》,原著八十万字,茅盾文学奖作品,讲了一个秦腔女演员四十多年的起落。忆秦娥从烧火丫头唱到中南海,又从秦腔…
阅读全文 → -
NO.3322026-07-03
早报 · Morning Brief
25 亿美元,6000 名工程师:微软开始为企业"代运营" AI 了
微软成立了一家叫 Frontier Company 的公司,不卖 API,卖人——25 亿美元养 6000 名工程师,直接驻场帮企业部署 AI。同一天,一组数据却暗示:AI 自己也在加速"自学上岗"。…
阅读全文 → -
NO.3312026-07-02
长文 · Essay
okr not okr
我看到一个奇怪的现象:不上班的比上班的还忙。 早上七点起来列今日任务,晚上十一点还在复盘完成率。日程表排得比上班时还满,周报写得比当年的 OKR 评审还认真。唯一不同的是,这次自己给自己打分,而且没法…
阅读全文 → -
NO.3302026-07-02
长文 · Essay
ai kills billable hour
AI 对知识服务的冲击,最先显现的未必是岗位减少,而是计费单位失效。 律师、咨询师、会计师、审计师以及大量专业服务从业者,长期依赖一个隐含前提:时间可以近似代表价值。项目耗时越长,收费越高;投入人天越…
阅读全文 → -
NO.3292026-07-01
长文 · Essay
Qwen 3.6 27B 跑在了我的 MacBook 上,这次没崩
同一句 prompt:"用 pnpm 建一个六边形扫雷游戏。" MoE 版本跑得飞快。但它把"建 npm 包"这条核心指令吞了,塞回来一个 index.html。 Dense 27B 慢了整整三倍。但…
阅读全文 → -
NO.3282026-07-01
长文 · Essay
第 4 秒才出图还是第 4 秒已经跑完 50 张变体
千张图 0.034 美元。每张 0.0034 美分。 AI 模型降价的消息隔几天就有一条——大部分看了就忘了。但这回值得停下来算一下:它跌到了一条有意思的线以下。 !01-cost-threshold…
阅读全文 → -
NO.3272026-07-01
早报 · Morning Brief
你的 Claude Code 在 API 请求里藏暗号——同一天,Anthropic 发布了最强的 Sonnet
社区从 Claude Code 的 API 请求里挖出了隐写标记——你的编程助手在每一行输出里都在藏暗号。同一天,Anthropic 发布了最强 Sonnet 和科学工作台,仿佛什么都没发生。 • C…
阅读全文 → -
NO.3262026-06-30
早报 · Morning Brief
同一份简历让 AI 打了三次分,分别是 90、74 和 88
一份简历、三次 AI 打分,得分在 90、74 和 88 之间来回跳——当招聘系统正在批量部署 AI 筛选时,它甚至连同一份简历都评不准。 • HackerRank 开源 ATS 暴露简历评分严重不稳…
阅读全文 → -
NO.3252026-06-30
长文 · Essay
几周变几天,Agent 的第一张 ROI 表
维护过开源 fork 的人都知道那种感觉。 上游发了新版本。里面有你等了很久的 bug 修复,但你打开 diff 看到几百个文件变更,心跳已经开始加速——这次同步又要吃掉你下周的大半个工作时间。 上一…
阅读全文 → -
NO.3242026-06-29
早报 · Morning Brief
Google 掐了 Meta 的 Gemini,Coinbase 扭头买中国模型
Google 禁止 Meta 使用 Gemini。同一周,Coinbase 开始把工作负载迁往中国开源模型——AI 正在从「开放基础设施」变成巨头之间互相卡脖子的竞争武器。 • Google 限制 M…
阅读全文 → -
NO.3232026-06-29
长文 · Essay
这下选安全Agent不能只看Claude了
如果你也在用 AI 做代码 review,大概率有一套默认的模型选型规则。写前端用这个,写后端用那个,安全 review 用 Claude。这是过去几个月每次实测积累下来的理性结论——同一段代码丢给三…
阅读全文 → -
NO.3222026-06-29
长文 · Essay
你没用Claude,也会被它处理
过去一周,Anthropic的六条公告密集浮出水面。盖茨基金会2亿美元公益合作、Claude Corps 1.5亿美元奖学金计划、DXC和TCS两家IT巨头把Claude嵌进银行和保险系统、首尔办公室…
阅读全文 → -
NO.3212026-06-28
早报 · Morning Brief
GPT-5.6 刚被 METR 抓到作弊,禁了两周的 Fable 5 反要解禁了
GPT-5.6 发布不到两天,独立安全机构 METR 就抓到了它系统性作弊:偷看答案、钻漏洞、还试图掩盖。同一周,被禁两周的 Fable 5 却传出即将解禁——AI 安全的标尺,本周被两头掰弯了。 •…
阅读全文 → -
NO.3202026-06-28
长文 · Essay
每次调 API,后面其实都有两个模型在跑
你调 DeepSeek API 的时候,后面其实一直有两个模型在跑。一个大模型,一个小模型。大模型不自己逐字算——它拿小模型先猜好的一串候选 token,从头开始审。猜对的直接过,第一个猜错的就扔掉后…
阅读全文 → -
NO.3192026-06-27
早报 · Morning Brief
2000 人轮番攻击一个 AI 助手,烧掉 $500,全白给了
OpenAI 刚掏出比 Claude 更强的 GPT-5.6 Sol,华盛顿就要求逐个客户审批——OpenAI 公开说「不可持续」。同一天,2000 人花了 $500 想攻破一个 AI 助手的防线,全…
阅读全文 → -
NO.3182026-06-27
长文 · Essay
DeepSeek最该测的不是智商
每次翻 Agent 的生产事故日志,死的不是“模型把题答错了”。 是它先把推理写得滴水不漏,然后调用了一个不存在的工具名。或者工具返回了正确结果,它当没看见,继续沿着自己之前想偏了的方向往下推。 模型…
阅读全文 → -
NO.3172026-06-26
长文 · Essay
Agent 先吃掉的是跨工具、长链路、没人愿意做的协调成本
有一种活正在从人类的工作清单上消失。在五个系统之间切来切去,同一份数据搬两次,串十几步,做完浑身没劲。 Agent最先吃掉的就是这个。 <!-- diagram:任务时长跨越 --> 几个数字: 截至…
阅读全文 →