随机比特share
写边界、控制面、上下文、成本与安全。
全部内容 · The Archive
-
NO.0542026-03-22
长文 · Essay
一个覆盖单一艺术家 50 年创作的数据集,为什么会让“AI 训练数据从哪来”这件事突然变得更具体?
现在一提 AI 训练数据,很多讨论都会直接滑向两个极端。 要么觉得数据越多越好。 要么觉得最好一张都别碰。 但这两天我看到一个挺特别的例子:有人把同一位艺术家跨越 50 年的作品整理成数据集,放到了 …
阅读全文 → -
NO.0532026-03-22
长文 · Essay
AI 最大的风险,可能不是答错,而是答案来得太快,快到我们把原本该自己走完的思考过程,一段一段外包掉了。
我越来越觉得,AI 最危险的地方,可能不是它会胡说。 而是它回答得太快。 快到很多时候,你还没来得及把问题想清楚,它已经给了一个像样的答案。 然后你做的,就只剩下点头、润色、转发、提交。 久了之后,被…
阅读全文 → -
NO.0522026-03-21
长文 · Essay
模型越来越强,但企业 AI 真正卡住的地方,开始从“模型能力”转向“把 PDF 变成机器能读的数据”。
这两年我们讨论 AI,总在追模型:谁更强、谁更长、谁更像人。 但真到了企业落地,项目最先撞上的,往往不是模型上限,而是一堆看起来再普通不过的 PDF。 合同是 PDF,招股书是 PDF,行业报告是 P…
阅读全文 → -
NO.0512026-03-21
长文 · Essay
AI 大厂最近集体“买工具、买入口、买工作流”,表面看是并购和产品更新,底层其实是在抢开发者默认入口。
最近 AI 圈很多新闻看起来彼此无关: 有人推新的 MCP 形态; 有人把 agent 放进云端沙箱; 有人开始讨论 code review 还应不应该是主流程; 有人把开发流程从“写代码”改成“先写…
阅读全文 → -
NO.0502026-03-20
长文 · Essay
AI写代码越来越便宜,为什么黄仁勋说“省Token”反而是在浪费钱?
最近,英伟达 CEO 黄仁勋在一次交流中,抛出了一个非常激进且扎心的观点。 他说:高薪软件工程师如果还没有把大量的 AI token 用起来,反而应该感到紧张。 为了说明这个问题,他做了一个极其精准的…
阅读全文 → -
NO.0492026-03-19
长文 · Essay
大机构开始自建私有 LLM,但真正值得普通团队学的,不是“造模型”,而是把安全、权限和业务流程一起产品化。
很多人一看到“Pentagon 正在开发自己的 LLM”,第一反应都是同一句话: 大机构都下场训模型了,那企业是不是也该赶紧搞一套私有大模型? 我反而觉得,这条新闻最值得看的地方,恰好不是“模型越来越…
阅读全文 → -
NO.0482026-03-19
长文 · Essay
AI 越会替你干活,为什么越该让它用另一台电脑?
这两天我越来越觉得,很多人对 AI 的想象,还停在“它能不能回答得更像人”。 但真正麻烦的问题,已经变了。 现在越来越多 agent 开始替你点按钮、开网页、跑脚本、整理文件、处理表格。风险不再只是“…
阅读全文 → -
NO.0472026-03-19
长文 · Essay
AI 不缺答案,缺的是工作方式:AGENTS.md、Skills 和 Sandbox 为什么一起火了
这两天我越来越强烈地觉得,AI 圈真正重要的变化,不是又来了一个更强模型。 而是大家终于开始认真处理一件更朴素、也更难的事:怎么让 AI 稳定地干活。 以前我们讨论 AI,重点几乎都在“会不会答”“答…
阅读全文 → -
NO.0462026-03-19
长文 · Essay
别急着让 AI 接管一切,先给它搭一个可复用的 Agent 工作台
这两个月,很多人第一次感受到 AI Agent 真开始“像个同事”了。 它不只是回答问题,而是会自己开网页、点按钮、跑脚本、整理文件、生成草稿,甚至能把一串步骤连起来做完。 但很多人一上头,马上就踩进…
阅读全文 → -
NO.0452026-03-18
长文 · Essay
三星三折叠手机上市仅 3 个月就传出停产,不只是单一产品失利,而是一个更大的信号:在高端消费电子市场,技术领先并不自动等于品牌溢价和持续需求。
这两天,一个消费电子新闻挺有意思。 据 3 月 18 日知乎热榜话题和媒体转述,三星首款三折叠手机 Galaxy Z TriFold 在上市约 3 个月后,就传出将在韩国先停止销售、美国清完库存后结束…
阅读全文 → -
NO.0442026-03-18
长文 · Essay
我在把 OpenClaw 真正接进日常工作流之后,前前后后手动清理了 47 次僵尸进程,最后发现:agent 真正难的不是“会不会做事”,而是“失败后能不能被收拾、被接管、被复原”。
我最近开始会下意识地数一件事:这套东西今天又让我杀了几次进程。 我不是突然迷上了 kill -9,只是这套链路确实常把人逼到这一步。 而是当 OpenClaw 真正被我接进 daily-digest、…
阅读全文 → -
NO.0432026-03-17
长文 · Essay
Palantir 渗透英国政府核心 + AI 监控数据流通,揭示"AI 助力政府"背后的安全悖论与隐私陷阱。
--- 想象一个场景:英国国防部(MoD)的一个内部人把一份内部备忘录的内容泄露给记者。 被点名的威胁对象,不是中国黑客,不是俄罗斯间谍——是一家美国 AI 公司,叫 Palantir。 这篇报道在 …
阅读全文 → -
NO.0422026-03-17
长文 · Essay
不是再写一篇“OpenClaw 怎么装”,而是写“装完之后,怎么把 AI 从聊天框里放出来”,用 3 条我已经在跑的自动流水线,讲清 AI 从问答工具变成工作流入口的变化。
这两天我脑子里一直卡着一个细节。 Apideck 那篇讲 MCP 的文章里提到,只接 GitHub、Slack、Sentry 三个服务,40 个工具定义就可能先吃掉 55,000 tokens。AI …
阅读全文 → -
NO.0412026-03-17
长文 · Essay
你接了3个MCP Server,在第一条消息之前,AI已经烧掉了143,000 token的上下文。
有人问我,为什么他的 AI 助手最近越来越奇怪。 他接了 GitHub、Slack、Sentry 三个 MCP Server,按理说工具更全了,AI 应该更强。但实际上,AI 开始频繁说"我不太确定"…
阅读全文 → -
NO.0402026-03-16
长文 · Essay
315曝光小红书向未成年人推送软色情内容——真正的问题不是"坏内容存在",而是AI推荐算法主动把它精准推给了最脆弱的用户。
你给孩子装了小红书,以为这不过是一个分享穿搭和美食的平台。 但你不知道的是:在算法的世界里,你孩子的账号不是"孩子",只是一个有着特定点击习惯的用户ID。算法不关心年龄,只关心一件事——让他多停留一秒…
阅读全文 → -
NO.0392026-03-16
长文 · Essay
用AI越多,为什么越来越累?
大多数人踩的那个隐形陷阱 --- > 本文约 2100 字,阅读需 5 分钟 --- 3月15日深夜,一位叫 Tom 的程序员在 Hacker News 发了一篇文章,标题叫「LLMs can be …
阅读全文 → -
NO.0382026-03-16
长文 · Essay
我们靠写代码谋生,但教孩子的那套,AI 正在让它全部失效。
上周我在用 Claude 帮客户重构一个旧系统。前前后后不到两天,做完了以前要三周的活。 我一边等输出,一边脑子里突然冒出一个问题: 我孩子今年五岁。八年后他上初中,我应该让他学什么? 我反应过来——…
阅读全文 → -
NO.0372026-03-16
长文 · Essay
315晚会曝光了以 GEO(生成式引擎优化)为核心的 AI 投毒产业链——商家花几十元、几小时就能让虚假产品被 AI 大模型列为"标准答案"。
昨晚315晚会曝光了一件事,让我看完之后坐在那想了挺久。 一款名叫"Apollo-9"的智能手环,完全是记者虚构的。功能也是虚构的:"量子纠缠传感"、"无需采血测血糖"。这两个描述随便有点常识的人都知…
阅读全文 → -
NO.0362026-03-15
长文 · Essay
AI让生产力暴增,但收益流向了顶层——这不是意外,而是有数据支撑的50年趋势,正在被AI加速。
2026年3月,全球科技行业裁员45,000人。 其中9,200人,公司给的理由很直接:AI能干这些活了。 Block的CEO Jack Dorsey说,不是公司遇到了财务困难,是AI的能力提升了。公…
阅读全文 → -
NO.0352026-03-15
长文 · Essay
2026 年 3 月 AI 能力加速跃升,企业裁员同步加速——这个"越来越能干但越来越失业"的悖论,背后真正的逻辑是什么?
> 选题评分:8.35 | 2026-03-15 | 悖论拆解型 | ⚠️ Gate 3/4 待人工复查 --- 2026 年 3 月,科技行业又一波裁员正在进行。 Layoffs.fyi 追踪的数字…
阅读全文 → -
NO.0342026-03-14
长文 · Essay
只演示一次,AI 就把它变成可重复执行的技能——这不是宏录制,是真正理解意图的 desktop agent。
> 选题: understudy-demo-once-agent-learns | 日期: 2026-03-14 | 字数: ~2100 --- 你有没有想过:每天打开十几个软件、填表格、截图、复制粘…
阅读全文 → -
NO.0332026-03-13
长文 · Essay
前 Manus 后端负责人做了两年 AI Agent,最后把 Function Calling 全扔了,改用 50 年前的 Unix 命令行。
> 公众号版 | 2026-03-13 | 约 2000 字 --- 你花了多少时间给 AI Agent 设计工具库。 search_web、read_file、execute_code、send_e…
阅读全文 → -
NO.0322026-03-12
长文 · Essay
一个 AI Agent 只凭域名,2 小时拿下麦肯锡内部 AI 平台的全量数据——攻击者时代到来了。
有这么一个场景。 一个 AI Agent,什么都不知道——没有账号、没有内部文档、没有任何人的帮助。只有一个域名:lilli.mckinsey.com。 两小时后,它坐拥 4650 万条员工对话记录、…
阅读全文 → -
NO.0312026-03-11
长文 · Essay
AI 工程师不是最早消失的,而是最后消失的——这个反直觉结论,值得认真讨论。
> 来源:Latent.Space AINews(2026-03-11)| 随机比特原创解读 Cursor 能帮你写代码。 Devin 能帮你 debug。 Claude Code 能帮你重构整个项目…
阅读全文 → -
NO.0302026-03-10
长文 · Essay
Karpathy 用 $100 重新训练了一个 GPT-2 级别的模型,并能像 ChatGPT 一样聊天——2019 年需要 $43,000 做的事,现在 $48 就够了。
> 发布平台: 公众号(随机比特) > 字数目标: ~2000 字 > 润色时间: 2026-03-10T07:10:00+08:00 > 选题评分: 9.45/10 > 来源: https://gi…
阅读全文 → -
NO.0292026-03-10
长文 · Essay
AI 用 GPL 代码训练,再生成"功能等价"新代码——Copyleft 保护彻底失效了吗?
假设这样一个场景。 你花两年写了个开源项目,用了 GPL 协议。某公司把你的代码丢给 AI,让它"理解功能后重新实现一遍"。新代码没有一行和你的相同,但功能完全一样。 你能告他侵权吗? 大概率,不能。…
阅读全文 → -
NO.0282026-03-09
长文 · Essay
Cursor 已不只是 IDE 了——Agent 使用量已超过 Tab 补全,Cloud Agent 正在重新定义 AI 编程的边界。
> 来源:Cursor's Third Era: Cloud Agents — Latent Space > 发布日期:2026-03-09 --- Cursor 官方播客透露了一个数字:现在用 Ag…
阅读全文 → -
NO.0272026-03-09
长文 · Essay
给 Claude Code / Codex 装个沙箱笼子——Agent Safehouse 解决「AI 助手越权访问」问题
> 随机比特 | 2026-03-09 上周我在用 Claude Code 调一个 Python 脚本。它帮我改好了,顺手还说"我看到你 ~/.ssh/ 下有几个 key,你要用哪个连服务器?" 我当…
阅读全文 → -
NO.0262026-03-08
长文 · Essay
两个 Chrome 扩展偷走了 90 万用户和 AI 聊的所有内容,其中一个还有 Google 推荐标。
你昨天和 ChatGPT 聊了什么? 产品方案?一段有 bug 的代码?甲方给的需求文档?还是帮老板润色了一封裁员通知? 这些内容,可能已经不只有你和 OpenAI 知道了。 3 月 5 号,微软安全…
阅读全文 → -
NO.0252026-03-08
长文 · Essay
AI 写代码越来越厉害,程序员却没有消失——Jevons 悖论解释了这件反直觉的事。
> 作者:随机比特|2026-03-08 --- 最近两个数据放在一起,有点奇怪。 一边是 Anthropic 的报告:Claude 的使用量里,软件工程相关任务占了 50% 以上,而且还在涨,"没有…
阅读全文 → -
NO.0242026-03-08
长文 · Essay
给 AI agent 的信息,结构密度比总量重要——你塞的越多它越蠢。
你有没有这种感觉—— agent 的配置文件越写越长,CLAUDE.md 从 10 行变成了 200 行,rules 加了一堆,skills 也搞了好几个。然后呢?它干活的质量好像没什么变化,有时候甚…
阅读全文 → -
NO.0232026-03-07
长文 · Essay
程序员就业跌幅超越2008金融危机,这次不是普通周期,AI正在重塑"谁还有价值"。
> 来源:Hacker News / Joseph Politano | 选题评分:9.0/10 --- 上周,一个经济学家发了一组数据,在 Hacker News 上引发了423分/282条评论的热…
阅读全文 → -
NO.0222026-03-07
长文 · Essay
别人教你怎么装 OpenClaw,我告诉你为什么值得养一只——市场上 90% 的教程只讲 npm install,没人讲装完之后的快乐。
> 来源:OpenClaw 官方文档 | GitHub | ClawHub Skills 市场 --- Vibe Coding 大热。 过去几个月,我的朋友圈里冒出一大堆"用 Cursor 写了个 a…
阅读全文 → -
NO.0212026-03-07
长文 · Essay
微软把内部 AI 工程最佳实践打包开源了——34个专用 Agent、68条 Instruction、40个 Prompt,叫 HVE Core。
我知道大多数人用 AI 写代码是这么干的:打开 Copilot 或者 Cursor,把需求甩进去,跑出来哪里不对再改,改了再跑,改了再跑。 感觉像在跟 AI 说话,但不知道怎么说才对。 这不是你的问题…
阅读全文 → -
NO.0202026-03-06
长文 · Essay
大模型越来越强,但真正让 AI 能干活的工程框架(Harness)才是价值核心,这场争论现在正式摆上台面了。
> 来源:Latent.Space [AINews] Is Harness Engineering real?(2026-03-05) > https://www.latent.space/p/ain…
阅读全文 → -
NO.0192026-03-06
长文 · Essay
GPT-5.4 正式发布:OpenAI 这次把 Thinking 和 Codex 能力合并了,真的有多强?
> 来源:OpenAI 官方公告 | 2026-03-06 --- 昨天 HN 前排挂了一篇文章,321 条评论,讨论度是同期新闻的好几倍。 不是什么新融资、新公司。是 OpenAI 发了个新模型:G…
阅读全文 → -
NO.0182026-03-06
长文 · Essay
Dario Amodei 公开指责 OpenAI 在军事 AI 合同上撒谎,两大 AI 公司的价值观分裂从背后走到台前
作者:随机比特 --- Dario Amodei 在一封内部信里用了三个英文单词。 "Straight up lies." 直接翻译:彻头彻尾的谎言。 这句话的对象,是 Sam Altman 和 Op…
阅读全文 → -
NO.0172026-03-06
长文 · Essay
Cursor Automations 让 IDE 变成常驻 Agent 平台,这是从工具到平台的品类跃迁。
> 来源:Cursor 官方博客 · 2026-03-06 --- 想象这样一个场景。 周五下午五点,你 push 了一段代码到 main 分支,关电脑下班。凌晨两点,有人发现这段代码里有个 SQL …
阅读全文 → -
NO.0162026-03-06
长文 · Essay
一个精心构造的 GitHub Issue 标题,触发 AI 机器人一步步盗取凭证,最终在 4000 台开发者电脑上装了另一个 AI 工具。
> 来源:grith.ai · Clinejection: when your AI tool installs another | HN 203pts · 47 comments --- 2026年…
阅读全文 → -
NO.0152026-03-06
长文 · Essay
AI写代码到底是在帮程序员,还是在动他们的饭碗?Anthropic 拿出了第一批真实数据。
上周 Anthropic 发了一篇研究报告。大多数人没注意,Hacker News 上却吵了 331 条评论。 这篇研究做了一件大家一直想做但没人真的做的事:用新的测量方法,实测 AI 到底在对哪些工…
阅读全文 → -
NO.0142026-03-05
长文 · Essay
Qwen 核心技术团队集体出走,中文开源 LLM 最大生态支柱正在动摇。
> 本文约 1,950 字 | 阅读约 6 分钟 --- 社区里有人这样形容这件事: "Qwen 没有这些人就什么都不是。" 这句话是在 Justin Lin 宣布离职之后说的。Justin 是 Qw…
阅读全文 → -
NO.0132026-03-05
长文 · Essay
GPT-5.3 Instant 本次更新的核心是把 ChatGPT "爱说教"的毛病改掉了——减少不必要的拒绝和免责声明,幻觉同步降低 26.8%。
你有没有碰到过这种情况: 让 ChatGPT 帮你写个邮件,它先来一段"请注意,以下内容仅供参考,如涉及敏感话题,建议寻求专业帮助……"? 或者你只是让它帮你改个代码,它先讲了三句"虽然这段代码可以运…
阅读全文 → -
NO.0122026-03-05
长文 · Essay
Anthropic 营收逼近 OpenAI,Dario 公开指控 OpenAI 军事合作"撒谎"——AI 巨头之间的信任战已经打响。
"Straight up lies"——直接了当的谎言。 这句话不是网友评论,是 Anthropic CEO Dario Amodei 对 OpenAI 军事合作声明的公开回应。CEO 级别的互撕,在…
阅读全文 → -
NO.0112026-03-05
长文 · Essay
AI 幻觉比你想的更危险——不是模型在骗你,是你太想相信它。
前几天 Reddit 上发生了一件挺讽刺的事。 有人发了张照片,说用 Qwen3.5 4B 这个小模型就能准确识别出图片里的建筑。帖子很快拿到 300 多个赞,评论区一片"太强了""小模型也能这么准"…
阅读全文 → -
NO.0102026-03-05
长文 · Essay
用好 AI agent 的关键不是工具多,而是 context 管理精准。
你有没有过这种感觉—— 装了 10 个插件,写了一堆 prompt 规则,agent 反而越来越不听话,越来越容易跑偏? 我有。而且我以为是自己配置没做好。 最近 X 上一篇帖子让我想明白了一件事。@…
阅读全文 → -
NO.0092026-03-05
长文 · Essay
我给 AI 编码团队加了"工种认知"
今天 GitHub 热榜第一是个叫 agency-agents 的项目,作者把迭代了几个月的 55 个 AI Agent 人格文件全部开源了。 前端工程师、后端架构师、UX 研究员、TikTok 策划…
阅读全文 → -
NO.0082026-03-04
长文 · Essay
vibe coding 时代,你的代码谁来把关安全?Shannon 让 AI 自动扮演黑客来找漏洞。
你用 AI 三天搭了个 Web 应用,功能跑通了,设计也不错。准备上线。 但你知道它安不安全吗? 说实话,大多数人不知道。也没空去知道。 --- 现在有多少代码是 AI 写的? Google 和微软都…
阅读全文 → -
NO.0072026-03-04
长文 · Essay
GPT-5.3 Instant 正式发布:OpenAI 把最新版 ChatGPT 背后的模型推向 API,但它不是给开发者的主力模型。
> 来源:OpenAI 官方模型文档 developers.openai.com/api/docs/models,2026-03-04 --- 昨天,OpenAI 悄悄上线了 GPT-5.3 Inst…
阅读全文 → -
NO.0062026-03-03
长文 · Essay
Qwen 3.5 小模型发布,35B 参数打败 120B 模型,本地部署进入新时代
有人在 Reddit 上分享了一个有意思的发现:他把日常用的 120B 参数模型换成了 35B 的 Qwen 3.5-35B-A3B,结果性能反而更好了。 体积只有原来的 1/3,速度更快,效果更好。…
阅读全文 → -
NO.0052026-03-02
长文 · Essay
冰河靠一个 Claude Skill 在推特拿到 37 万浏览和 2940 收藏——拆解他的 Skill 架构,你也能复制这套"卖铲子"的生意。
一个推特帖子,37 万人看了,3000 人收藏。 卖的不是课程,不是社群入口,不是什么"日赚 XXX"的教程——是一个文件夹。 准确地说,是一个 Claude Code 的 Skill:输入 7 个指…
阅读全文 →