码农早餐 · 2026-09-22
今日头菜:测试量翻四倍,PR 等待只从 6 分钟降到 5 分钟。另有 7 条快讯:沙箱不是黑魔法:先想清楚要关住谁;MCP 被质疑那天,五篇唱衰 AI 的文章同时上榜;等。
Linear 的测试套件比年初涨了近四倍,PR 在 CI 上的等待却只从 6 分多降到 5 分出头,每个测试的 runner 时间砍掉约一半。我的判断是:这活儿真正的收益不在那 1 分钟,而在换掉 GitHub Actions、换 tsgo、把 lint 改成纯 AST 这几步省下的 runner 账单。
测试量翻四倍,PR 等待只从 6 分钟降到 5 分钟
Linear 的 CTO 给工程师派了个 issue,标题就一句「CI 成本太高」,顺手还要求把 CI 做快。原因很实在:Agent 让写代码快了一个量级,验证没跟上,每个 PR 还是得排队过 CI,于是 CI 成了瓶颈,基础设施账单涨,人和 Agent 一起干等。他们盯两个指标——PR 在 CI 上等多久、吃掉多少 runner 时间。结果是测试套件比年初涨了近四倍,等待时间从 6 分多降到 5 分出头,每个测试的 runner 时间砍掉约一半。做法有四类:换掉 GitHub Actions 用第三方 runner(同口径对比平均快 34%,tsc 快 52%)、换 tsgo 让类型检查周中位数降 73%、把依赖类型信息的 lint 规则改写成纯 AST 静态分析(API lint 时间降 68%,全仓 lint 降 55%),以及减少重复 setup。如果你也在被 CI 拖住,先看哪一步在 gate 其他任务,再谈优化。

来源:
沙箱不是黑魔法:先想清楚要关住谁
这篇讲软件沙箱基础的文章,开篇就承认这块地基本没地图:实现沙箱要用的零件散落各处,先行者还没攒出一张能指引新水手的「世界地图」。作者给沙箱下的定义来自 2009 年 Hack In The Box 的一次分享——以编程方式限制进程权限、不需要机器上的管理员权限、可自主降权。他特别点出,自己 2025 年的看法已经和当年那套不同,尤其是「能不能用超级用户 API」这一条。文中代码示例需要尚未发布的 Emilua 0.11,得从开发分支取最近的 commit。如果你在做插件、脚本执行或第三方代码托管,这篇值得一读;但别指望它给你一条现成的安全路线,它更像是在说:先把「要限制什么」想明白。
来源:
MCP 被质疑那天,五篇唱衰 AI 的文章同时上榜
同一天的热榜上挤着五篇不太客气的文章,标题分别指向 MCP、prompt、聊天机器人的「读心术」和 AI 泡沫。其中一篇的标题是问句:MCP 是不是从来就不是个好主意?另一篇讲「LLMentalist 效应」,把聊天机器人的说服力类比成算命先生的冷读术——用统计上通用的说法让你觉得它在针对你说话。还有一篇报道称,AI 聊天机器人在回答财务问题时「大多数时候」给出错误答案。
这几篇的共同点不是结论,是提问方式:它们都在问同一件事——我们是不是把统计上的流畅,误当成了理解。对每天要写代码的你来说,真正有操作性的只有一条:凡是让模型碰数字、碰钱、碰状态的地方,输出必须能被外部验证,别靠它自己说对不对。我判断 MCP 那篇的价值不在结论,在于它逼你想清楚这层协议到底替你省了哪一步。
来源:
- The LLMentalist Effect (2023)
- MCP was always a bad idea?
- Prompts aren't Real
- AI chatbots give wrong answers to financial queries 'most of the time'
- I stopped drinking the AI Kool-Aid
macOS 27 关不掉 Siri:删掉模型文件重启就回来
有人在 macOS 27 上找到一套绕法:先在「屏幕使用时间」里把 Siri 设为「不允许」,再进 Recovery 模式挂载 Data 卷,删掉 /System/Library/AssetsV2 下的 com_apple_MobileAsset_UAF_FM* 模型文件,重启后 Apple Intelligence 的占用确实消失。但代价很实在:mobileassetd 同时管着语音、词典、语音识别这些资源,一刀切会连带影响;而且重启后模型会被重新下载,删文件不是持久方案。对 8GB M1、256GB 硬盘的机器来说,几个 GB 不是小数目。想只关 Mac 不关 iPhone 也不行,改语言会同步到所有设备。我的看法是,系统级 AI 该给一个真正的开关,而不是让人进 Recovery 模式删文件。
来源:
Python Workers GA:边缘跑 FastAPI 不用再写 JS 胶水
Cloudflare 的 Python Workers 正式 GA,距首次推出两年。这次的关键变化是类型转换被收进 runtime 和 Python SDK:以前往 Queue 里塞一个 dict,得写 to_js({"key": "value"}, dict_converter=js.Object.fromEntries) 这种胶水,现在直接 self.env.QUEUE.send({"key": "value"})。FastAPI、Django、Flask 都能跑,底层是 Wasm 编译的 Pyodide 解释器。代价也明摆着:Pyodide 意味着冷启动和包体积都要重新算账,别拿它跟原生 CPython 划等号。先看原理再评价,这活儿值不值,取决于你的接口对延迟有多敏感。
来源:
M5 Ultra Mac Studio 评测:256 GB 内存跑本地 Agent
我们之前聊过 Mac 本地跑模型的基准,今天这条是换代进展:M5 Ultra Mac Studio 配 256 GB 统一内存,作者拿它和上一代 M3 Ultra(512 GB)以及一台 RTX 5090 主机对比了四天。结论是本地 Agent 终于能当主力用——他把 Qwen3.8-Flash-Next 设成了 Open Minis 和 Hermes Agent 的默认模型,长上下文和多轮循环不再越跑越慢。取舍也写得很直白:5090 靠更高的内存带宽仍有优势,但体积、发热和噪音摆在那。要提醒你的是,作者自称不是 AI 开发者,只做推理不做训练微调,所以这些数字对应的是「跑现成模型」的场景。另外同批的 M6 Mac mini 评测提到涨价 300 美元,小机器这条线的性价比得单独算。先看它在你手上的工作流里能替掉什么,再决定要不要为内存买单。
来源:
Sublime Text 4213:插件宿主从 Python 3.8 跳到 3.14
Sublime Text 发布 Build 4213,插件宿主从 Python 3.8 直接升到 3.14,同时内置的 Python 3.3 默认关闭,官方说未来版本会彻底移除。如果你有老插件跑不起来,可以设 "disable_plugin_host_3.3": false 把 3.3 重新打开,但这只是缓兵之计。另外 Windows 最低要求提到 Windows 10,macOS 最低 10.13,C# 语法高亮被重写,还加了文件图标主题和 open_terminal 命令。
来源:
Google 开源 AX:宣称每集群跑十亿个 Agent 任务
AX 是 Google 开源的 Agent 编排框架,用 task.yaml 声明式地描述任务,由它负责沙箱、挂载 workspace、隔离网络,官方称单个集群能跑到十亿级并发 Agent 会话,空闲任务被 checkpoint 后一秒内恢复。它跑在 Agent Substrate 这个 runtime 上,还带「生成式 workspace」——用一句英文描述环境,它自己装工具链。
数字先别急着信:十亿是「每集群」的并发会话上限,不是实测吞吐,原文也没给 benchmark 和延迟分布。真要看的是它把 Agent 当有状态 actor 来调度这件事本身——你写 Agent 时最烦的隔离、断点续跑、按活跃计费,它想一次解决。
来源:
如果 CI 已经在 gate 你的活,你会先动 runner 还是先动类型检查和 lint?明早 8 点见。
本期从过去 24h 的 X / Hacker News / GitHub Trending 共 65 条信息中挑出 8 条(全天逐小时采写、经事实校对后于晨间选编)。内容由 LLM 辅助生成,每条均附原始来源链接,重要决策请交叉验证。

微信扫码关注「码农早餐」
每天早 8 点推送到微信,不用记网址。关注后回复「价格」,拿大模型价格与退役时间速查表。
喜欢这篇?订阅每日推送
每天 8:00 帮你挑好 AI 圈最重要的 5-10 条,说人话、看得懂、不浪费时间。
本页内容由 LLM 自动聚合 + 解读生成,每条均有原始来源链接,建议交叉验证。