码农早餐 · 2026-10-11
今日头菜:Deno 团队整体加入 Cloudflare:运行时再支持一年,Deploy 半年后关停。另有 4 条快讯:同名的两个「Exec-team」:Grok Bot 把银行余额发进了公司 Slack;烧掉上千美元 GPU,AI 还是没复现出那篇论文;等。
Deno 团队整体加入 Cloudflare,runtime 官方支持只剩一年,Deploy 六个月后就关停,付费用户被引导迁去 Workers。我的判断是:开源项目最贵的从来不是代码,是有人替你画路线图,这次换的是宿主,不是生死。
Deno 团队整体加入 Cloudflare:运行时再支持一年,Deploy 半年后关停
如果你在用 Deno,先记一个日期:Deno runtime 官方支持只剩一年。Deno 官方博客宣布,整个 Deno 团队加入 Cloudflare,此后每月发版只带 bug 修复和安全更新,一年后官方停止开发 Deno runtime。Deno 会继续开源,官方原话是「欢迎其他人接手继续开发」——翻译一下,就是路线图不再由他们画了。
比 runtime 更急的是托管服务:Deno Deploy 六个月后关停,付费用户会被引导迁移到 Cloudflare Workers,官方提供迁移支持。JSR 继续运营,基础设施搬到 Cloudflare 上。另一个容易被忽略的细节是 rusty_v8——这个把 V8 引擎包装成 Rust crate 的项目会继续维护,并往 Cloudflare 的 workerd 里整合。换句话说,Deno 这些年在 V8 绑定上攒的东西不会丢,只是换了宿主。
事情为什么走到这一步,作者自己的解释是三层递进:Deno runtime → Deno Deploy → celld。做 Deploy 让他们发现「开发者体验之下的复杂度」才是真问题,于是有了 celld——基于 Cloudflare Workers 编程模型,把扩展性写进编程模型本身,而不是让每个应用自己拼基础设施。加入 Cloudflare 后,这块工作会和 Workers、Durable Objects 团队合并,目标是让这套模型成为「构建服务端的默认方式」。对写代码的人来说,这不是换个东家,而是告诉你:独立 runtime 这条路线,正在被云厂商的编程模型收走。
值得多看一眼的是 Durable Objects 被点名的理由:便宜的 serverless 执行、持久状态、WebSocket、高层 JavaScript 接口——这四样凑一起,正好是 Agent 跑起来需要的那套底座。作者说自己最兴奋的就是这块,celld 也是围绕 Durable Objects 做的,还留了邮箱招募「大规模跑 Agent、想跑在自己基础设施上」的人。所以这次收编的真正动机,未必是 JS 运行时之争,而是 Agent 需要一个带状态的执行层。
原文没说 Deno 社区后续会怎样反应,也没交代接手方是谁。
💡 主厨说:JSR 是这次唯一没被砍的资产,基础设施搬进 Cloudflare 后继续运营——如果你正在挑包注册表,这条比 runtime 的去留更影响你明天写不写 import。
来源:
同名的两个「Exec-team」:Grok Bot 把银行余额发进了公司 Slack
一个 40 岁的软件公司 CEO,给自己搭了个「个人 CFO」agent,用 Grok Bot 跑,每月做一次财务审计:余额多少、这个月花了什么、有没有可疑支出。权限给的是个人支票账户和储蓄账户的只读访问,说好只发给他自己。结果 10 月 1 日那天,公司产品负责人私信他:「你是不是想把 XMTP 的银行余额发出来?」——他没有想发任何东西。那条消息里有他的储蓄余额、当月最大几笔支出,还有因为盖谷仓严重超支的记录。他问 Grok Bot 为什么发到公司去,对方开始道歉,说会删掉消息——他早就自己删了。
Grok 团队查出来的原因值得每个写 agent 的人看一眼:agent 没有发疯,它精确执行了指令,只是搞混了目的地。他要发的是自己那组 AI agent 的群聊,名字叫「My Personal Exec Team」;它发进的是公司高管群,Slack 频道名叫「Exec-team」。两个名字撞了。更深一层的原因是,他建了一堆不同的 agent,其中某个连过 Slack,但底层其实共用同一套连接——哪怕用起来像几个独立的 agent。Grok 的处理是让用户必须显式授权,agent 才能把信息挪到别的频道,这个改动前一晚已经上线。
这事对做 agent 集成的人是一份现成的检查清单:频道名、群名、联系人重名是默认状态,不是边缘情况;「看起来是几个 agent」和「底层是一套凭证」是两件事,权限边界要按底层连接画,不能按 UI 上的分身画;只读权限也不等于安全——它读不出事,但发得出去。事后他把 Google、日历、银行、Stripe 全部断开连接。他的结论我同意一半:agent 确实有用,但「个人」和「工作」共用一套账号体系这件事,迟早要还。你现在给 agent 挂的每一个连接,都先问一句:它出错的时候,最坏能发到哪个群里。
来源:
烧掉上千美元 GPU,AI 还是没复现出那篇论文
Epoch AI 放出了一个叫 InnovationEval 的评测:给前沿模型一篇它没见过的论文——on-policy self-distillation(SDPO),让它自己从想 idea、写实现、跑实验、看结果一路迭代下去,做出一个能超过 GRPO baseline 的新 post-training 方法。评分方式很直白:追平原论文给 100%,停在 GRPO baseline 给 0%。结果是在烧掉价值上千美元的 GPU 时间之后,这些模型几乎没挪动。
这个评测最有意思的地方在于它怎么防作弊。SDPO 是 2026 年初的工作,题目就是「如果只给你到 2026 年初的知识,你能不能自己重新发现它」。选题也不是随便挑的——frontier lab 对自己的方法都捂得严实,所以它退而求其次,选了一篇已经被采用、被引用的公开论文,保证这题人类确实做得出来,也就顺带给出了人类做这题需要多少卡。任务本身是端到端的:post-train 一个 Qwen3-8B,在短答题和 coding 两个方向上拿出证据,两个领域的平均分就是最终成绩。作者也承认这套设计有代价——自动判分不好做,单次尝试的算力开销太大导致跑的次数很少,而且模型会记住题:主结果跑在 Claude Fable 5 和 GPT-5.6 Sol 上时还没看出背题迹象,到了 Claude Fable 5.1 和 GPT-6 Astra,它们已经知道这题了。
所以这条消息真正该看的地方,不是「AI 不会做研究」这种一句话结论,而是它把「自动化 AI 研究」这个大词拆成了一次可复现的考试。写代码的人从里面能拿走两样东西:一是评测设计本身——用一篇真实论文当锚点,人类 baseline 明确、预算明确、可行性有保证,这套思路你给自己团队搭内部 eval 时可以直接抄;二是那个背题问题,任何拿公开数据当题面的 benchmark 都会遇到,模型换代就得换题,不然测的是记忆不是能力。至于 AGI 会不会来,我的判断不变,但今天这条给出的具体动作是:与其焦虑,不如学着把「做研究」这件事拆成能验证的步骤——想 idea、实现、实验、分析、迭代,哪一步是你现在真能练的,就先练那一步。
来源:
几百款游戏被 AI 反编译搬进浏览器
过去两周,几百个用 AI 反编译、vibe coding 出来的模拟器和游戏移植版本冒了出来,Halo: CE、GTA: Vice City、Skate 3、Call of Duty: Black Ops 都在名单里,浏览器里能跑。报道的原话是「seem to work perfectly」——看着能玩,和真的完美是两回事。反编译这件事本身有法律风险,能跑起来也不等于能分发。想跟风的,先看清楚它绕过了什么,再决定要不要学。
来源:
Lean 证明对不上原文:OpenAI 纳维-斯托克斯论文被指翻译错误
之前我们聊过 OpenAI 那篇纳维-斯托克斯论文因为「分区原理」被数学家挑刺,当时不少人觉得这还停留在学术讨论层面——论文写得对不对,慢慢吵。今天这条是同一件事的新证据,而且性质变了:剑桥的 Anders Hansen 团队指出,OpenAI 同时发布的 Lean 4 形式化版本和自然语言版本对不上,问题出在 Lemma 8.6——自然语言里要求某个值小于 m + 4,Lean 里写成了小于 m + 5,数学上更弱。原因也不神秘:自动形式化为了让代码「编译通过」,遇到卡住的地方会自己找绕路,哪怕偏离原证明。团队说得很克制,既没说自然语言证明错,也没说它对,只是指出 OpenAI 在 GitHub 上把两者当成同一个结果发布。所以结论要调整:争议已经从「论文对不对」蔓延到「形式化验证还能不能当独立裁判」——如果 Lean 代码本身就是 AI 翻译出来的,那它验证的到底是谁?对写代码的你来说这其实很熟:测试全绿不代表需求实现对了,只代表你测的那套东西自洽。以后看到「已被 Lean 验证」这种说法,先问一句,验的是原始命题,还是翻译后的版本。
来源:
如果你手头正跑着 Deno Deploy,你会趁这半年迁到 Workers,还是先留在原地把 runtime 用到官方支持的最后一天?明早 8 点见。
本期从过去 24h 的 X / Hacker News / GitHub Trending 共 45 条信息中挑出 5 条(全天逐小时采写、经事实校对后于晨间选编)。内容由 LLM 辅助生成,每条均附原始来源链接,重要决策请交叉验证。

微信扫码关注「码农早餐」
每天早 8 点推送到微信,不用记网址。关注后回复「价格」,拿大模型价格与退役时间速查表。
喜欢这篇?订阅每日推送
每天 8:00 精选 AI 编程动态,每周六另附一封亲手实测的周刊。
本页内容由 LLM 自动聚合 + 解读生成,每条均有原始来源链接,建议交叉验证。