码农早餐 · 2026-10-04
今日头菜:把 "think carefully" 从 CLAUDE.md 里删掉:Opus 5.5 官方技巧清单。另有 4 条快讯:Cloudflare 开源 Agent 工作台:每个应用只跑给你一个人;Gemini 停掉 Flash 与 Pro 免费额度;等。
Opus 5.5 官方指南里最反直觉的一条:把 prompt 和 CLAUDE.md 里的 "think carefully"、"think step by step" 全删掉,因为它每次回复前会自己决定想多久,你催它只是在拖慢它。我的判断是,这条不只是省几秒——它说明我们过去两年攒的那套提示词习惯,有一部分已经变成纯粹的仪式感了。
把 "think carefully" 从 CLAUDE.md 里删掉:Opus 5.5 官方技巧清单
Opus 5.5 在 9 月 22 日发布了一份官方使用指南,讲的是同一个模型在 Claude 应用和 Claude Code 里该怎么用。最反直觉的一条:官方让你把 prompt 和 CLAUDE.md 里所有 "think carefully"、"think step by step" 删掉——Opus 5.5 每次回复前都会自己决定想多久,你催它「仔细想」只是让回复变慢。官方在聊天产品里的测试结论是:删掉这行字,回复开始得更早,质量没有明显下降。
比这更值得留意的是「停止点」这件事。Opus 5.5 在长任务里会主动汇报,但有时会停下来问你「要不要继续」——一个只报下一步却不执行的总结、一个继续的邀请、一堆其实不阻塞工作的选项。官方的解法是在 CLAUDE.md 里写死规则:不需要我输入就继续跑,状态说明和下一个动作放在同一条消息里;只有在你无法独立继续、或者要执行删除数据、force-push、改动仓库外文件这类破坏性操作前才停下来问。官方还建议对破坏性命令保留权限确认。

干货部分有三条可以直接抄。第一,把整个任务一次性给出去,同时说清「完成」长什么样——比如「每个 endpoint 都用新 client、旧 client 删掉、测试全过」,以及什么时候该停下来问你。早期测试者让它跑数小时的编码任务,几乎不用盯。第二,大范围审计或迁移时,让它把每个 service 分给独立 subagent,每个 subagent 报回来后先核对证据再采纳,最后汇总成一张表。第三,长任务让它把 checklist 写进 TASKS.md 并逐项打勾——长跑会撑满 context window,Claude Code 随后会摘要旧轮次,写在文件里的清单能活下来,你读文件而不是翻滚动记录。另外,中途想起什么可以直接在它工作时打字回车追加,不用重启,因为现在一次跑得更久,重启的代价更高。
设计类需求有个细节值得单独记:光说「别做得太通用」基本没用,那只是把一个默认风格换成另一个默认风格;要列出你不想看到的具体模式,比如不要米白背景、不要标题里的斜体强调词、不要 "01 / 02 / 03" 编号、不要等宽字体标签、不要胶囊按钮。
官方指南里最值钱的一句是「删掉 think carefully」,最容易被忽略的一句是「在 CLAUDE.md 里写清楚什么时候该停下来问你」。
💡 主厨说:这份指南里最容易漏掉的是它对「破坏性操作」的划界——删数据、force-push、动仓库外的文件,这三类它建议你保留权限确认,别为了少点几次弹窗把这道闸也一起拆了。
来源:
Cloudflare 开源 Agent 工作台:每个应用只跑给你一个人
Cloudflare 把内部用了很久的 AI 工作台开源了,仓库叫 cloudflare-os,定位是「AI 生产力操作系统」。按 README 的说法,Cloudflare 内部从工程到销售的一大半人每天都在用它;现在这版是 v2,一次彻底重写,2026 年 8 月发布,官方自己给的定性是「early access」——能力已经像样,但毛边不少,它自己承认。
真正值得看的不是聊天框,是它对「应用」的重新定义。你在里面做一份幻灯片,系统不是去调某个 SaaS,而是给你单独生成一份幻灯片软件的私有实例,跑在独立沙箱里,官方管这个叫 Gadget。好处有两个:别人的幻灯片应用出安全漏洞,漏不到你头上;你想加个功能,直接让 Agent 改这份实例的代码就行,改坏了也只坏你自己这份。安全层叫 Gatekeepers,本质是加强版的 MCP server,负责 OAuth、把权限收窄到用户指定的那一个资源、记录每一次调用。里面有个设计我觉得比宣传更实在:需要人工确认的操作,Gatekeeper 先在本地模拟结果让 Agent 继续往下跑,等你方便的时候再批量批准或拒绝。这解决的是「给 Agent 派完任务去倒杯咖啡,回来发现它卡在第一步等审批」那个经典场面——于是大家干脆 --dangerously-skip-permissions,然后装作没看见。上手很便宜,装好 pnpm 跑 pnpm run-local,本地 8787 端口就能看到全貌,也可以直接部署到自己的 Cloudflare 账号。
但「操作系统」这个词用得太大了。它既不是传统 OS,也不是你公司装一套就能用的产品——官方的意思是让你抄走改成「你们公司 OS」,改造成本得自己扛。所以别急着把内部工具链往上搬,先本地跑一遍,重点看 Gatekeepers 的权限模型和沙箱边界是不是你要的;真要接自己的系统,写 Gatekeeper 的活大概率躲不掉。对写代码的人来说,它更像一份可以拆开读的参考实现:Agent 怎么被关进沙箱、副作用操作怎么异步审批,这两块比 UI 值钱。
来源:
Gemini 停掉 Flash 与 Pro 免费额度
Reddit 上有人贴出消息:Gemini 要结束 Flash 和 Pro 两个模型的免费使用。原文只有这一句,没给生效时间,也没说免费层是彻底关掉还是只收窄额度。对写代码的人来说,这事的分量取决于你有没有把 Gemini 塞进自己的工具链——脚本里调它做总结、做代码补全、做批量翻译的,都得先翻一遍 API 账单和调用量,别等哪天请求直接报错才发现。免费额度这东西从来不是承诺,是获客预算,预算花完就收,我向来按「随时会没」来规划。
来源:
System76 对 COSMIC 大部分代码库说不收 AI 生成代码
System76 给 Pop!_OS 的 COSMIC 桌面环境立了规矩:大部分代码库不接受 AI 生成的代码提交。原文只有标题和一句摘要,具体怎么界定、怎么核查都没展开。对写代码的人来说,这事有两层:一是你给这类项目提 PR 时,得先确认自己用的补全和生成算不算被禁;二是它把「AI 写的代码谁负责」这个问题摆到了台面上。用 AI 生成率考核程序员,本身就是把工具当成绩,我反对这种指标。
来源:
Greg KH 讲内核安全:LLM 时代该防什么
这是 Greg Kroah-Hartman 的一场演讲,题目是「LLM 时代的安全」,原始页面只抓到了 YouTube 的验证页,没有正文,具体讲了什么、举了哪些例子都无从确认。能确定的只有两件事:讲的人是内核稳定分支的长期维护者,讲的话题是 LLM 与安全。对天天跑内核、盯 CVE 的人来说,这个组合值得点开看一眼——内核这块的安全讨论,通常比应用层的热闹要慢半拍,但落到补丁上更实。至于结论,等看完再说,别拿标题当观点。
来源:
官方说删掉「仔细想」质量没明显下降,你信不信?我反正是打算先在自己那份 CLAUDE.md 上删一行试试。明早 8 点见。
本期从过去 24h 的 X / Hacker News / GitHub Trending 共 44 条信息中挑出 5 条(全天逐小时采写、经事实校对后于晨间选编)。内容由 LLM 辅助生成,每条均附原始来源链接,重要决策请交叉验证。

微信扫码关注「码农早餐」
每天早 8 点推送到微信,不用记网址。关注后回复「价格」,拿大模型价格与退役时间速查表。
喜欢这篇?订阅每日推送
每天 8:00 精选 AI 编程动态,每周六另附一封亲手实测的周刊。
本页内容由 LLM 自动聚合 + 解读生成,每条均有原始来源链接,建议交叉验证。