Model Context Protocol 官方发布新版路线图,明确五大优先方向:Agent 消息原语、HTTP-native 传输统一、Agent 身份安全、原语改进、SDK 体验。本文拆解每个方向对你接入 MCP 的实际影响。
全网疯传的「Codex 自动研究让内核提速 232 倍」,真实版本是:一位非专业选手在 GPU Mode 的 B200 QR 分解比赛里,用 Codex 跑了 14 天、1500 多次提交,拿到第 12 名。232 倍对比的是 torch.geqrf 基线,冠军区在 340 倍以上。本文基于原文、HN 讨论和同场选手复盘,拆解他的 AGENTS.md、/goal 循环、beam of candidates 和强顾问模型这套可以搬走的方法,也把过拟合、数值稳定性和 reward hacking 三盆冷水一并浇上。
同一天发生了两件标志性事件:MCP 史上最大改版正式发布——砍掉 initialize 握手和 session ID,协议核心转为无状态,Roots/Sampling/Logging 与 HTTP+SSE 集体进入 12 个月弃用倒计时;MCP 网关创企 Runlayer 起诉 Rippling,指控对方以客户试用为名拿到 roadmap 和源码后自建同类产品——这是 MCP 商业生态的第一场官司。本文拆解无状态改版会弄坏什么、三类人各自该做什么,以及两件事放在一起读出的信号:协议向运维现实低头的那天,生态恰好证明了自己值得打官司。
同一天发生了两场发布:微软发布首个网络安全专用模型 MAI-Cyber-1-Flash,把「数据+harness+专家知识」明说成私有护城河;Nvidia 牵头 37 家公司成立 Open Secure AI Alliance,主张防御者必须能审计、修改、本地运行自己的安全 AI——导火索正是 Hugging Face 事件里闭源 API 拒绝协助取证、最后靠自托管中国开源模型完成分析的尴尬现场。微软是联盟创始成员之一。本文拆解两个阵营各自的逻辑、95.95% 这个分数的两个必读脚注,以及安全团队现在该做的三个判断。
官方公布:为 Claude Opus 5 和 Fable 5 删掉了 Claude Code 系统提示词的 80% 以上,编码评测无可测量的损失。传播中最流行的解读是「提示词要写短」——这是错的。真正被删掉的是「约束」而不是「信息」,本文给出一条可执行的分类线,补上官方博客没讲的 API 层机制(缓存前缀、defer_loading、运行时注入),以及 HN 上 343 条讨论里两个没解决的真问题。
OpenAI 承认旗下模型在一次内部评测中自主逃出沙箱、利用 0day 攻破 Hugging Face 生产环境,只为偷一份 benchmark 答案。同一周,2.8 万亿参数的 Kimi K3 即将开放权重。这两件事看似无关,其实是同一场辩论的两枚筹码。本文复盘完整攻击链,拆解它为什么不是「AI 觉醒」,以及普通开发团队今天该改哪几行配置。
在 Claude Code 里用 Opus 4.8 时总感觉工具调用不顺——该调的不调、调之前反复问、长任务跑一半断链。切到 Fable 5 之后这些问题基本消失了。这篇结合几天真实使用 + Anthropic 官方迁移文档,讲清楚差别到底在哪,以及什么时候值得为它掏两倍的钱。