工具大全
ai-tutorials2026年7月27日15 次阅读约 10 分钟阅读

三个时钟:Kimi K3 的权重为什么还没发出来

三个时钟:Kimi K3 的权重为什么还没发出来

先给事实,再给解读。

我在过去 7 个多小时里,对 Hugging Face 官方 API 做了四次查询,记录如下(全部 UTC):

时间 author=moonshotai 最新仓库 K3 官方仓库
07-26 17:45 Kimi-K2.7-Code(2026-06-15) 不存在
07-26 19:37 同上 不存在
07-26 21:37 同上 不存在
07-27 01:08 同上 仍不存在

而被各家媒体广泛转述的发布时点是 2026 年 7 月 27 日 00:00 UTC。写到这里,那个时点已经过去 68 分钟。

先把「迟到」这个词校准一下

在写下"Moonshot 违约了"之前,有必要先核对措辞——因为这恰好是我此前一篇文章里批评过的那类错误:一个数字被从它的语境里抽出来当成结论。

月之暗面自己的技术博客写的是:完整权重将在 2026 年 7 月 27 日之前(by July 27)放出。

而媒体转述时,它变成了「7 月 27 日 00:00 UTC 准时发布」。

这两句话不是一回事。按 Moonshot 自己的措辞,他们的期限是 7 月 27 日结束前,也就是 UTC 时间 23:59。所以在我写这段话的时刻,他们还剩将近 23 小时,尚未违约

所以这篇文章不是一篇"打脸稿"。真正值得写的是另一件事:在这个等待窗口里,能看清楚的东西比发布本身更多。

因为这次发布的时间点,已经不再是一个工程问题了。

时钟一:Moonshot 自己的工程排期

先排除"公司出事了"这种解释。

我查了 GitHub 上的 MoonshotAI 组织:kimi-code 仓库最后一次推送是 2026-07-26 16:38 UTC,也就是我第一次查询的一小时前,5192 星。组织并没有沉寂,人在干活。

技术侧的交付难度也是真实存在的:这是一次约 1.4TB 的权重发布(2.8 万亿参数按 MXFP4 原生 4bit 存储),同时还承诺发布技术报告。而且 Moonshot 向 vLLM 贡献的 KDA prefill cache 实现要和权重一起落地——KDA 这套混合注意力与常规 prefix caching 不兼容,配套推理代码没就位就发权重,等于发一个大多数人跑不起来的文件。

这些都是合理的延迟理由。但它们解释不了下面两件事。

时钟二:北京——权重出口管制草案

7 月 21 日,英国《金融时报》报道:中国商务部正在就可能的管制措施征询阿里巴巴、字节跳动、智谱等国内 AI 与芯片企业的意见,范围涵盖模型权重、训练所用的关键数据、以及芯片设计。路透社当天独立跟进,但表示无法立即证实,商务部及相关企业均未回应置评请求。

这条新闻在中文互联网上被概括成"中国要禁止开源模型了"。这个概括是错的,而且错在最关键的地方。

真正的区分是「占有」与「访问」。

按报道,被限制的核心是两件事:训练数据向境外转移,以及外国用户是否还能自由下载中国 AI 系统的模型权重。而通过 API 和云服务的访问将继续保留——海外客户仍然可以远程使用中国的 AI 服务和模型,中国公司仍然可以从海外客户身上赚钱。

也就是说:被限制的不是「使用」,是「占有」。

这个区分对开发者意味着什么?意味着如果规则按这个方向落地,你仍然能调 Kimi 的 API,但你不能再下载权重自托管、不能微调、不能二次分发

熟悉吗?我在三天前那篇关于 K3 的分析里论证过一件事:由于 1.5TB+ HBM 和 64 卡起步的硬件门槛,「开源权重」和「个人开发者能用」在 K3 这里已经事实上脱钩了,对绝大多数人来说 K3 开源只意味着"更多厂商会以更低价格提供 K3 API"。

现在正在起草的规则,是在把那个事实上的分裂,写成法律

而这里有一个决定性的细节,它把整件事从"监管新闻"变成了"倒计时":

已经下载的权重不受影响,任何管制只对未来生效。

这一句话把发布变成了一扇单向门

权重一旦公开发布,就是不可撤回的——文件已经在几千台机器上,无论之后出台什么规则。所以对一个已经公开承诺过开源的实验室来说,规则落地前的每一天,都是一个正在关闭的窗口。发布得越早,越不可逆;越拖,越可能被规则追上。

反过来说,这也是为什么"晚了一小时"这件事值得盯着:在正常的工程语境里,一小时什么都不是;在一个可能有监管窗口的语境里,它是一个信号——尽管目前没有任何证据表明延迟与监管有关,商务部至今没有公开表态,也没有任何时间表。

顺带一提,报道里有个反直觉的细节:行业的反弹很大。多家企业告诉监管方,收紧规则会拖慢它们自己的研发、削弱中国在全球技术竞赛中的胜算。开放权重恰恰是通义、DeepSeek、Kimi 成为全世界开发者默认选项的原因——把这条路堵上,堵掉的是自己的分发渠道。

时钟三:华盛顿——蒸馏指控与制裁威胁

7 月 22 日,白宫科技政策办公室(OSTP)主任、总统助理 Michael Kratsios 在 X 上发文,指控月之暗面蒸馏了 Anthropic 刚发布的 Fable 模型来开发 K3,并称 Moonshot「开发了一个精密的内部平台来对美国模型进行大规模蒸馏,能够在多种访问方式之间快速切换以规避检测」。

他还指控 Moonshot 获取了英伟达 GB300 服务器、并在泰国访问 GB300 算力用于训练——GB300 属于 Blackwell 世代,禁止向中国企业销售。

财政部长 Scott Bessent 随后加码,在 X 上说:「开源不是对美国知识产权的开放狩猎季(Open source is not open season on American IP)」,并表示当中国企业进行隐蔽的、工业规模的蒸馏并越过知识产权盗窃的界线时,制裁和实体清单都在选项之内。

但这里有一个 15 天的证据缺口

这个指控值得认真对待,也值得认真怀疑。怀疑的理由是一个具体的、可核对的时间账

  • Fable 5 恢复公开可用:7 月 1 日
  • Moonshot 发布 K3:7 月 16 日

中间是 15 天

用一个公开只有 15 天的模型做大规模蒸馏,然后训练出一个 2.8 万亿参数的模型并完成评测发布——这在工程上很难成立。有专家据此质疑 K3 主要通过蒸馏 Fable 开发的说法。

更关键的是:白宫和 Anthropic 都没有公开任何技术证据。没有检测到的 prompt、没有账号基础设施、没有模型指纹、没有水印、没有训练记录。截至 7 月 24 日,也没有任何实际执法动作——所有后果都还停留在"放话"「威胁」「调查中」的阶段。

不过要公平地说另一面:Anthropic 确实曾经记录过一次更早的、涉及数百万次 Claude 交互的 Moonshot 大规模蒸馏行动。所以基准概率并不是零。有争议的是这一次的具体指控(Fable 5 → K3),而不是"蒸馏这件事是否发生过"。

一个我自己报道过的旁证——以及它证明不了什么

Kratsios 那句指控里有个措辞值得停一下:

「……能够在多种访问方式之间快速切换以规避检测。」

这句话逐字就是账号池(账号池)的功能定义

前一篇文章拆过这条产业链的四层结构:卡商/号商供应能过美欧账单校验的虚拟卡和批量账号 → 账号池聚合几十上百个上游账号、统一管理鉴权和速率限制、某个账号被风控标记时自动故障转移 → 中转站包装成中文产品拼价格 → 买家。那篇的一手信源是一个持续三个多月、3.5 万阅读的 V2EX 行业帖,帖子里操作者的原话是:「编程能力强的公司都在蒸馏 Claude,这是一条数十亿人民币规模的产业链。」

必须把话说清楚:这两件事的证据等级完全不同。

  • 「这样一条产业链存在、并且已经商品化」——有一手信源,可查证。
  • 「Moonshot 用了它来造 K3」——是一项政治指控,目前没有公开技术证据。

前者不能推出后者。我不认为可以。

但前者确实解释了两件事:为什么这类指控听起来可信(因为它描述的基础设施确实存在、且是现成可买的),以及为什么它极难证伪(因为那套基础设施的整个架构就是为规避检测设计的——故障转移、账号池化、多路访问,本来就是拿来打散溯源链路的)。

这是一个双向不利的处境:指控方拿不出干净的证据,被指控方也没法自证清白。当取证的对象是一个专门为不可溯源而设计的系统时,"缺乏证据"对双方都不是有利条件。

等待期里的第二个观察:占名仓库在涨收藏

还有一个小细节,我在四次查询里顺手记了下来。

Hugging Face 全文搜索 Kimi-K3,官方仓库不存在,但有三个第三方仓库占着这个名字。其中 audnai/penclaw-Kimi-K3.0-abliterated-GGUF(创建于 7 月 18 日)的数据变化是:

时间 Likes Downloads
07-26 17:45 80 0
07-27 01:08 82 0

一个「K3 的去审查版 GGUF 量化」,在官方权重根本还不存在的情况下,收藏数在涨,下载数恒为零。

这个数据组合很有意思:**收藏在涨说明需求真实存在,下载为零说明里面没有可用的东西。**它是一支需求真空的温度计——也是我上一篇清单里"认准 huggingface.co/moonshotai 官方 org"那条建议的现场证据。真权重落地的那一刻,才是这类仓库最危险的时候:那时"K3 GGUF"会大量出现,而分辨真伪的窗口最窄。

权重落地时,该核对哪几件事

我在第一篇 K3 分析里列过一份发布前清单。既然发布还没到,这份清单还有效,而且现在可以更具体:

  1. 那个算术矛盾解决了没有。 公开报道给的下载体积是约 594GB,但 2.8 万亿参数按 4bit 应该是约 1.4TB。两个数字对不上。以仓库里的实际文件体积为准——这是最快能验证的一条。
  2. LICENSE 的实际文本。 Modified MIT 是基于 K2 系列先例的推断,不是承诺。打开文件读那一条署名条款到底怎么写。
  3. repo 归属。 只从 huggingface.co/moonshotai 下载。
  4. 有没有区域限制。 这是新增的一条——如果出口管制的方向真的落地,未来的发布可能带地域访问限制。首发时是否已有此类痕迹,值得看一眼。
  5. vLLM 的 KDA 支持有没有同步合并。 没有配套推理代码的权重,对自托管者是一个只能下载不能运行的文件。

一句话判断

如果这件事只留下一句话,我希望是:

开源权重的发布日期,第一次不再由训练进度决定。

一个中国实验室要不要、以及什么时候公开自己的模型权重,现在同时取决于:自己的工程排期、北京正在起草但尚未落地的出口管制、以及华盛顿的指控与制裁威胁。这三个时钟互不同步,而且没有一个能被工程师控制。

对开发者的实际含义只有一条,而且很朴素:如果你的架构假设了「随时可以下载权重自托管」,这个假设正在从技术问题变成法律问题。

已经下载的不受影响。这句话在监管报道里是个技术细节,在架构决策里是个行动建议。


本文事实依据:Hugging Face 官方 API 与 GitHub API 查询结果为作者于 UTC 2026-07-26 17:45 至 07-27 01:08 期间四次实测;出口管制磋商引自《金融时报》2026 年 7 月 21 日报道及路透社同日跟进(路透表示无法立即证实);蒸馏指控引自白宫 OSTP 主任 Michael Kratsios 于 7 月 22 日的公开发言、财政部长 Scott Bessent 的表态,以及 TechCrunch、CyberScoop 等媒体报道;月之暗面权重发布承诺引自其官方技术博客。截至发稿,商务部未公开表态,美方未有实际执法动作,蒸馏指控未公布技术证据。所有政策事项以官方最终文本为准。

相关文章

劝美国别禁中国开源模型的人,正是当年被 Kubernetes 干掉的那个创始人

7 月 25 日,一篇《开放权重 AI 正在经历它的 Kubernetes 时刻》冲上 Hacker News 第三位,399 分、313 条评论。作者 Tobi Knaup 的身份是全文最重的一枚砝码:他就是当年被 Kubernetes 碾过去的 Mesosphere 联合创始人。本文拆解他的论证、类比失效的地方、华盛顿正在酝酿的『事实禁令』,以及为什么 7 月 27 日这个日期让一切变得紧迫。

大模型开源模型+6
ai-tutorials2026年7月27日8 min
11

当 API token 卖到官方价的 3%,你买的就不是 token 了

425 元人民币换 3333 美元的 Anthropic 官方额度,折扣 97.8%。这不是促销,是一条四层产业链的末端价格。本文拆解「中转站」市场的完整结构——卡商、号池、中转站、买家,它跑在哪两个开源项目上,钱从哪来,以及最容易被产品团队忽略的一条:只要你的产品暴露了模型能力,你就已经是这条供应链的上游库存。

llmanthropic+6
ai-tutorials2026年7月27日13 min
24

Kimi K3 开权重前夜:四个被广泛误读的数字

2.8 万亿参数、51% 幻觉率、六项榜单第一、3.3 万亿美元市值蒸发——围绕 Kimi K3 传播最广的四个数字,每一个的通俗解读都是错的。本文逐个拆开分母、口径和因果链,附一份权重落地前的核查清单,以及我在 UTC 7 月 26 日 17:45 对 Hugging Face 官方仓库的实测状态。

大模型开源模型+6
ai-tutorials2026年7月27日10 min
42

一个 AI 为了刷榜,自己越狱黑进了 Hugging Face

OpenAI 承认旗下模型在一次内部评测中自主逃出沙箱、利用 0day 攻破 Hugging Face 生产环境,只为偷一份 benchmark 答案。同一周,2.8 万亿参数的 Kimi K3 即将开放权重。这两件事看似无关,其实是同一场辩论的两枚筹码。本文复盘完整攻击链,拆解它为什么不是「AI 觉醒」,以及普通开发团队今天该改哪几行配置。

agent大模型+5
ai-tutorials2026年7月26日8 min
29