工具大全
AI 教程作者:Coocon2026年8月7日145 次阅读约 8 分钟阅读

Dario Amodei:我从未要求禁开源模型

Anthropic 从未主张禁开源?Dario 亲自下场回应的 10 个要点

"Anthropic has never advocated for a ban on open-weights models." —— Dario Amodei,2026 年 7 月 27 日。加粗是他自己加的。

起因是 Axios 的一则报道:美国官员在考虑禁止美国公司使用中国的开放权重模型。7 月 25 日,英伟达、微软、Meta、Palantir、Hugging Face、Mistral 等一长串公司联名发信,反对"过早设限",黄仁勋用他人生中第一条 X 帖子把这封信转了出去。

OpenAI 在信发布之后补签了。Anthropic 没签。

于是传言开始发酵:Anthropic 想禁开源,为的是保住自己的闭源生意。7 月 27 日,Dario Amodei 在官网发了一篇不长的博客回应。以下是从原文里拆出来的 10 个要点。


1. 先把话说死:从来没主张过禁令

"任何读过我过去文字的人都该知道,我不认为这种禁令是有用的手段。但让我说清楚,免得有任何疑问:Anthropic 从未主张禁止开放权重模型。"

这是全文第一段的收尾。加粗是他自己加的,TechCrunch 在报道里特意注明了这一点("emphasis his own")。

一个 CEO 需要在自家官网上加粗一句"我们从来没有主张过 X",本身就说明 X 这个指控已经传得够广了。

My take: 这不是澄清,是灭火。真正的信息量不在这句话里,而在于它为什么必须被说出来 —— 当整个行业都默认你是那个想关门的人,你的其他所有主张都会被重新解读一遍。


2. 无危险能力的开放权重模型,是公共品

"不具备危险能力的开放权重模型是一种公共品:除了运行它们所需的算力之外不产生任何成本,并且它们为企业、开发者和研究人员创造价值。"

这句给整篇博客定了调 —— 他不是在反对开源,他是在给开源划一条能力线。线以下的,公共品;线以上的,另说。

My take: "public good"(公共品)是个经济学术语,不是客套话。他在承认一件事:开放权重模型的社会收益是真实的、可计量的。这让他后面所有的限制主张都必须是精准的,不能一刀切 —— 因为一刀切要连公共品一起砍掉。


3. 禁令解决不了他真正担心的问题

"保护主义式的禁令无法解决我最严重的国家安全担忧。"

这是整篇文章的论证支点。他不从"开源好不好"入手,而从"禁令有没有用"入手。

My take: 这个转向很聪明。争论"开源是好是坏"永远没有结论,因为双方价值观不同。但争论"这项政策能不能达到它宣称的目标"是可以验证的。他把一场意识形态之争,拽回到了工具有效性之争。


4. 噩梦一:威权政府拿到更强的模型

"我的首要担忧是,威权政府 —— 不只是中国共产党,尽管中共显然是最有能力的那个威胁 —— 造出比美国更强的 AI 模型,并用它们来实现永久性的军事优势,或者对本国人民实施极其深度的压制。"

紧跟着一句很关键:这些模型是不是以开放权重发布,无关紧要

"事实上,最危险的模型可能是那种秘密训练、只交给解放军用于无人机、只交给国安部用于监控与压制的模型。"

My take: 这是全文逻辑最硬的一处。如果你真正怕的是国家级军事应用,那开放权重恰恰是你最不该怕的形态 —— 公开的东西是可见的、可评估的、可被对手研究的。真正让人睡不着的是那些永远不会公开发布的模型。在这个威胁模型下,禁开源不仅无效,方向都是反的。


5. 噩梦二:网络攻击和生物攻击

"开放权重模型 —— 无论来自中国还是其他任何地方 —— 确实可能比闭源模型带来更高的风险,因为很难对它们施加护栏或监控其使用,而且权重一旦发布就无法收回。"

这是他对开源阵营的正面回击:不可撤回性是开放权重的结构性特征,不是靠治理能补上的漏洞。

但紧接着他自己把禁令这条路堵死了:

"但禁止美国企业使用这些模型对此毫无帮助,因为坏人不太可能是合法的美国企业。"

My take: "坏人不太可能是合法的美国企业" —— 一句话就把整个禁令提案打穿了。你要防的对象根本不在禁令的管辖范围内。禁令唯一能真正约束的,是那些老老实实遵守美国法律的公司。


6. 最坦白的一句:禁令确实能保护美国 AI 公司

"它确实会保护美国 AI 公司免于竞争,但那从来不是我的目标。"

原文里 "would" 是斜体,他自己强调的。

这句值得反复读。他没有否认禁令对 Anthropic 有商业好处 —— 他承认了,然后说那不是他的动机。

My take: 承认利益冲突存在,比声称自己没有利益冲突可信得多。但这也是一句无法被验证的话:动机不可证伪。他能给出的最强证明不是这句声明,而是后面那三条措施 —— 看它们到底指向威胁,还是指向竞争对手。


7. 措施一:芯片。别卖,还要堵走私

"我们不应该向中国出售强大的芯片或芯片制造设备,我们应该打击猖獗的走私和绕道行为。"

理由是 scaling laws:中国本土产能有限,没有美国芯片就造不出比美国更强的模型。他说这是"阻断威胁一最高效、最直接的方式",顺带也间接缓解威胁二。

My take: 这是三条里唯一一条已经是既定美国政策的。他把它排第一,等于在说:真正的杠杆在硬件层,不在模型发布方式上。如果你同意他的威胁模型,这条的优先级确实远高于禁用某几个中国模型。


8. 措施二:打击工业级蒸馏

"蒸馏不能让中共获得等同或超越美国的 AI 能力,但它能把中国的前沿拉到距离美国前沿几个月之内。"

他明确切割了蒸馏和开源这两件事:

"确实,许多进行这类操作的公司会发布开放权重模型 —— 但开放权重远不如另一个事实重要:这些操作背后是一个试图在前沿超越美国的威权国家。全面禁止开放权重模型既不是正确的补救措施,也不是我们呼吁过的东西。"

背景补一句:上个月 Anthropic 向美国参议院银行委员会递了一封信,指控阿里巴巴(Qwen 系列的开发者)对其实施了"迄今已知最大规模的蒸馏攻击"。

My take: 这是他最有资格发言、也最难摆脱利益嫌疑的一条 —— 被蒸馏的是他自己的模型,起诉书也是他自己递的。有意思的是,联名信里其实也写了蒸馏问题应该用"针对性的法律和商业框架"解决,而 Dario 明确说他同意这句。双方在这点上是一致的,分歧不在要不要管蒸馏,而在要不要因此动开源。


9. 措施三:强制安全测试,不分开闭源,不分国别

"所有足够强大的模型,无论开源还是闭源,都应该通过强制性的安全测试。"

细节值得注意:按能力分级,明确豁免创业公司和学术界的低能力模型;不看原产国;他还提到 Demis Hassabis 的行业提案与此接近,以及特朗普政府近几个月在往这个方向走。

最后一句最大胆:

"要有效,测试必须是全球性的,这意味着连中共也需要参与进来。我认为这实际上可能是可行的。"

My take: 这条才是他真正的主张,前两条更像是通往它的铺垫。而且它比禁令严格得多 —— 禁令只管中国模型,强制测试连 Claude 自己都得测。这也是三条里唯一一条会给 Anthropic 增加成本的。想判断他的动机,看这条比看第 6 条的声明有用。


10. 他和联名信的真正分歧:开源到底利攻还是利守

"但我不同意信中的这些断言:开放权重必然让安全防护更容易开发,或者能力的广泛可及必然对防守方比对进攻方更有利。在我看来,相反的情况至少同样可能。"

他举了生物学的例子:足够强的模型可能用广泛可得的材料快速武器化大流行级别的病毒,而防御是一项以年计的工程任务 —— 他直接点名 Operation Warp Speed(新冠疫苗计划)作参照,那还是最好的情况。

结论是一句方法论:

"这类问题应该通过严格的发布前测试来实证回答,而不是提前假定。"

My take: 这是整场争论里唯一一个真正的技术分歧,其余大部分是站位问题。开源阵营的核心论证是"公开更安全",这在软件安全领域被验证了几十年。Dario 的反驳是:生物领域可能不适用,因为造病毒和造疫苗的时间成本差着数量级。

他没说自己一定对,他说这事该用数据回答。这是全文最有建设性的一句。


一点总结

把整件事压缩成一句话:Dario 反对的不是开源,是把"发布方式"当成风险的分类轴。

他那三条主张 —— 卡芯片、打蒸馏、强制测试 —— 分类轴全是能力和来源,不是开闭源。从这个角度看,他和联名信的重叠部分比对立部分多。

但站位本身也是表态。这封信 Anthropic 没签,OpenAI 补签了。这种时候,不签名比签名更需要解释 —— 两天后的这篇博客,就是那份解释。

值得记的是第 9 条:他主张的强制安全测试会同样落在 Claude 头上。政策主张里,唯一可信的信号是那些会伤到自己的部分。


原文:Our position on open-weights models,Dario Amodei,2026 年 7 月 27 日(7 月 28 日更新了 modular training 研究合作方的注记)。 背景报道:TechCrunch / CNBC。引文为中译,以英文原文为准。

相关文章

码农早餐 · 2026-09-21

今日头菜:ChatGPT 的广告 Cookie 跨站追踪:936 个追踪像素、1029 个域名。另有 7 条快讯:AI Studio 删数据只删本地指针,举报者 60 秒被封号;Mac M4 离线跑 Laya:CoreML 每秒约 45 次决策;等。

daily-intel2026年9月21日13 min
29

DeepSeek 标称 1M、Claude Code 只认 200K:两个都测了,真正卡住你的是第三个数

DeepSeek 标称 1M 上下文,而 Claude Code 接上去之后对同一个模型报告 contextWindow 200000。我把两边都测了。DeepSeek 的真实上限是 1,048,576——字面的 2 的 20 次方,不是一百万整——而且这个额度**含**你的 max_tokens 输出预算,用一组对照实验坐实。针插在第 0 位、上下文 1,039,744 token 时仍被准确捞出。Claude Code 则在远低于此处就本地拒绝,25 毫秒、零 API 调用,而且它卡的**根本不是 token**:闸门在约 48 万字符。喂高熵文本,478,000 字符顺利通过、真实 token 高达 309,567——比它刚刚自称的 20 万窗口还多 55%。而日常使用里这三个数你一个都碰不到,因为 Bash 输出超过整 30,000 字符就压根不进上下文。

claude-code长上下文+5
hands-on2026年9月20日6 min
26

拿 DeepSeek 当 Claude Code 后端:功能全通,但成本显示虚高 38 倍

DeepSeek 提供 Anthropic 格式端点,三个环境变量就能让 Claude Code 转去调它。我在真机上把整条链跑了一遍:本地工具(Read / Write / Bash / Glob / Edit / 子代理)全部正常且副作用真实发生,所以结论是能用。但没人测过的那部分是——Claude Code 按 Claude Sonnet 的价目给 DeepSeek 的 token 计费。十次相同调用,Claude Code 报告花了 $1.71,DeepSeek 账户实际只扣了 ¥0.32(≈$0.045),虚高 38 倍,这是余额差不是价目表推算。另外:官方文档关于未知模型名的说法是错的(会 400 而不是回落),v4-pro 默认返回 thinking 块导致小 max_tokens 看起来是空响应,以及一个看着像 DeepSeek 的锅其实不是的失败。

claude-codedeepseek+5
hands-on2026年9月20日7 min
35

码农早餐 · 2026-09-20

今日头菜:Gemini 猜密码进了三家系统,测试跑出了边界。另有 7 条快讯:Stagehand 称 Playwright 提速 2 倍、token 省 80%;593 次跑测:多设备 CoW 文件系统在常规基准外的表现;等。

daily-intel2026年9月20日9 min
52