⚖️ 产业立场 · 开放权重辩论

黄仁勋 X 首帖分享开放权重联名信,七大 AI 公司联署唯独 Anthropic 缺席

黄仁勋开通个人 X 账号后的第一篇帖子没有介绍新 GPU,而是分享了一封支持"开放权重模型"的联名信。NVIDIA、Google、OpenAI、Meta、Microsoft、Mistral、Hugging Face 七家出现在联署名单中,Anthropic 是唯一缺席方——一场关于"模型权重该不该公开"的长期分歧,由此被推到了台前。

来源:公开报道 全文约 4 分钟读完
#开放权重 #NVIDIA #Anthropic #AI 治理
7 家 联署方:NVIDIA / Google / OpenAI / Meta / Microsoft / Mistral / Hugging Face
1 家 缺席方:Anthropic,未正式解释原因
0 条 官方回应,仅研究员个人发言

⚡ 30 秒速览

  • 发生了什么:黄仁勋 X 首帖分享开放权重联名信,七家 AI 公司联署,Anthropic 缺席引发开发者社区讨伐。
  • 联名信主张:不是"所有大模型都必须公开",而是希望开放权重继续作为一种正常的模型发布方式存在。
  • Anthropic 回应:研究员 Julian Schrittwieser 反问"CUDA、Windows 何时开放",被指偷换概念——网友列出 NVIDIA 已开源 NCCL/CUTLASS/TensorRT-LLM,Microsoft 已开源 .NET/TypeScript/ONNX Runtime/DeepSpeed。
  • 深层分歧:不是开放 vs 封闭,而是"前沿模型发布前评测,能否支撑权重被长期交给外部使用"。
  • 关键落差:Anthropic 安全设计依赖服务器端持续控制;权重公开后,分类器可被移除、提示词可被修改、微调可削弱拒绝行为。

01联署名单与缺席方 七家在列,一家缺席

联名信由 NVIDIA 主导发起,核心主张是:经过评测、能力和风险相对清楚的模型,可以考虑把权重交给外部使用——并非所有模型都必须留在原厂服务器里。

NVIDIA Google OpenAI Meta Microsoft Mistral Hugging Face Anthropic ✗ 缺席

注:联署方中 OpenAI、Google 等仍以 API 为主要商业模式,但支持开放权重作为一种发布方式继续存在;缺席不等于反对,Anthropic 未正式表态。

02冲突现场 Julian 的"阴阳" vs 工程师的清单

Anthropic 研究员 Julian Schrittwieser 在 X 发了几条回应,没有否定开放模型的作用,但反问 NVIDIA 和 Microsoft 何时开放自家核心产品:

Julian 的反问

既然 NVIDIA 强调开放,CUDA 和 GPU 驱动什么时候开放?Microsoft 也支持开放权重,那么 Windows 和 Office 又该怎么看?

"我并不主张限制开放权重。"

工程师 Atharva 的反击

列出这两家公司已开放的项目,并指出 Anthropic 自身的开放边界:

NVIDIA 已开源
NCCL CUTLASS TensorRT-LLM
Microsoft 已开源
.NET TypeScript ONNX Runtime DeepSpeed
Anthropic 的边界
MCP(开放协议) Claude 权重 ✗ Claude Code 仓库公开但无常见开源许可证

网友抓住的另一个落差:Julian 此刻声称不反对开放权重,与 Anthropic 管理层此前反复释放的谨慎态度并不完全一致。Reddit 上的批评更尖锐——有人认为 Anthropic 正在快速消耗开发者社区的好感,"亲手毁掉过去积累的开发者信任"。

03联名信到底支持什么 不是"全公开",是"作为一种方式存在"

这封信支持的并不是"所有大模型都必须公开",而是希望开放权重继续作为一种正常的模型发布方式存在。理解这一点,才能看懂为什么 OpenAI、Google 这些以 API 为主的公司也愿意签。

API 模式

开发者把请求发给模型公司,接收返回结果。背后运行哪个版本、用什么推理参数、有没有更新安全规则,外部通常难以确认。

开放权重

开发者拿到训练完成的参数文件,可部署在自己服务器上,继续量化(降显存)、微调(适应特定任务)、蒸馏(把大模型能力转移到小模型),并固定版本反复测试。

联署方认可的判断是:并非所有模型都必须留在原厂服务器里。经过评测、能力和风险相对清楚的模型,可以考虑把权重交给外部使用——这也解释了为什么 OpenAI、Google 仍可参与:它们可以继续保留前沿模型,同时支持其他模型以开放权重方式发布。

04为什么这些公司愿意签 三个技术判断

名单中的公司愿意支持开放权重,背后大致有三个技术判断:

1

开放与否,按能力评估而非只看"是否公开"

一个主要用于文本整理的小模型,和一个能执行复杂网络操作、调用工具并连续完成任务的模型,风险显然不同。发布前可测试模型在网络攻击、生物知识、自动执行和绕过安全限制等方面的能力,再决定是否公开权重。

2

很多问题,只有拿到权重才能研究清楚

通过 API 测试时,模型表现变化可能是权重更新,也可能是系统提示词、分类器或推理配置变化,外部难以分开。拿到权重后,可固定版本测试:经过少量微调后是否还会拒绝某类请求?降到 4 位精度后安全行为是否变化?多个模型合并后原限制是否仍在?

3

模型权重和安全系统可以分开部署

模型负责生成内容,输入检查、输出过滤、工具权限和异常监测可以放在模型外面。权重公开后,部署者仍可增加分类器、限制模型能访问哪些文件和工具、记录异常调用。

05Anthropic 的核心顾虑 安全系统能否在权重公开后保留

Anthropic 没有正式解释为什么缺席,不能把 Julian 的个人回应当作公司结论。但从 Claude 现有的安全设计看,它的顾虑集中在一个问题上:模型离开原厂服务器后,原来的安全措施还能保留多少。

Claude 的安全并不只靠训练时形成的拒绝行为。Anthropic 还在服务器上做了这些事:

输入检查
在请求进入模型前识别异常请求
输出过滤
对模型生成内容做分类与拦截
工具权限
限制账户调用范围与频次
异常监测
发现新问题后更新分类器或替换模型版本
权重公开后
外部部署者可移除分类器、修改系统提示词、继续微调。Anthropic 无法掌握这些副本后来处理了什么请求,也难以要求所有使用者安装新的安全更新。

更麻烦的是:安全训练通常只是控制模型"什么情况下回答",并不代表相关知识已从参数中消失。使用者拿到权重后,后续微调可能削弱原来的拒绝行为。模型发布时通过安全测试,不一定意味着修改后的版本还会保持相同表现。

在线 API 出问题后原厂可统一更新;已公开的权重却很难召回。早期版本、量化版本、微调版本可能长期存在,原开发者无法确认它们是否保留了原来的防护。

这可能是 Anthropic 与名单中多数公司较核心的技术差异。联署方倾向于"先筛选适合开放的模型,再由外部部署者配置过滤、权限和监测";Anthropic 则更重视原厂对前沿模型的持续控制

MCP 可以开放、Claude 权重却不开放,也可以从这里理解:MCP 规定的是模型如何连接工具和数据,公开协议不会同时交出 Claude 的模型能力;公开权重则意味着使用者可独立运行并修改模型,两者对原有安全控制的影响并不相同。

编辑视角

这封联名信由 NVIDIA 主导发起,参与方均为商业公司,立场天然偏向"开放权重应作为正常发布方式"——读者需注意,这是一份产业倡议,不是中立技术共识。Anthropic 一方仅有研究员个人发言,未见公司正式回应或第三方独立复测,所谓"前后表态不一致"目前仍属单方披露。

把情绪拿掉,这场讨论其实存在错位:Julian 把 CUDA、Windows 和 MCP 拉进来比较,恰好说明"开放"不是一个统一开关——权重、协议、运行环境、应用代码,公开后带来的影响并不相同,放在一起直接比较只会越说越乱。

双方需要回答的其实是同一个技术问题:发布前的评测,是否足以支持一份模型权重被长期交给外部使用——这个问题的答案,将决定未来前沿模型治理的基本形态。

延伸阅读

联名信全文 PDF 与黄仁勋 X 原帖已公开,可自行查阅原始文本。

联名信全文 PDF