黄仁勋 X 首帖分享开放权重联名信,七大 AI 公司联署唯独 Anthropic 缺席
黄仁勋开通个人 X 账号后的第一篇帖子没有介绍新 GPU,而是分享了一封支持"开放权重模型"的联名信。NVIDIA、Google、OpenAI、Meta、Microsoft、Mistral、Hugging Face 七家出现在联署名单中,Anthropic 是唯一缺席方——一场关于"模型权重该不该公开"的长期分歧,由此被推到了台前。
黄仁勋开通个人 X 账号后的第一篇帖子没有介绍新 GPU,而是分享了一封支持"开放权重模型"的联名信。NVIDIA、Google、OpenAI、Meta、Microsoft、Mistral、Hugging Face 七家出现在联署名单中,Anthropic 是唯一缺席方——一场关于"模型权重该不该公开"的长期分歧,由此被推到了台前。
联名信由 NVIDIA 主导发起,核心主张是:经过评测、能力和风险相对清楚的模型,可以考虑把权重交给外部使用——并非所有模型都必须留在原厂服务器里。
注:联署方中 OpenAI、Google 等仍以 API 为主要商业模式,但支持开放权重作为一种发布方式继续存在;缺席不等于反对,Anthropic 未正式表态。
Anthropic 研究员 Julian Schrittwieser 在 X 发了几条回应,没有否定开放模型的作用,但反问 NVIDIA 和 Microsoft 何时开放自家核心产品:
既然 NVIDIA 强调开放,CUDA 和 GPU 驱动什么时候开放?Microsoft 也支持开放权重,那么 Windows 和 Office 又该怎么看?
列出这两家公司已开放的项目,并指出 Anthropic 自身的开放边界:
网友抓住的另一个落差:Julian 此刻声称不反对开放权重,与 Anthropic 管理层此前反复释放的谨慎态度并不完全一致。Reddit 上的批评更尖锐——有人认为 Anthropic 正在快速消耗开发者社区的好感,"亲手毁掉过去积累的开发者信任"。
这封信支持的并不是"所有大模型都必须公开",而是希望开放权重继续作为一种正常的模型发布方式存在。理解这一点,才能看懂为什么 OpenAI、Google 这些以 API 为主的公司也愿意签。
开发者把请求发给模型公司,接收返回结果。背后运行哪个版本、用什么推理参数、有没有更新安全规则,外部通常难以确认。
开发者拿到训练完成的参数文件,可部署在自己服务器上,继续量化(降显存)、微调(适应特定任务)、蒸馏(把大模型能力转移到小模型),并固定版本反复测试。
联署方认可的判断是:并非所有模型都必须留在原厂服务器里。经过评测、能力和风险相对清楚的模型,可以考虑把权重交给外部使用——这也解释了为什么 OpenAI、Google 仍可参与:它们可以继续保留前沿模型,同时支持其他模型以开放权重方式发布。
名单中的公司愿意支持开放权重,背后大致有三个技术判断:
一个主要用于文本整理的小模型,和一个能执行复杂网络操作、调用工具并连续完成任务的模型,风险显然不同。发布前可测试模型在网络攻击、生物知识、自动执行和绕过安全限制等方面的能力,再决定是否公开权重。
通过 API 测试时,模型表现变化可能是权重更新,也可能是系统提示词、分类器或推理配置变化,外部难以分开。拿到权重后,可固定版本测试:经过少量微调后是否还会拒绝某类请求?降到 4 位精度后安全行为是否变化?多个模型合并后原限制是否仍在?
模型负责生成内容,输入检查、输出过滤、工具权限和异常监测可以放在模型外面。权重公开后,部署者仍可增加分类器、限制模型能访问哪些文件和工具、记录异常调用。
Anthropic 没有正式解释为什么缺席,不能把 Julian 的个人回应当作公司结论。但从 Claude 现有的安全设计看,它的顾虑集中在一个问题上:模型离开原厂服务器后,原来的安全措施还能保留多少。
Claude 的安全并不只靠训练时形成的拒绝行为。Anthropic 还在服务器上做了这些事:
更麻烦的是:安全训练通常只是控制模型"什么情况下回答",并不代表相关知识已从参数中消失。使用者拿到权重后,后续微调可能削弱原来的拒绝行为。模型发布时通过安全测试,不一定意味着修改后的版本还会保持相同表现。
在线 API 出问题后原厂可统一更新;已公开的权重却很难召回。早期版本、量化版本、微调版本可能长期存在,原开发者无法确认它们是否保留了原来的防护。
这可能是 Anthropic 与名单中多数公司较核心的技术差异。联署方倾向于"先筛选适合开放的模型,再由外部部署者配置过滤、权限和监测";Anthropic 则更重视原厂对前沿模型的持续控制。
MCP 可以开放、Claude 权重却不开放,也可以从这里理解:MCP 规定的是模型如何连接工具和数据,公开协议不会同时交出 Claude 的模型能力;公开权重则意味着使用者可独立运行并修改模型,两者对原有安全控制的影响并不相同。
这封联名信由 NVIDIA 主导发起,参与方均为商业公司,立场天然偏向"开放权重应作为正常发布方式"——读者需注意,这是一份产业倡议,不是中立技术共识。Anthropic 一方仅有研究员个人发言,未见公司正式回应或第三方独立复测,所谓"前后表态不一致"目前仍属单方披露。
把情绪拿掉,这场讨论其实存在错位:Julian 把 CUDA、Windows 和 MCP 拉进来比较,恰好说明"开放"不是一个统一开关——权重、协议、运行环境、应用代码,公开后带来的影响并不相同,放在一起直接比较只会越说越乱。
联名信全文 PDF 与黄仁勋 X 原帖已公开,可自行查阅原始文本。
联名信全文 PDF →