Anthropic CEO Dario Amodei 阐明对开放权重模型的立场
Our position on open-weights models
Anthropic CEO Dario Amodei 发文明确表示,Anthropic 从未主张封禁开放权重模型,并称不具备危险能力的开放权重模型是一种公共品。
Anthropic CEO 亲自澄清公司从未主张封禁开放权重模型,并给出芯片管制、蒸馏治理与强制安全测试三条替代路径。
Anthropic CEO Dario Amodei 的一篇文章
过去几天,关于开放权重模型的讨论很多,尤其是来自中国的模型。有报道称,一些美国官员正在考虑禁止美国公司使用中国的开放权重模型。作为回应,许多科技公司签署了一封信支持开放权重模型,一些人甚至指责 Anthropic 想要禁止开放权重模型,以此保护我们的业务。任何读过我过去文章的人都知道,我并不认为此类禁令是有用的措施,但让我明确表态,以免有任何疑问:Anthropic 从未主张禁止开放权重模型。
不具备危险能力的开放权重模型是一种公共产品:除了运行所需的算力之外,它们不花费任何成本,并且为企业、开发者和研究人员提供价值。
保护主义禁令无法解决我最严重的国家安全担忧。具体来说,我担心两种噩梦般的情景。六个月前,我在我的文章The Adolescence of Technology中阐述了这些情景1,并且多年来一直坚持这些立场:
- 我的首要担忧是,威权政府——不仅仅是中国共产党(CCP),尽管中共显然是最有能力的威胁——构建出比美国构建的 AI 模型更强大的模型,并利用它们实现永久军事优势或对自己人民实施极其深重的镇压。这种担忧在美国政府内部广泛存在:副总统 Vance 去年在巴黎警告称,“威权政权窃取并利用 AI 来增强其军事、情报和监控能力”,而情报界的2026 年度威胁评估发现,“其他全球大国在 AI 方面的强劲进展正在挑战美国的经济竞争力和国家安全优势。”这些模型是否以开放权重发布无关紧要,当然,它们是否被美国企业使用也无关紧要。事实上,最危险的模型可能是在秘密中训练、只交给中国人民解放军用于无人机、交给国家安全部用于监控和镇压的模型。
- 我的次要担忧是,强大的 AI 模型可能被滥用来实施网络攻击或生物攻击,并且可能存在严重的对齐问题。开放权重模型——无论来自中国还是其他地方——确实可能比闭源模型带来更高的风险,因为很难对它们施加护栏或监控其使用,而且一旦权重发布就无法撤回2。但禁止美国企业使用这些模型无助于解决这一风险,因为恶意行为者不太可能是合法的美国企业。这会保护美国 AI 公司免受竞争,但这从来不是我的目标。
为了解决这些担忧,我确实支持以下三项措施,我和 Anthropic 一直倡导这些措施:
- 我们不应向中国出售强大的芯片或芯片制造设备,并且应打击为获取此类芯片而猖獗进行的走私3和规避手段。中国的国内产能有限,因此,受规模定律制约,没有美国芯片就无法构建比美国更强大的模型。这是阻断威胁#1最有效、最直接的方式,而且通过阻碍训练出美国法律无法触及的模型,它也能间接帮助应对威胁#2。
- 我们应打击工业规模的蒸馏操作。蒸馏是一种比从零开始训练模型计算效率高得多的过程。它使中国能够构建出远超其芯片数量通常所能支持的更好的模型,从而部分规避芯片禁令。蒸馏并不能让中共获得与美国同等或更优的AI能力,但它可以将中国的前沿拉近到距美国前沿仅几个月的差距。诚然,开展这些操作的许多公司会发布开放权重模型——但相比这些操作由一个试图在前沿领域超越美国的威权国家支持这一事实,开放权重远没有那么重要。我们应当采取政策干预来遏制这种行为。全面禁止开放权重模型既不是正确的补救措施,也不是我们呼吁的做法4。
- 所有足够强大的模型,无论开放还是闭源,都应经过强制性安全测试。应对威胁#2的最佳方式就是在发布前直接测试模型在网络、生物和对齐方面的风险。我认为这个想法实际上已接近共识:令我感到鼓舞的是,特朗普政府近几个月已朝这个方向行动,而且近期的行业提案也主张对此类测试适用于最强大的模型,无论其原产国或开放与否(同时完全豁免能力较弱的模型,例如来自初创公司和学术界的模型)。开放模型是否会带来更大的风险,以及这种风险能否被缓解,应当通过测试得出结论,而不是事先决定——而且可能存在有前景的方法来提高开放权重模型的安全性,包括AE Studio和Anthropic近期关于模块化训练策略的研究。请注意,要想有效,测试必须是全球性的,这意味着连中共也需要参与。我认为这实际上可能是可行的:正如我在《技术的青春期》中所写,围绕防止AI生物武器的有限合作可能是可行的,因为这也符合中国的利益。
这让我想到了这封公开信。我同意其中的许多观点:开放权重扩大了人们进入人工智能经济的机会,至少在某些用例中增强了竞争,并让客户拥有更大的控制权。对蒸馏的担忧应通过有针对性的法律和商业框架来解决——也就是我上文所述的同样措施。但我不同意信中关于开放权重模型必然更容易开发安全保障措施,或广泛获取能力必然更有利于防御方而非攻击方的论断。在我看来,相反的情况至少同样可能成立。例如,我担心生物学领域会存在强烈的攻防不对称,足够强大的模型或许能够利用广泛可得的材料迅速将大流行级别的病毒武器化,而针对这些病原体的防御即便在最理想的情况下也是一项耗时多年的运营任务(正如我们在“曲速行动”中所见)5。此类问题应通过严格的发布前测试以实证方式加以回答,而不应事先假定。
总结我和Anthropic的立场:我们从未也并非主张将开放权重模型作为一个类别予以禁止。我们应转而专注于让强大芯片不落入威权者之手、阻止工业规模的蒸馏,并要求对所有足够强大的模型——无论开放还是闭源——进行安全测试。
*7月28日更新:已更新说明,所引用的模块化训练策略研究是Anthropic与AE Studio的合作成果。
相关内容
Anthropic投资1亿美元培训1万名工程师,以弥合企业AI人才缺口
Anthropic将向Claude Frontier Academy投资1亿美元,到2027年底培训1万名前沿部署工程师,来自埃森哲、贝恩、CBA、德勤、麦肯锡、摩根士丹利和诺和诺德的首批学员已经开课。
巴克莱扩大Claude应用规模,以升级运营并改善客户体验
英国全能银行巴克莱正在扩大与Anthropic的战略合作,将安全的企业级AI系统整合到其全球运营中。
Claude发现一种具有类CRISPR重复序列的新型酶系统
我们宣布在Anthropic成立一个新的生命科学研究小组和实验室。本文介绍这项工作背后的团队,并分享早期成果:在我们科学家仅提供高层级指导的情况下,Claude发现了一种特性令人联想到CRISPR的新型酶系统。
来源:Anthropic News · anthropic.com