跳到正文
Anthropic News·· 2023-11-05精选AI 评分62

Anthropic 解读美国 AI 行政令、G7 行为准则与 Bletchley Park 峰会

Thoughts on the US Executive Order, G7 Code of Conduct, and Bletchley Park Summit

AI 导读

Anthropic 发文总结上周三项 AI 政策事件:美国政府发布逾 100 页的 AI 行政令,G7 推出《先进 AI 系统开发组织行为准则》,英国在 Bletchley Park 举办首届 AI 安全峰会并发布 Bletchley Declaration。

推荐理由

Anthropic 官方梳理美国行政令、G7 行为准则与 Bletchley 峰会三项政策动作,并说明其自身立场与参与方式。

正文 · AI 翻译


过去一周发生了三件AI政策大事:美国政府发布了范围广泛的AI行政命令,G7制定了国际行为准则,英国政府在布莱切利园举办了首次AI安全峰会,并产生了布莱切利宣言。在这篇文章中,我们简要总结这些事件,以及我们认为它们对AI政策意味着什么。

这份超过100页的全面行政命令(EO)涵盖了AI带来的各种风险,包括与隐私、公平性和偏见相关的影响,以及灾难性风险。它认可了AI所承诺的好处,指示政府部门通过设立首席AI官并促进其机构内的AI创新,来寻找利用该技术改善政府服务和职能的机会。

与我们此前的呼吁一致,我们欣慰地看到该行政命令指示美国国家标准与技术研究院(NIST)开展重要的新工作,例如开发模型能力和安全特性的评估,扩展安全软件开发框架以纳入前沿模型的安全开发实践,并在成功的风险管理框架基础上为生成式AI开发配套框架。

此外,该行政命令启动了国家AI研究资源(NAIRR)试点,旨在增强学术研究人员获取开展AI安全研究和开发有益应用所需的数据和算力,同时支持美国的创新。Anthropic自成立以来一直支持NAIRR(以及相关的CREATE AI法案),我们期待找到支持NAIRR试点的方式。

G7国际行为准则

通过G7广岛进程制定的开发先进AI系统的组织行为准则以白宫宣布的AI公司自愿承诺为基础。它描述了一套负责任的做法,用于在AI开发和部署生命周期中识别和缓解风险,包括通过评估、信息共享、治理方法、安全程序和透明度措施。该准则为前沿AI公司设定了重要基线,如果得到政府和公司的广泛认可,可以作为国际最佳实践和国内监管的基线。Anthropic支持G7行为准则,它将与白宫承诺一起指导我们的开发和部署实践。

AI安全峰会

英国政府在布莱切利园主办了历史性的AI安全峰会,召集了政府官员以及来自学术界、产业界和民间社会的专家,详细讨论围绕前沿AI的担忧以及可以采取的应对措施。Anthropic的首席执行官Dario Amodei发表了讲话,介绍了Anthropic的负责任扩展政策,我们希望它可以为其他前沿AI开发者提供指南,并成为潜在监管方法的原型(但至关重要的是,它不能替代监管)。

参会的28个国家发布了《布莱切利宣言》,这是一份广泛的声明,呼吁多方利益相关者采取行动,以利用该技术的益处并应对其风险,值得注意的是,签署国中包括中国和发展中国家。这些国家还同意支持对现有前沿AI能力和风险研究进行国际评估,以便向各国政府通报科学现状,并确定AI安全的优先研究领域。我们欢迎该宣言和科学研究小组,并希望它们能推动具体而持续的国际合作。

政府AI安全研究所

同样在峰会上,英国宣布其前沿AI工作组将改组为AI安全研究所——这是首个专注于评估前沿AI模型风险的重大政府举措。AI安全研究所拥有技术专家,他们已经在私下测试来自Anthropic等实验室的前沿AI模型。这是Anthropic迄今为止参与的最具技术复杂性的政府合作;我们希望会有更多类似的合作。

与此同时,美国宣布计划通过NIST的一个联盟推出英国AI安全研究所的美国对应机构,支持开发评估AI系统的方法,重点关注安全性和可信度。NIST还将制定前沿威胁红队测试指南——识别模型潜在危险的双重用途能力。(不过我们要指出,鉴于此事至关重要,找到增加NIST资金的方法将是进一步提高其在该领域办事能力的好办法)。

我们此前已概述了评估AI系统的挑战。各国政府总体上应投资于自身测量和监测AI的能力,我们对美国、英国和新加坡的努力以及欧洲的提案感到鼓舞。有效测量该技术是合理监管的基础要求。我们还认为,推进评估科学并建立可靠、独立的测试协议,将有助于创造公平的AI竞争环境,使资源较少的公司能够在相同的安全评估上与大型公司竞争,同时为政府、客户和公众提供客观信息。

结论

本周的公告标志着AI安全和政策工作进入新阶段。世界主要国家政府正表现出对评估和监测AI系统前所未有的兴趣和参与——显然,它们的许多关注点都依赖于测试和评估AI系统能力、滥用潜力以及固有安全属性的能力。我们致力于尽自己的一份力量,为实现这些目标做出贡献,并鼓励一场向最高标准看齐的安全竞赛。

相关内容

Anthropic投资1亿美元培训1万名工程师,以解决企业AI人才缺口

Anthropic正在向Claude Frontier Academy投资1亿美元,计划到2027年底培训1万名前沿部署工程师,来自Accenture、Bain、CBA、Deloitte、McKinsey、Morgan Stanley和Novo Nordisk的首批学员已经开课。

阅读更多

Barclays扩展Claude以升级运营并改善客户体验

英国全能银行 Barclays 正在扩大与 Anthropic 的战略合作,以在其全球业务中整合安全的企业级 AI 系统。

阅读更多

Claude 发现了一种具有类 CRISPR 重复序列的新型酶系统

我们宣布在 Anthropic 成立一个新的生命科学研究小组和实验室。本文介绍这项工作背后的团队,并分享早期成果:在我们的科学家仅提供高层方向的情况下,Claude 发现了一种特性令人联想到 CRISPR 的新型酶系统。

阅读更多

来源:Anthropic News · anthropic.com