Anthropic 宣布支持加州 AI 监管法案 SB 53
Anthropic 宣布支持加州参议员 Scott Wiener 提出的 SB 53 法案,该法案要求开发最强 AI 系统的大型公司制定并发布安全框架、公开透明度报告、在 15 天内上报重大安全事件,并提供举报人保护,违规将面临罚款。
推荐理由:Anthropic 作为前沿实验室公开支持加州 AI 监管法案,读者可了解其对披露义务与安全框架的具体主张。
公司与模型
Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。
158 条精选近 30 天 23 条共收录 364 条
Anthropic 宣布支持加州参议员 Scott Wiener 提出的 SB 53 法案,该法案要求开发最强 AI 系统的大型公司制定并发布安全框架、公开透明度报告、在 15 天内上报重大安全事件,并提供举报人保护,违规将面临罚款。
推荐理由:Anthropic 作为前沿实验室公开支持加州 AI 监管法案,读者可了解其对披露义务与安全框架的具体主张。
Anthropic 更新服务条款中的区域销售限制,禁止所有权结构使其受制于中国等不支持地区管辖的公司或组织使用其服务,无论其实际运营地在哪里。新规涵盖由不支持地区总部企业直接或间接持股超过 50% 的实体。Anthropic 称此举是为应对受限地区企业通过海外子公司获取其服务、可能用于军事与情报目的或通过蒸馏推进自身 AI 开发的风险。
推荐理由:Anthropic 官方收紧区域销售限制,读者可了解其如何界定受控实体及背后的国家安全考量。
Anthropic 完成 130 亿美元 F 轮融资,由 ICONIQ 领投,Fidelity 和 Lightspeed 联合领投,投后估值 1830 亿美元。
推荐理由:官方披露了融资规模、估值与营收增长曲线,可据此观察头部模型公司的商业化节奏。
OpenAI 与 Anthropic 公布一次联合安全评估的结果,双方互相测试对方模型在失准、指令遵循、幻觉、越狱等方面的表现。OpenAI 称这是此类跨实验室合作评估,并提到其中的进展、挑战以及跨实验室协作的价值。
推荐理由:两家头部实验室首次互测对方模型的对齐与越狱表现,可了解跨实验室安全评估的做法与发现。
Anthropic 发布 2025 年 8 月威胁情报报告,披露 Claude 被滥用的三类案例:有攻击者用 Claude Code 对至少 17 家机构实施数据窃取与勒索。
推荐理由:Anthropic 首次系统披露 Claude 被滥用的三类真实案例,为理解智能体时代的安全攻防提供了第一手样本。
Anthropic 宣布与美国能源部国家核安全管理局(NNSA)及 DOE 国家实验室合作,共同开发了一个用于区分核相关对话是否值得关注的分类器,初步测试准确率达 96%。
推荐理由:Anthropic 与美国 NNSA 联合开发核扩散风险分类器并已上线 Claude,展示了公私合作做前沿模型安全防护的路径。
Anthropic 宣布 Team 和 Enterprise 客户可升级到包含 Claude Code 的高级席位,把 Claude 应用与编码智能体合并到同一订阅中,管理员可按用户分配标准或高级席位。
推荐理由:官方说明企业版席位如何把 Claude 与 Claude Code 打包,并给出管理、用量分析与合规接口的具体控制项。
Anthropic 宣布以 1 美元的价格向美国联邦政府三支机构提供 Claude for Enterprise 和 Claude for Government,覆盖联邦文职行政部门以及立法和司法部门。
推荐理由:Anthropic 以 1 美元向美国三支政府机构开放 Claude,可观察 AI 厂商在公共部门的定价与合规路径。
Anthropic 发布 Claude Opus 4.1,在智能体任务、真实编码和推理上对 Opus 4 进行升级,SWE-bench Verified 成绩提升至 74.5%,价格与 Opus 4 相同。
推荐理由:官方给出 Opus 4.1 在 SWE-bench Verified 上的成绩与多家合作方的实测反馈,可据此判断升级幅度。
Anthropic 推出面向金融分析的 Claude 解决方案,把市场数据源与 Databricks、Snowflake 等内部数据统一到单一界面,并附带预置 MCP 连接器。
推荐理由:Anthropic 面向金融行业推出的整合方案,列出数据源、合作方与客户实测数字,可据此判断金融场景的落地路径。
美国国防部通过首席数字与人工智能办公室(CDAO)向 Anthropic 授予一份两年期其他交易原型协议,上限 2 亿美元,Anthropic 将围绕前沿 AI 能力开展原型开发以支持美国国家安全。
推荐理由:美国国防部向 Anthropic 授予 2 亿美元原型协议,可据此观察前沿 AI 进入国防场景的合作模式与边界。
Anthropic 发布研究,基于约 450 万段 Claude.ai Free 和 Pro 对话、经隐私保护工具 Clio 分析后保留 131,484 段情感类对话,发现仅 2.9% 的交互属于情感类对话,陪伴与角色扮演合计不足 0.5%,浪漫或性角色扮演低于 0.1%。
推荐理由:Anthropic 用 13 万余段对话量化 Claude 的情感类使用占比与话题分布,为讨论 AI 情感陪伴风险提供了一手数据。
Anthropic 推出专为美国国家安全客户构建的 Claude Gov 模型,已由美国最高层级国家安全机构部署,访问权限仅限在涉密环境中工作的人员。该系列模型基于政府客户直接反馈开发,并经过与所有 Claude 模型相同的安全测试,在涉密材料处理、情报与国防语境文档理解、关键语言和方言、复杂网络安全数据解读等方面有增强表现。
推荐理由:官方披露了面向美国国家安全客户的定制模型能力边界与准入限制,可了解专用模型在涉密场景的落地方式。
Anthropic 发布下一代 Claude 模型 Claude Opus 4 和 Claude Sonnet 4,主打编码、高级推理与 AI 智能体能力。
推荐理由:官方给出 Claude Opus 4 与 Sonnet 4 的基准成绩、定价和 API 新能力,可据此判断编码与智能体场景的选型。
Anthropic 宣布在发布 Claude Opus 4 的同时启用负责任扩展政策中的 AI 安全等级 3(ASL-3)部署与安全标准。ASL-3 部署措施聚焦限制模型协助 CBRN 武器相关任务,通过 Constitutional Classifiers 实时拦截有害输入输出;安全措施包含 100 多项控制,如模型权重访问双人授权和出口带宽限制。
推荐理由:Anthropic 首次在发布新模型时启用 ASL-3 防护,读者可了解前沿模型安全分级如何落地及对部署的影响。
Anthropic 发布 2025 年 3 月 Claude 恶意使用检测与反制报告,披露并封禁了四类滥用账号。最值得关注的是首个影响即服务(influence-as-a-service)案例,该操作利用 Claude 调度 Twitter/X 和 Facebook 上超过 100 个社交机器人账号,由模型决定这些账号何时点赞、评论或转发真实用户帖子,并与数万个真实账号互动。
推荐理由:Anthropic 公开了四类 Claude 滥用案例,其中用模型调度上百个社交机器人账号的做法此前少见。
Anthropic 发布教育报告,用 Clio 工具分析了约 100 万条来自高校邮箱账号的 Claude.ai 匿名对话,筛选出 574,740 条学术相关对话。
推荐理由:基于百万条真实对话的分析,给出了不同学科学生使用 AI 的分布与四种交互模式,可作为教育场景讨论的数据参照。
Anthropic 发布面向高等教育机构的 Claude for Education,并推出 Learning mode,引导学生自己推理而非直接给出答案。该版本包含与东北大学、伦敦政治经济学院和 Champlain College 的全校接入协议,东北大学 13 个全球校区的 5 万名学生、教师和员工将获得 Claude 访问权限。
推荐理由:Anthropic 面向高校推出专用版本并给出 Learning mode 与三所大学的全校接入案例,可了解教育场景的落地方式。
Anthropic 的 Frontier Red Team 基于过去一年四个模型版本的红队工作,评估前沿 AI 模型在国家安全相关双重用途能力上的进展。
推荐理由:Anthropic 用四个模型版本一年的红队数据,给出网络与生物两类双重用途能力的进展与当前风险边界。
Anthropic 完成 3.5 亿美元 E 轮融资,投后估值 615 亿美元,由 Lightspeed Venture Partners 领投,Bessemer、Cisco Investments、Fidelity、General Catalyst、Jane Street、Menlo Ventures、Salesforce Ventures 等新老投资方参投。
推荐理由:融资规模与资金用途一并给出,可据此观察 Anthropic 在算力、可解释性与国际扩张上的投入方向。