Anthropic 宣布 Claude 模型为 Alexa+ 提供支持
Anthropic 宣布 Claude 模型正在为 Alexa+ 提供支持,这是其与 Amazon 持续合作的一部分,双方团队在过去一年密切协作,首席产品官 Mike Krieger 带队帮助 Alexa+ 用上 Claude 的能力。
推荐理由:Anthropic 官方说明 Claude 接入 Alexa+ 的合作方式与安全能力,可了解模型进入消费级语音助手的路径。
公司与模型
Anthropic 的全部动态:Claude 系列模型、Claude Code、安全研究路线与公司进展的持续追踪。
158 条精选近 30 天 23 条共收录 364 条
Anthropic 宣布 Claude 模型正在为 Alexa+ 提供支持,这是其与 Amazon 持续合作的一部分,双方团队在过去一年密切协作,首席产品官 Mike Krieger 带队帮助 Alexa+ 用上 Claude 的能力。
推荐理由:Anthropic 官方说明 Claude 接入 Alexa+ 的合作方式与安全能力,可了解模型进入消费级语音助手的路径。
Anthropic 发布 Claude 3.7 Sonnet,称其为市场上首个混合推理模型,可在标准回答与可见的扩展思考模式间切换,API 用户还能限制思考的 token 预算,上限为 128K。
推荐理由:Anthropic 官方给出混合推理模式的定价与开放范围,读者可据此判断推理预算控制在实际编码工作流中的取舍。
Anthropic 为 Claude 3.7 Sonnet 推出可开关的扩展思考模式,用户可切换是否让模型深入思考,开发者还能设置思考预算控制思考时长。该模式让同一模型自行分配更多时间与算力,而非切换到另一个模型,其原始思考过程对用户可见,官方将其定位为研究预览。
推荐理由:Anthropic 官方披露 Claude 3.7 Sonnet 扩展思考的可见推理机制,并给出 GPQA 与智能体评测数据。
Anthropic 推出 Anthropic Economic Index,首份报告基于约一百万条 Claude.ai 匿名对话,用 Clio 工具按美国劳工部 O*NET 任务分类分析 AI 的实际使用情况。
推荐理由:Anthropic 用约百万条真实对话数据刻画 AI 在职业任务中的渗透程度,并开源数据集供研究者复用。
Anthropic 开源 Model Context Protocol(MCP),用于把 AI 助手连接到内容库、业务工具和开发环境等数据所在系统,以单一开放协议替代碎片化的定制集成。
推荐理由:Anthropic 开源 MCP 并给出规范、SDK 与预置服务器,读者可据此判断 AI 助手接入数据源的标准化路径。
Anthropic 宣布扩大与 AWS 的合作,Amazon 追加 40 亿美元投资,使其对 Anthropic 的总投资达到 80 亿美元,并确立 AWS 为其主要云和训练伙伴。
推荐理由:Anthropic 与 AWS 扩大合作并获 40 亿美元新投资,读者可了解其云与训练伙伴关系及 Trainium 芯片协同的布局。
Anthropic 宣布新版 Claude 3.5 Sonnet 开始在 GitHub Copilot 上滚动推出,开发者可在 Visual Studio Code 和 GitHub.com 中选择该模型写代码,面向 GitHub 超过 1 亿开发者。
推荐理由:Anthropic 官方说明 Claude 3.5 Sonnet 接入 GitHub Copilot 的可用范围与编码场景,可据此判断开发者何时能用上。
Anthropic 宣布最新版 Claude 3.5 Sonnet 具备电脑操作能力,在适当软件环境下可移动光标、点击屏幕位置并通过虚拟键盘输入,目前处于公开测试阶段。
推荐理由:Anthropic 官方披露 Claude 3.5 Sonnet 电脑操作能力的训练思路与安全评估,可了解该能力当前边界。
Anthropic 发布升级版 Claude 3.5 Sonnet 和新模型 Claude 3.5 Haiku,并公开 computer use 能力公测。
推荐理由:官方给出升级版 Claude 3.5 Sonnet 与 Haiku 的基准变化,并首次开放 computer use 公测,可据此判断智能体操作电脑的当前边界。
Anthropic 发布负责任扩展政策(RSP)的更新版本,引入更灵活的风险评估方式,并新增能力阈值与所需保障措施两部分框架。更新后的政策定义了两个关键能力阈值:模型若能自主开展复杂 AI 研发任务,需提升至可能为 ASL-4 或更高的安全标准;若模型能实质协助具备基础技术背景的人制造或部署 CBRN 武器,则需达到 ASL-3 标准。
推荐理由:Anthropic 公开了 RSP 更新后的能力阈值与 ASL 分级思路,可对照其一年实施中暴露的合规缺口。
Anthropic 发布 Contextual Retrieval 方法,通过 Contextual Embeddings 和 Contextual BM25 两项子技术,将 top-20 分块检索失败率降低 49%,结合重排序后降低 67%。
推荐理由:Anthropic 公开了 Contextual Retrieval 的具体做法与失败率数据,读者可据此评估自家 RAG 检索环节的改进空间。
Anthropic 宣布 Claude 3 Haiku 在 Amazon Bedrock 中的微调功能正式可用,客户可基于自有 prompt-completion 数据训练定制版本,用于分类、调用自定义 API 等专门任务。
推荐理由:官方给出微调后的分类准确率与 token 消耗变化,并附两家企业客户的具体数据,可据此判断定制小模型的落地空间。
Anthropic 宣布一项新计划,资助第三方机构开发能有效衡量 AI 模型高级能力的评测,以缓解当前安全相关评测供不应求的局面。
推荐理由:Anthropic 公开了第三方模型评测的资助方向与优先级,可据此了解前沿实验室如何定义安全评测需求。
Anthropic 宣布 Claude 3 Haiku 和 Claude 3 Sonnet 已上架面向美国情报界的 AWS Marketplace 以及 AWS GovCloud,供政府机构使用。
推荐理由:官方说明 Claude 3 Haiku 与 Sonnet 进入面向美国政府与情报机构的 AWS 市场,并给出使用政策例外的具体边界。
Anthropic 为 Claude.ai Pro 和 Team 用户推出 Projects,可将聊天按项目组织,把知识文档与聊天记录集中在一处,并支持把优质对话分享给团队成员查看。
推荐理由:官方说明 Projects 如何把内部知识与聊天记录集中到一处,并给出 200K 上下文和团队共享的具体用法。
Anthropic 发布 Claude 3.5 Sonnet,这是 Claude 3.5 模型家族的首个版本,在 GPQA、MMLU、HumanEval 等评测上超过 Claude 3 Opus,速度约为 Opus 的两倍,定价为每百万输入 token 3 美元、每百万输出 token 15 美元,上下文窗口 200K token。
推荐理由:官方给出 Claude 3.5 Sonnet 的定价、上下文窗口与智能体编码评测数据,可据此判断其相对 Claude 3 Opus 的速度与成本取舍。
Anthropic 发布关于解读大语言模型内部机制的研究论文,并基于 Claude 3 Sonnet 推出为期 24 小时的交互演示 Golden Gate Claude。
推荐理由:Anthropic 用可交互演示展示可解释性研究如何定位并调节 Claude 内部特征,读者可借此理解该方法的实际效果。
Anthropic 宣布 Claude 即日起面向欧洲个人和企业开放,提供 Claude.ai 网页版、免费的 Claude iOS 应用以及 Claude Team 套餐,并支持 Claude 3 模型系列。
推荐理由:Anthropic 官方公布 Claude 面向欧洲个人与企业开放的产品形态与订阅价格,可据此判断其欧洲市场落地节奏。
Anthropic 发布 Claude 3 Haiku,称其为同智能级别中最快、最便宜的模型,具备领先的视觉能力并在行业基准上表现强劲。该模型处理 32K token 以下提示时每秒可处理 21K token(约 30 页),速度是同类模型的三倍,输入输出 token 比例为 1:5,成本为同性能档其他模型的一半。
推荐理由:官方给出 Haiku 的速度、定价与可用渠道,读者可据此判断它在企业批量文档处理中的定位。
Anthropic 发布 Claude 3 模型家族,按能力升序为 Claude 3 Haiku、Claude 3 Sonnet 和 Claude 3 Opus,Opus 与 Sonnet 即日起在 claude.ai 和 Claude API 上线,API 已在 159 个国家开放,Haiku 稍后推出。
推荐理由:官方给出三档模型的基准、定价与上下文窗口,可据此判断不同工作负载该选哪一档。