Anthropic 在 Amazon Bedrock 上线 Claude 3 Haiku 微调
Fine-tune Claude 3 Haiku in Amazon Bedrock
Anthropic 宣布 Claude 3 Haiku 在 Amazon Bedrock 中的微调功能正式可用,客户可基于自有 prompt-completion 数据训练定制版本,用于分类、调用自定义 API 等专门任务。
官方给出微调后的分类准确率与 token 消耗变化,并附两家企业客户的具体数据,可据此判断定制小模型的落地空间。

更新:在 Amazon Bedrock 中微调 Claude 3 Haiku 现已正式可用。(2024 年 11 月 1 日)
客户现在可以在 Amazon Bedrock 中微调 Claude 3 Haiku——我们最快、最具成本效益的模型——为其业务定制知识和能力,使模型在专门任务中更加高效。
微调概述
微调是一种提升模型性能的常用技术。通过创建模型的定制版本,你可以训练模型在高度定制的工作流程中表现出色。
要微调 Claude 3 Haiku,你首先需要准备一组高质量的提示-补全对——即你希望 Claude 针对给定任务提供的理想输出。微调 API 现已推出预览版,它将使用你的数据创建你自己的定制 Claude 3 Haiku。使用 Amazon Bedrock 控制台或 API,你可以测试和完善你的定制 Claude 3 Haiku 模型,直到它满足你的性能目标并准备好部署。
优势
微调让你可以定制 Claude 3 Haiku,使其获得专门的业务知识,从而提高准确性和一致性。优势包括:
- 在专门任务上取得更好的结果:增强针对特定领域操作的表现,例如分类、与自定义 API 的交互或行业特定数据的解读。通过编码公司和领域知识,微调使 Claude 3 Haiku 在对你业务至关重要的领域比更通用的模型表现更出色。
- 更快的速度和更低的成本:降低生产部署的成本,Claude 3 Haiku 可以替代 Sonnet 或 Opus 使用,同时更快地返回结果。
- 一致且符合品牌规范的格式:生成按你确切规格定制的结构化输出,例如标准化报告或自定义模式,确保符合监管要求和内部协议。
- 易于使用的 API:各种规模的公司都可以高效创新,无需大量内部 AI 专业知识或资源。任何人都可以无缝微调模型,无需深厚的技术专业知识。
- 安全可靠:专有训练数据保留在客户的 AWS 环境中。Anthropic 的微调技术保持了 Claude 3 模型系列低有害输出风险的特点。
我们微调了 Haiku 来审核互联网论坛上的在线评论1,包括识别侮辱、威胁和露骨内容。微调将分类准确率从 81.5% 提升至 99.6%,同时将每次查询的 token 数减少了 85%。

客户聚焦
SK Telecom 是韩国最大的电信运营商之一,他们训练了一个定制 Claude 模型,利用其行业特定专业知识来改进支持工作流程并实现更好的客户体验。
“在我们的客户支持运营中嵌入微调后的 Claude,可衡量地改进了我们的内部流程和整体客户满意度。通过定制 Claude,我们看到客服回复的正面反馈增加了 73%,电信相关任务的关键绩效指标提升了 37%。微调后的模型现在能够高效地从客户通话记录中生成主题、行动项和摘要,并将复杂的客户问题分解为可管理的步骤,以便更好地解决问题,”AI 技术协作组副总裁 Eric Davis 表示。
汤森路透是一家全球内容和技术公司,已在Claude 3 Haiku上取得了积极成果。该公司为法律、税务、会计、合规、政府和媒体领域的专业人士提供服务,期望通过利用其行业专业知识对Claude进行微调,实现更快、更相关的AI结果。
“我们很高兴能在Amazon Bedrock中微调Anthropic的Claude 3 Haiku模型,以进一步增强我们由Claude驱动的解决方案。汤森路透旨在提供准确、快速和一致的用户体验。通过围绕我们的行业专业知识和特定需求优化Claude,我们预期能实现可衡量的改进,以更快的速度提供高质量结果。我们已经在Claude 3 Haiku上看到了积极成果,微调将使我们能够更精确地定制AI辅助功能,”汤森路透AI和实验室负责人Joel Hron表示。
如何开始
Amazon Bedrock中Claude 3 Haiku的微调功能现已在美国西部(俄勒冈)AWS区域预览可用。发布时,我们支持上下文长度最多32K令牌的基于文本的微调,并计划在未来引入视觉功能。更多详情请参见AWS发布博客和文档。
如需申请访问权限,请联系您的AWS客户团队或在AWS管理控制台中提交支持工单。
来源:Anthropic News · anthropic.com