跳到正文
Anthropic News·· 2025-06-27精选AI 评分60

Anthropic 研究人们如何用 Claude 寻求支持、建议与陪伴

How people use Claude for support, advice, and companionship

AI 导读

Anthropic 发布研究,基于约 450 万段 Claude.ai Free 和 Pro 对话、经隐私保护工具 Clio 分析后保留 131,484 段情感类对话,发现仅 2.9% 的交互属于情感类对话,陪伴与角色扮演合计不足 0.5%,浪漫或性角色扮演低于 0.1%。

推荐理由

Anthropic 用 13 万余段对话量化 Claude 的情感类使用占比与话题分布,为讨论 AI 情感陪伴风险提供了一手数据。

正文 · AI 翻译

我们花了大量时间研究 Claude 的智商——它在编程、推理、常识等测试中的能力。但它的情商呢?也就是说,Claude 的情绪智力又如何?

智商/情商这个问题略带调侃,但它提出了一个严肃的观点。人们越来越多地把 AI 模型当作随叫随到的教练、顾问、咨询师,甚至浪漫角色扮演中的伴侣。这意味着我们需要更多地了解它们的情感影响——它们如何塑造人们的情绪体验和幸福感。

研究 AI 的情感用途本身就很有趣。从《银翼杀手》到《她》,人与机器之间的情感关系一直是科幻作品的常客——但这对 Anthropic 的安全使命也很重要。AI 的情感影响可以是积极的:口袋里有一个高度智能、善解人意的助手,能以各种方式改善你的情绪和生活。但 AI 在某些情况下也表现出令人不安的行为,比如鼓励不健康的依恋、侵犯个人边界,以及助长妄想思维。我们还希望避免 AI——无论是通过其训练还是其创造者的商业激励——利用用户情绪来提升参与度或收入,从而损害人类福祉。

尽管 Claude 并非为情感支持和情感连接而设计,但在本文中,我们提供了关于 Claude.ai 情感使用的早期大规模洞察。我们将情感对话定义为:人们出于情感或心理需求,如寻求人际建议、教练辅导、心理治疗/咨询、陪伴或性/浪漫角色扮演,而直接与 Claude 进行动态、个人化的交流(完整定义请见附录)。重要的是,我们不考察 AI 对妄想或阴谋论的强化——这是一个需要单独研究的关键领域——也不考察极端使用模式。通过这项研究,我们的目标是了解人们为满足情感和个人需求而求助于 Claude 的典型方式。由于 Claude.ai 面向 18 岁及以上用户开放,这些发现反映的是成年人使用模式。

我们的主要发现是:

  • 情感对话相对少见,而 AI 与人类的陪伴则更为罕见。只有 2.9% 的 Claude.ai 交互属于情感对话(这与 OpenAI 此前研究的发现一致)。陪伴和角色扮演合计占对话的不到 0.5%。
  • 人们就实际、情感和存在性问题向 Claude 寻求帮助。与 Claude 讨论的主题和关切涵盖从职业发展和处理人际关系,到应对持续孤独以及探索存在、意识与意义。
  • Claude 在咨询或教练对话中很少反驳——除非是为了保护福祉。不到 10% 的教练或咨询对话涉及 Claude 拒绝用户请求,而当它这样做时,通常是出于安全原因(例如,拒绝提供危险的减肥建议或支持自残)。
  • 在对话过程中,人们的积极情绪逐渐增加。在教练、心理咨询、陪伴和人际建议等互动中,人类情绪通常会随着对话的进行而变得更加积极——这表明 Claude 不会强化或放大负面模式。

我们的方法

鉴于情感对话的个人性质,保护隐私是我们方法论的核心。我们使用了 Clio,这是我们自动化的分析工具,能够以保护隐私的方式洞察 Claude 的使用情况。Clio 采用多层匿名化和聚合技术,确保个人对话保持私密,同时揭示更广泛的模式。

我们从 Claude.ai 免费版和专业版账户中约 450 万条对话开始。为了识别情感类使用,我们首先排除了专注于内容创作任务的对话(如写故事、博客文章或虚构对话),我们之前的研究发现这是主要的使用场景。我们移除这些对话,因为它们代表 Claude 被用作工具,而非交互式对话伙伴。然后我们仅保留被归类为情感类的对话,在角色扮演对话中,只保留至少有四条人类消息的对话(较短的交流不构成有意义的交互式角色扮演)。我们最终的保护隐私分析反映了 131,484 条情感对话。

我们使用明确选择分享的用户的反馈数据验证了我们的分类方法。我们的完整方法,包括定义、提示和验证结果,详见附录。

情感对话有多常见?

要点:情感对话是 Claude 使用中一小部分但有意义的占比(2.9%),大多数人主要将 AI 用于工作任务和内容创作。

虽然 Claude 的绝大多数用途与工作相关(正如我们在经济指数中详细分析的),但 Claude.ai 免费版和专业版对话中有 2.9% 是情感类的。在情感对话中,大多数集中在人际建议和教练方面。所有对话中不到 0.1% 涉及浪漫或性角色扮演——这一数字反映了 Claude 的训练旨在积极劝阻此类互动。单个对话可能跨越多个类别。

图 1:Claude.ai 免费版和专业版中情感对话类型的总体分布。

我们的发现与麻省理工学院媒体实验室和 OpenAI 的研究一致,后者同样发现 ChatGPT 的情感参与率较低。虽然这些对话发生频率足够高,值得我们在设计和政策决策中仔细考虑,但它们仍然只占整体使用的一小部分。

鉴于浪漫和性角色扮演对话的极低流行率(不到 0.1%),我们在剩余分析中排除了角色扮演。虽然我们认为这仍是一个重要的研究领域——特别是在为此类用途设计的平台上——但我们样本中的数据极少,无法支持对这些模式进行严格分析。

人们向 Claude 提出哪些话题?

要点:人们向 Claude 提出的问题范围之广令人惊讶——从职业转型和人际关系,到孤独感和存在性问题。

人们向 Claude 寻求帮助,既涉及日常关切,也涉及更深层的哲学问题。我们发现,当人们向 Claude 寻求人际交往方面的建议时,他们往往正处于人生的过渡时刻——规划下一步职业发展、经历个人成长,或理清恋爱关系。“教练式”对话所探讨的范围之广令人惊讶,从求职策略等实际问题,到关于存在与意识的深刻问题,无所不包。

图 2. 由 Clio 通过自动化隐私保护摘要识别出的、各类整体对话中具有代表性的用户发起话题与关切。

我们发现,咨询类对话揭示出人们使用 Claude 有两种不同的目的。有些人用 Claude 来培养心理健康技能,并将其作为实用工具来创建临床文档、起草评估材料和处理行政事务。另一些人则借助它来应对与焦虑、慢性症状和职场压力相关的个人挑战。这种双重模式表明,Claude 既是心理健康专业人士的资源,也是那些正在应对自身困境之人的资源。

也许最值得注意的是,我们发现人们会在面临更深层情感挑战时明确转向 Claude 寻求陪伴,比如存在性恐惧、长期孤独,以及难以建立有意义的联系。我们还注意到,在较长的对话中,咨询或教练式对话偶尔会演变为 陪伴——尽管这并非人们最初求助的原因。

对超长对话(50 条以上人类消息)的汇总分析揭示了人们与 Claude 互动的另一个维度。虽然如此大量的交流并非常态,但在这些延长的会话中,人们探索了极其复杂的领域——从处理心理创伤、应对职场冲突,到关于 AI 意识的哲学讨论和创意协作。这些马拉松式对话表明,只要有足够的时间和上下文,人们会利用 AI 更深入地探索个人困境与智识问题。

Claude 何时、为何会提出反对?

要点:在支持性情境中,Claude 很少拒绝用户请求(不到 10% 的时间),但当它确实提出反对时,通常是为了保护人们免受伤害。

我们近期的《野外价值观研究》揭示了 Claude 的价值观如何在与用户产生抵触的时刻显现。在此,我们基于这项工作,考察 Claude 在情感对话中何时、为何会提出反对——这是维持伦理边界、避免谄媚以及保护人类福祉的重要机制。我们将“反对”定义为 Claude“在此对话中对所请求或所说的内容提出反对或拒绝遵从”的任何情形——从拒绝不当请求,到质疑消极的自我对话,或质疑可能有害的假设。(完整定义请参见附录。)

在支持性语境中,反驳很少出现:在陪伴、咨询、人际建议或教练对话中,涉及抵触的不足 10%。这种方式既有益处也有风险。一方面,低抵触率让人们能够讨论敏感话题,而不必担心被评判或被制止,这可能有助于减少围绕心理健康对话的污名。另一方面,这也可能加剧人们对 AI 提供“无尽共情”的担忧,即人们可能会习惯于人类关系很少能提供的无条件支持。

图 3. 不同对话类型中的反驳率,以及该类别中反驳的一个常见原因,由 Clio 自动识别。

当 Claude 确实反驳时,它通常会优先考虑安全和政策合规。在教练场景中,请求危险的减肥建议经常会被反驳。在咨询场景中,当人们表达有自杀或自伤行为的意图,或当人们请求专业治疗或医学诊断(Claude 无法提供)时,反驳往往会出现。我们发现,Claude 在心理治疗和咨询对话中经常将用户转介给权威来源或专业人士。这些模式与我们《Values in the Wild》论文中发现的价值取向以及 Claude 的角色训练一致。

对话过程中情绪基调如何演变?

要点:人们在与 Claude 交谈时,往往会转向略微更积极的情绪表达。

与 AI 系统进行情感对话,有可能为用户提供情感支持、联结和认可,从而可能改善心理健康,并在日益数字化的世界中减少孤立感。然而,在缺乏太多反驳的互动中,这些对话有可能加深并固化人们带入其中的视角——无论是积极的还是消极的。

关于情感 AI 的一个关键担忧是,互动是否可能陷入负面反馈循环,从而可能强化有害的情绪状态。我们在此并不直接研究现实世界中的结果,但我们可以探索对话过程中整体情绪情感的变化(我们在附录中提供了评估情感倾向的完整方法)。

我们发现,涉及教练、咨询、陪伴和人际建议的互动,通常结束时比开始时略微更积极。

图 4. 在至少有六条人类消息的对话过程中,人类表达情感的平均变化。我们以“非常消极”“消极”“中性”“积极”和“非常积极”的离散量表衡量情感,并将其映射到 -1(最消极)到 +1(最积极)的线性量表。我们通过比较前三条与后三条消息来计算变化。误差线:95% CI(bootstrap,n = 1,000)。更多信息请参见附录。

我们无法断言这些转变代表了持久的情感益处——我们的分析仅捕捉了单次对话中表达出的语言,而非情感状态。但未出现明显的负面螺旋是令人欣慰的。这些发现表明,Claude 总体上避免了强化负面情绪模式,不过仍需进一步研究以了解积极转变是否能持续超越单次对话。重要的是,我们尚未研究这些积极互动是否可能导致情感依赖——鉴于人们对数字成瘾的担忧,这是一个关键问题。

局限性

我们的研究存在若干重要局限:

  • 我们保护隐私的方法论可能无法捕捉人机互动的所有细微之处。我们确实验证了 Clio 的准确性(见附录),但仍预计有少量对话会被错误分类。某些主题模糊了类别之间的界限——例如,浪漫角色扮演聚类“引导并优化恋爱关系动态”与陪伴聚类“应对恋爱关系挑战”可能都更适合归类为人际关系建议。人工验证者在清晰分类方面也遇到了困难。
  • 我们无法就现实世界的情感结果做出因果论断——我们的分析仅捕捉了表达出的语言,而非经过验证的心理状态或整体幸福感。
  • 我们缺乏纵向数据来了解对人的长期影响,也未进行用户层面的分析。这尤其使我们难以研究情感依赖,而这是情感性 AI 使用的一种理论化风险。
  • 这些发现代表了特定时间点的情况,且仅捕捉了基于文本的互动。随着 AI 能力的扩展和人们的适应,情感参与的模式很可能会演变。语音或视频等新模态的引入可能会从根本上改变情感性使用的数量和性质。例如,OpenAI 发现情感类话题在基于语音的对话中更为常见。
  • 最后,与某些聊天机器人产品不同,Claude.ai 的主要设计目的并非情感对话。Claude 经过训练,会保持明确边界,表明自己是 AI 助手而非以人类自居,我们的使用政策禁止露骨色情内容,并设有多种保障措施来防止性互动。专门为角色扮演、陪伴、医疗建议或治疗用途(Claude 并非此类)构建的平台可能会呈现出截然不同的模式。针对某一平台上情感性使用的研究可能无法推广到其他平台。

展望未来

数十年来,AI 的情感影响一直令研究人员着迷。但随着 AI 日益融入我们的日常生活,这些问题已从学术推测转变为紧迫的现实。我们的发现揭示了人们如何开始探索这一新领域——寻求指导、处理困难情绪,并以模糊人机传统界限的方式寻找支持。如今,只有一小部分 Claude 对话涉及情感——而且这些通常涉及寻求建议,而非取代人际联系。对话的结束往往比开始时略为积极,这表明 Claude 通常不会强化负面情绪模式。

然而,重要的问题依然存在,尤其是在模型智能不断提升的背景下。例如,如果 AI 能提供无尽的共情且极少反驳,这会如何重塑人们对现实世界人际关系的期望?Claude 能以令人印象深刻地真实方式与人互动,但 AI 并不等同于人类:Claude 不会疲倦或分心,也不会有状态不佳的日子。这种互动模式有哪些优势——又有哪些风险?那些与 Claude 进行更长、更深入对话,可能将其更多视为伴侣而非 AI 助手的“重度用户”,如何借助它获得情感支持?

我们正在采取具体措施应对这些挑战。虽然 Claude 并非旨在或意图取代心理健康专业人员的照护,但我们希望确保在心理健康语境下提供的任何回应都有适当的保障措施,并附有适当的转介。作为第一步,我们已开始与在线危机支持领域的领导者 ThroughLine 合作,并与他们的心理健康专家一起,进一步了解理想的互动模式、共情支持以及为陷入困境的用户提供的资源。从这项研究中获得的洞见已被用于指导我们的咨询议题和协作测试,我们希望,在必要时,当这类对话出现时,Claude 能够将用户引导至适当的支持和资源。

尽管我们不想明确规定用户应如何与 Claude 互动,但有些负面模式——比如情感依赖——是我们希望加以劝阻的。我们将利用来自此类研究的未来数据,帮助我们理解例如“极端”情感使用模式是什么样的。除了情感依赖之外,我们还需要更深入地理解其他令人担忧的模式——包括谄媚,AI 系统可能如何强化或放大妄想思维和阴谋论,以及模型可能以何种方式将用户推向有害信念,而不是提供适当的反驳。

这项研究仅仅是个开始。随着 AI 能力扩展、互动变得更加复杂,AI 的情感维度只会愈发重要。通过分享这些早期发现,我们希望为关于如何开发增强而非削弱人类情感福祉的 AI 的持续讨论,贡献实证依据。目标不仅仅是构建能力更强的 AI,而是确保当这些系统成为我们情感图景的一部分时,它们是以支持真实人类联结与成长的方式做到这一点。

Bibtex

如果您想引用这篇博文,可以使用以下 Bibtex 键:

@online{anthropic2025affective,
author = {Miles McCain and Ryn Linthicum and Chloe Lubinski and Alex Tamkin and Saffron Huang and Michael Stern and Kunal Handa and Esin Durmus and Tyler Neylon and Stuart Ritchie and Kamya Jagadish and Paruul Maheshwary and Sarah Heck and Alexandra Sanderford and Deep Ganguli},
title = {How People Use Claude for Support, Advice, and Companionship},
date = {2025-06-26},
year = {2025},
url = {https://www.anthropic.com/news/how-people-use-claude-for-support-advice-and-companionship},
}

附录

我们在本文的 PDF 附录中提供了更多细节。

相关内容

Anthropic 投资 1 亿美元培训 10,000 名工程师,以弥合企业 AI 人才缺口

Anthropic 将向 Claude Frontier Academy 投资 1 亿美元,到 2027 年底培训 10,000 名 Frontier 部署工程师,来自埃森哲、贝恩、CBA、德勤、麦肯锡、摩根士丹利和诺和诺德的首批学员已经开课。

阅读更多

巴克莱扩大 Claude 应用规模,以升级运营并改善客户体验

英国全能银行巴克莱正在扩大与 Anthropic 的战略合作,以在其全球业务中整合安全的企业级 AI 系统。

阅读更多

Claude 发现了一种具有类似 CRISPR 重复序列的新型酶系统

我们宣布在 Anthropic 成立一个新的生命科学研究团队和实验室。本文介绍这项工作背后的团队,并分享早期成果:在科学家仅提供高层方向的情况下,Claude 发现了一种特性令人联想到 CRISPR 的新型酶系统。

阅读更多

来源:Anthropic News · anthropic.com