Anthropic 研究:人们如何使用 Claude 获取支持、建议和陪伴
Anthropic 发布了关于 Claude.ai "affective use"(情感使用)的早期大规模研究,发现虽然情感和心理参与相对较少,但通常会导致人类情感向更积极的方向转变,而不会强化负面的情绪模式。
情感对话的普遍性
情感对话——定义为由情感或心理需求驱动的动态、个人化的交流——占 Claude.ai Free 和 Pro 交互总数的 2.9%。这一发现与 OpenAI 此前进行的研究一致。
在此类情感使用的细分群体中,分布如下:
- 人际关系建议与教练指导: 最常见的情感参与形式。
- 陪伴与角色扮演: 两者合计占对话总数的不足 0.5%。
- 浪漫或性角色扮演: 这些占所有对话的不足 0.1%,这一低比例归因于 Claude 在训练中被要求避免此类交互。
用户话题与参与模式
用户在面临生活转折时刻,经常转向 Claude 以满足多样化的情感和实际需求。
常见主题
- 人际关系建议: 用户经常寻求帮助以应对职业转型、个人成长和浪漫关系。
- 教练指导: 话题范围从实际的求职策略到关于意识和存在的哲学探究。
- 咨询: 这一类别显示出双重模式;心理健康专业人士使用 Claude 处理行政任务和临床文档,而其他用户则寻求针对焦虑、职场压力和慢性症状的支持。
- 陪伴: 当面临持续的孤独感、存在主义恐惧或在建立人际关系方面遇到困难时,用户会明确寻求陪伴。
交互深度
对 "marathon conversations"(马拉松式对话,即包含 50 条以上人类消息的对话)的分析表明,用户会对复杂领域进行更深入的探索,包括处理心理创伤、应对职场冲突以及讨论 AI 意识。
模型拒绝与安全干预
在支持性语境下,Claude 很少拒绝用户请求,在陪伴、咨询、人际关系建议或教练指导对话中,干预发生的比例低于 10%。
当 Claude 进行干预时,通常是为了优先考虑安全和政策合规性。例如:
- 教练指导: 拒绝提供危险的减肥建议。
- 咨询: 拒绝提供专业的医疗诊断或治疗,并抵制与自杀或自残行为相关的请求。
在这些情况下,Claude 经常会将用户引导至权威的专业来源。
情绪情感演变
在情感对话的过程中,人类的情感通常会变得更加积极。在涉及教练指导、咨询、陪伴和人际关系建议的交互中,用户表达的语言倾向于从对话开始到结束发生转变。
Anthropic 指出,这并不一定意味着持久的情感获益或经过验证的心理改善,但这表明 Claude 通常会避免创造负面反馈循环或放大有害的情绪状态。
方法论与局限性
Anthropic 利用 Clio(一种保护隐私的自动化分析工具)分析了大约 450 万场对话。在排除内容创作任务和简短的角色扮演交流后,最终分析基于 131,484 场情感对话。
关键局限性
- 因果关系: 研究捕捉的是表达的语言,而非经过验证的心理状态,因此无法对现实世界的情感结果做出因果性结论。
- 纵向数据: 缺乏用户层面的纵向数据,使得研究难以探讨长期效应,例如情感依赖。
- 模态: 该研究仅涵盖基于文本的交互;语音或视频模态可能会产生不同的情感使用模式。
- 设计意图: Claude 不是作为治疗或陪伴工具设计的,这意味着结果可能无法推广到专门为此类目的搭建的平台。
未来方向
为了提高心理健康语境下的保障措施,Anthropic 已开始与在线危机支持领域的领导者 ThroughLine 合作,以完善共情支持和资源转介。 未来研究将侧重于识别 "extreme"(极端)情感使用模式、情感依赖、谄媚行为(sycophancy)以及 AI 强化妄想思维或阴谋论的可能性。
Sources
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch