Anthropic 研究:人們如何使用 Claude 進行支持、建議與陪伴

Anthropic 發布了關於 Claude.ai 「情感使用」的早期大規模研究,發現雖然情感與心理參與相對罕見,但通常會導致人類情緒轉向更積極的方向,且不會強化負面的情緒模式。

情感對話的盛行率

情感對話——定義為由情感或心理需求驅動的動態、個人化交流——佔所有 Claude.ai 免費版與 Pro 版互動的 2.9%。這一發現與 OpenAI 先前的研究結果一致。

在此類情感使用的少數子集中,分布如下:

  • 人際建議與教練服務: 最常見的情感參與形式。
  • 陪伴與角色扮演: 兩者合計佔對話總數的不到 0.5%。
  • 浪漫或性角色扮演: 這些佔所有對話的不到 0.1%,這一低比例歸因於 Claude 的訓練旨在遏止此類互動。

使用者主題與參與模式

使用者在面對生活轉折點時,經常轉向 Claude 以滿足多樣化的情感與實際需求。

常見主題

  • 人際建議: 使用者經常尋求協助以應對職涯轉型、個人成長與浪漫關係。
  • 教練服務: 主題範圍從實際的求職策略到關於意識與存在的哲學探究。
  • 諮詢: 此類別呈現雙重模式;心理健康專業人士使用 Claude 處理行政任務與臨床文件,而其他使用者則尋求針對焦慮、職場壓力與慢性症狀的支持。
  • 陪伴: 使用者在面對持續的孤獨感、存在主義恐懼或在建立人際連結方面的困難時,會明確地尋求陪伴。

互動深度

對「馬拉松式對話」(即包含 50 條以上人類訊息的對話)的分析顯示,使用者會對複雜領域進行更深層次的探索,包括處理心理創傷、應對職場衝突以及討論 AI 意識。

模型抗拒與安全防護

Claude 在支持性情境下很少拒絕使用者的請求,在陪伴、諮詢、人際建議或教練服務的對話中,抗拒發生的比例低於 10%。

當 Claude 進行抗拒時,通常是為了優先考慮安全性與政策合規性。例如包括:

  • 教練服務: 拒絕提供危險的減重建議。
  • 諮詢: 拒絕提供專業醫療診斷或治療,並抗拒與自殺或自殘行為相關的請求。

在這些情況下,Claude 經常會引導使用者參考權威的專業來源。

情緒情緒演變

人類的情緒通常會在情感對話的過程中變得更加積極。在涉及教練服務、諮詢、陪伴與人際建議的互動中,使用者表達的語言傾向於於對話開始與結束之間發生轉變。

Anthropic 指出,這並不一定意味著持久的情感益處或經過驗證的心理改善,但這顯示了 Claude 通常會避免創造負面回饋循環或放大有害的情緒狀態。

研究方法與限制

Anthropic 利用 Clio,一種保護隱私的自動化分析工具,分析了約 450 萬場對話。最終分析是基於 131,484 場情感對話,在排除內容創作任務與短暫的角色扮演交流後進行。

關鍵限制

  • 因果關係: 研究捕捉的是表達的語言,而非經過驗證的心理狀態,因此無法對現實世界的的情緒結果做出因果性主張。
  • 縱向數據: 缺乏使用者層級的縱向數據,使得研究難以探討長期影響,例如情緒依賴。
  • 模態: 本研究僅涵蓋文字基礎的互動;語音或影片模態可能會產生不同的情感使用模式。
  • 設計意圖: Claude 並非設計作為治療或陪伴工具,這意味著研究結果可能無法推廣至專門為此目的建立的平台。

未來方向

為了改善心理健康情境下的安全防護,Anthropic 已開始與線上危機支持的領導者 ThroughLine 合作,以完善共情支持與資源轉介。

未來研究將集中於識別「極端」情緒使用模式、情緒依賴、諂媚行為,以及 AI 可能強化妄想性思考或陰謀論的可能性。

Sources

相關