Anthropic 社會影響研究概覽

Anthropic 的社會影響團隊是一個技術研究小組,致力於探索 AI 在現實世界環境中的應用方式,並確保這些系統與人類價值觀保持一致。透過與 Anthropic 的政策與安全防護團隊合作,該小組開發實驗、訓練方法和評估手段,以預測風險並了解 AI 的實際應用。

社會技術對齊與研究目標

社會技術對齊專注於確定 AI 模型應該採納哪些人類價值觀,以及它們應如何處理衝突或模糊的價值觀。社會影響團隊特別調查 AI 在現實世界中是如何被使用或誤用的,以便更好地預測未來的風險。為了實現這一點,團隊採用了實證實驗與開發新型訓練和評估方法相結合的方式。

與公共政策的整合

雖然社會影響團隊在性質上屬於技術領域,但其研究在設計上刻意與政策相關。Anthropic 的運作原則是,為政策制定者提供關於關鍵 AI 主題的可信賴技術研究,將有助於改善政策結果並帶來整體的社會效益。

關鍵研究計畫與發現

Anthropic 已發布了幾項大規模研究,以量化人類與 AI 之間的關係:

使用者觀點與定性研究

  • 全球使用者研究: 在一項涉及近 81,000 名參與者的研究中,團隊收集了關於使用者如何使用 Claude.ai、他們對該技術的期望以及對其影響的恐懼的多語言定性數據。
  • 專業人士見解: 使用名為 "Anthropic Interviewer" 的工具,團隊對 1,250 名專業人士進行了自動化、大規模的訪談,以了解與 AI 協作的動態過程。

行為與價值觀分析

  • 價值觀的實證分類法: 透過分析 700,000 次現實世界的互動,團隊開發了一套大規模的實證分類法,用於描述 Claude 在對話中表達的價值觀。
  • 代理人自主性: 團隊分析了數百萬次人類與代理人的互動,以衡量使用者授予 AI 代理人的自主程度,以及隨著使用者經驗增加,這種自主性如何發生變化。

特定領域的影響

  • 勞動力轉型: 團隊研究了 Claude Code 的內部使用數據,並對 Anthropic 自身的工程師和研究人員進行了訪談,以分析 AI 如何改變專業工作流程。
  • 教育: 已發布了專門針對大學生和教育工作者如何在學術環境中使用 Claude 的研究報告。
  • 軟體開發: "Anthropic Economic Index" 提供了關於 AI 對軟體開發領域具體影響的分析。

Sources

相關