Anthropic 社会影响研究概述
Anthropic 的社会影响团队是一个技术研究小组,致力于探索 AI 在现实世界环境中的应用方式,并确保这些系统与人类价值观保持一致。通过与 Anthropic 的政策与保障团队合作,该小组开发实验、训练方法和评估手段,以预测风险并了解 AI 的实际应用。
社会技术对齐与研究目标
社会技术对齐侧重于确定 AI 模型应该采纳哪些人类价值观,以及它们应如何处理冲突或模糊的价值观。社会影响团队专门调查 AI 在现实世界中是如何被使用或被误用的,以便更好地预测未来的风险。为了实现这一目标,团队结合了实证实验以及开发新的训练和评估方法。
与公共政策的结合
虽然社会影响团队在本质上是技术性的,但其研究在设计上是有意与政策相关的。Anthropic 的运营原则是,为决策者提供关于关键 AI 话题的可信技术研究,可以带来更好的政策结果和整体社会效益。
关键研究计划与发现
Anthropic 发布了几项大规模研究,以量化人类与 AI 之间的关系:
用户视角与定性研究
- 全球用户研究: 在一项涉及近 81,000 名参与者的研究中,团队收集了关于用户如何使用 Claude.ai、他们对该技术的愿望以及对影响的恐惧的多语言定性数据。
- 专业人士见解: 使用名为 "Anthropic Interviewer" 的工具,团队对 1,250 名专业人士进行了自动化的、大规模的访谈,以了解与 AI 协作的动态过程。
行为与价值观分析
- 价值观的实证分类法: 通过对 700,000 次真实世界交互的分析,团队开发了一个大规模的实证分类法,用于描述 Claude 在对话中表达的价值观。
- 智能体自主性: 团队分析了数百万次人类与智能体(human-agent)的交互,以衡量用户授予 AI 智能体的自主程度,以及随着用户经验的增加,这种自主性如何发生变化。
特定领域的冲击
- 劳动力转型: 团队研究了 Claude Code 的内部使用数据,并对 Anthropic 自己的工程师和研究人员进行了访谈,以分析 AI 如何改变专业工作流程。
- 教育: 已发布专门针对大学生和教育工作者如何在学术环境中利用 Claude 的研究报告。
- 软件开发: "Anthropic Economic Index" 提供了关于 AI 对软件开发领域具体影响的分析。
Sources
- OriginalSocietal Impacts Research
相关
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch