Anthropic 社会的影響のリサーチ概要
Anthropic の Societal Impacts チームは、AI が実世界でどのように利用されているかを探求し、これらのシステムが人間の価値観と一致するようにすることに専念する技術的なリサーチグループです。Anthropic の Policy と Safeguards チームと協力することで、グループはリスクを予測し、AI の実用的な応用を理解するための実験、トレーニング方法、および評価方法を開発します。
社会技術的アライメントとリサーチの目標
社会技術的アライメントは、AI モデルがどの人間の価値観を採用すべきか、また、相反する、あるいは曖昧な価値観をどのように扱うべきかに焦点を当てています。Societal Impacts チームは、将来のリスクをより適切に予測するために、AI が実社会でどのように使用または悪用されているかを具体的に調査しています。これを達成するために、チームは実証的な実験と、新しいトレーニングおよび評価手法の開発を組み合わせて採用しています。
公共政策との統合
Societal Impacts チームは本質的に技術的なものですが、そのリサーチは意図的に政策に関連するように設計されています。Anthropic は、政策立案者に重要な AI トピックに関する信頼できる技術的なリサーチを提供することが、政策成果の改善と社会全体の利益につながるという原則に基づいて運営されています。
主要なリサーチ・イニシアチブと知見
Anthropic は、人間と AI の関係を定量化するために、いくつかの大規模な研究を公開しています。
ユーザーの視点と定性的研究
- Global User Study: 約 81,000 人の参加者が関与した研究において、チームはユーザーが Claude.ai をどのように利用しているか、技術に対する彼らの熱望、およびその影響に関する彼ら自身の懸念について、多言語の定性的データを収集しました。
- Professional Insights: "Anthropic Interviewer" と呼ばれるツールを使用して、チームは 1,250 人の専門家に対して自動化された大規模なインタビューを実施し、AI と共に働くダイナミクスを理解しました。
行動および価値観の分析
- Empirical Taxonomy of Values: 700,000 件の実世界でのやり取りを通じて、チームは Claude が会話中に表現する価値観の大規模な実証的分類学を開発しました。
- Agent Autonomy: チームは、何百万もの人間とエージェントのやり取りを分析し、ユーザーが AI エージェントに付与する自律性のレベルと、ユーザーが経験を積むにつれてその自律性がどのように変化するかを測定しました。
ドメイン特化型の影響
- Workforce Transformation: チームは内部の Claude Code 使用データと、Anthropic 自身のエンジニアやリサーチャーとのインタビューを実施し、AI が専門的なワークフローをどのように変えているかを分析しました。
- Education: 大学の学生や教育者が学術的な環境で Claude をどのように利用しているかについて、具体的にリサーチレポートが公開されています。
- Software Development: "Anthropic Economic Index" は、ソフトウェア開発分野における AI の具体的な影響に関する分析を提供します。
Sources
- OriginalSocietal Impacts Research
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch