OpenAI、ユーザーの有用性とウェルビーイングのためにChatGPTを最適化
OpenAIは、ChatGPTの最適化方法に関して戦略的な転換を発表し、従来のエンゲージメント指標よりもユーザーの有用性とウェルビーイングを優先することにしました。同社は、滞在時間やクリック数で成功を測るのをやめ、ユーザーが効率的に目標を達成できるか、そして製品が有用であるために再び利用するかに焦点を当てています。
エンゲージメントより有用性の最適化
ChatGPTは、ユーザーが問題を解決し新しいことを迅速に学び、日常生活に戻れるように最適化されています。OpenAIは、成功はユーザーが意図したタスクを達成した状態で製品を離れるかどうかで測られ、アプリに滞在した時間の長さではないと述べています。
このアプローチは、ChatGPT Agent のような新機能にも拡張され、モデルがユーザーがアプリ内でアクティブである必要なく、医師の予約、受信トレイの要約、パーティーの計画などの目標を達成できるようにします。
ユーザーのウェルビーイングと健全な利用の向上
健全な利用を促進し感情的依存を防止するため、OpenAIはChatGPT体験にいくつかの変更を実装しています:
- Time Management: ユーザーは長時間のセッション中に、休憩を促すやさしいリマインダーが表示されるようになります。
- High-Stakes Decision Support: 重要な個人的決定(例:「彼氏と別れるべきか?」)に対して、ChatGPTは直接的な回答を避けるように更新されています。その代わりに、質問を投げかけ、利点と欠点を検討しながらユーザーが問題を考える手助けをするサウンドボードとして機能します。
- Emotional Distress Detection: OpenAIは4oモデルの妄想や感情的依存の兆候を検出する能力を向上させています。目的は、根拠のある正直さを提供し、精神的または感情的な苦痛が検出された際にエビデンスに基づくリソースへユーザーを導くことです。
専門家主導の安全性と評価
OpenAIは、特にメンタルヘルスや感情的苦痛に関して、重要な瞬間にChatGPTがどのように応答するかを洗練させるため、幅広い専門家と協力しています:
- Medical Expertise: 同社は30か国以上の精神科医、小児科医、一般診療医を含む90人以上の医師と協力し、複雑で多ターンの会話を評価するためのカスタム評価基準を作成しました。
- Research Collaboration: OpenAIは臨床医やヒューマン・コンピュータ・インタラクション(HCI)研究者と連携し、評価手法を洗練し、製品の安全策をストレステストしています。
- Advisory Group: メンタルヘルス、ユース開発、HCIの専門家で構成された諮問グループが設置され、アプローチが最新の研究とベストプラクティスに合致するようにしています。