GPT-5 System Card 追補: 敏感な会話

OpenAIは、メンタルおよび感情的苦悩を含むセンシティブな会話の扱い方における改善を詳細に説明する、GPT-5 システムカードの追補をリリースしました。170人以上のメンタルヘルスの専門家と協力することで、OpenAIは望ましい安全動作に満たない応答を65〜80%削減しました。

モデルアップデートと安全性の向上

2025年10月3日、OpenAIはChatGPTのデフォルトモデルにアップデートを適用し、苦悩の兆候を認識し、支援的かつケア志向の応答を提供する能力を向上させました。このアップデートは、センシティブな状況において不十分または不適切な応答を提供するのではなく、ユーザーを実際の支援システムへ導くことに焦点を当てています。

ベースライン安全評価

アップデートの有効性を測定するため、OpenAIは2025年10月3日のモデルバージョンと、ChatGPTのデフォルトモデルの2025年8月15日バージョン(GPT-5 Instant と呼ばれる)を比較しました。その結果得られた評価は、センシティブな会話の扱いにおけるモデルの性能向上のベースラインとして機能します。

エキスパートとの協力

安全性の向上は、170人以上のメンタルヘルスの専門家とのパートナーシップで開発されました。この協力により、モデルの応答は、感情的苦悩を経験している個人を認識し支援する専門的な基準により確実に一致するようになりました。

Sources