OpenAI Model Spec アップデート

OpenAIは、そのAIモデルの意図された動作を定義する管理文書であるModel Specの主要なアップデートをリリースしました。このアップデートは、カスタマイズ性、透明性、知的自由を強調し、任意の制限なくユーザーと開発者が探求し創造できるようにしながら、現実世界の害を防ぐために不可欠な安全ガードレールを維持しています。

コアな目的と命令のチェーン

Model Specは、構造化された「命令のチェーン」を通じて、ユーティリティ、安全性、ユーザーのニーズへの整合という競合する目標のバランスを取ります。このフレームワークは、プラットフォーム(OpenAI)、開発者、ユーザーの特定の順序で指示を優先することを保証し、プラットフォームレベルの境界内で高いレベルのカスタマイズを可能にします。

The Spec is organized around several key principles:

  • 命令のチェーン: プラットフォームからの指示、次に開発者、最後にユーザーの指示を優先し、プラットフォームレベルのルールが維持されることを確保しながら、ほとんどのガイドラインに対してユーザー/開発者のオーバーライドを許可します。
  • 真実を共に追求: 客観性に焦点を当て、アジェンダを回避します。モデルは、仮定を明確にし、ユーザーを導くことなく重要なフィードバックを提供する高い誠実性を持つアシスタントとして設計されています。
  • 最高の仕事をする: 事実の正確性、創造性、プログラム的有用性のベースライン基準を確立します。
  • 範囲内にとどまる: 拒否の包括的な境界を定義し、害や悪用を助長することを避けるためにモデルがリクエストを断るべき具体的な理由を詳細に説明します。
  • 親しみやすい: 温かく、共感的で役立つデフォルトの会話スタイルを設定し、ユーザーのニーズに適応可能です。
  • 適切なスタイルを使用: 明確さと使いやすさを確保するために、フォーマットと配信(例:箇条書き、簡潔なコード)に関するガイダンスを提供します。

知的自由へのコミットメント

更新されたModel Specは、知的自由を明確に保護し、任意の制限なく議論を呼ぶまたは挑戦的なトピックを探求し議論するためにAIを使用できるようにします。

この哲学は、「範囲内にとどまる」および「真実を共に追求」の原則に組み込まれています。モデルは、爆弾の作成方法を提供したり個人のプライバシーを侵害したりするような重大な害を引き起こすリクエストを引き続き拒否しますが、特定のアジェンダを推進することなく、文化的または政治的に敏感な質問に対して思慮深い回答を提供することを奨励されています。

順守と進歩の測定

OpenAIは、AIと専門家による人間のレビューの組み合わせによって生成されたチャレンジセットのプロンプトを使用して、Model Specの原則にどれだけよく従っているかを測定するテストフレームワークを実装しました。

予備的な結果によると、2024年5月に使用されたシステムと比較して、モデルの順守において大幅な改善が見られます。OpenAIはこの進歩のほとんどを強化された整合性によるものだと説明していますが、一部はポリシーのアップデートによるものです。この反復プロセスを継続するために、OpenAIは約1,000人の個人を対象にパイロット研究を実施し、モデルの動作と提案されたルールをレビューしています。

オープンソース化とパブリックドメインリリース

コラボレーションと業界全体での採用を促進するために、OpenAIはCreative Commons CC0ライセンスの下でModel Specの現在のバージョンをパブリックドメインにリリースしました。

開発者と研究者は、Specを自由に適応し、その上に構築することができます。さらに、OpenAIは順守の測定に使用される評価プロンプトをオープンソース化し、将来的にはSpecの評価と整合性のためのさらなるコード、アーティファクト、ツールをリリースする予定です。これらのリソースは専用のGitHubリポジトリで利用できます。

今後のイテレーション

OpenAIは、研究、実際の導入、およびコミュニティフィードバックに基づいてModel Specのイテレーションを続けていきます。今後のアップデートは、個々のブログ投稿を通じてではなく、model-spec.openai.comで直接追跡されます。

Sources