OpenAI o1-preview リリースノート / 新機能

OpenAI は o1 シリーズを導入しました。これは、応答前に「考える」時間を長く取るよう設計された新しいクラスの AI モデルです。この推論中心のアーキテクチャへのシフトにより、従来のモデルよりもはるかに難しい科学、コーディング、数学の問題を解くことが可能になります。

推論能力とパフォーマンス

OpenAI の o1 モデルは、考えるプロセスを洗練し、ミスを認識し、最終回答を出す前にさまざまな戦略を試すように訓練されています。このアプローチにより、技術領域でのパフォーマンスが大幅に向上しました。

  • Mathematics: 国際数学オリンピック(IMO)の予選試験で、推論モデルは 83% の得点を取り、GPT-4o は 13% だった。
  • Coding: モデルは Codeforces コンペティションで 89 パーセンタイルに達した。
  • Science: 物理学、化学、生物学の難しいベンチマークタスクにおいて、次のモデルアップデートは博士課程の学生と同等の性能を示す。

多くの一般的なタスクでは、o1-preview が現在ウェブ閲覧、ファイルアップロード、画像サポートといった機能を欠いているため、GPT-4o の方が短期的には依然としてより高性能です。

安全性とアラインメント訓練

OpenAI は、モデル自身の推論能力を活用してアラインメントガイドラインに従う新しい安全性訓練アプローチを導入した。コンテキスト内で安全規則を推論することで、モデルはそれらをより効果的に適用できる。

「ジェイルブレイキング」(安全規則を回避しようとする試み)に関する社内テストでは、顕著な改善が見られた。o1-preview モデルは 0〜100 のスケールで 84 点を取得し、GPT-4o は 22 点だった。

これらの機能を支えるために、OpenAI は以下のガバナンス措置を統合しました:

  • Preparedness Framework: 厳格なテストと評価。
  • External Collaboration: 米国および英国の AI Safety Institute と正式な協定を結び、モデルの研究版への早期アクセスを提供した。
  • Internal Review: Safety & Security Committee が実施する取締役会レベルのレビュー プロセス。

モデルバリエーション: o1-preview と o1-mini

OpenAI は、パフォーマンスと効率性のバランスを取るために、推論シリーズの 2 つのバージョンをリリースしています:

  • OpenAI o1-preview: 複雑で多段階の問題に対応する主要な推論モデル。
  • OpenAI o1-mini: コーディングに特化して最適化された、より高速で低コストな代替モデル。o1-preview より 80% 安価で、広範な世界知識を必要とせずに推論が必要なアプリケーション向け。

利用可能性とアクセス

o1 シリーズへのアクセスは、さまざまな層で段階的に展開されています:

  • ChatGPT Plus and Team: モデルピッカーから o1-preview と o1-mini にアクセス可能。2024年9月17日現在、レートリミットは o1-preview が週 50 クエリ、o1-mini が日 50 クエリ。
  • ChatGPT Enterprise and Edu: 初回の 9 月 12 日リリースの翌週からアクセスが開始された。
  • Developers: 使用量ティア 5 のユーザー向けに API アクセスが提供され、初期レートリミットは 20 RPM。現在の API は関数呼び出し、ストリーミング、システムメッセージをサポートしていない。
  • Free Users: OpenAI は o1-mini のアクセスをすべての ChatGPT Free ユーザーに提供する計画である。

今後のロードマップ

OpenAI は GPT シリーズと並行して o1 シリーズの開発を継続する。o1 モデルに計画されている改善点として、ウェブ閲覧、ファイルアップロード、画像アップロード機能の追加がある。

Sources