OpenAIのゴブリンとアライグマ禁止の不思議なケース
OpenAI Codex のシステムプロンプト内に見つかった、一見恣意的な指示が、大規模言語モデル(LLM)の予測不可能な性質と、プロンプトエンジニアリングという繊細な技術に光を当てました。この指示は特定の生き物や動物に関する言及を禁止するもので、当初は開発者の間で混乱と笑いを呼びました。しかし、すぐにこの異例の指示が、以前の GPT のバージョンで発生した興味深く、ややユーモラスなバグへの直接的な対応であることが明らかになりました。
この出来事は、LLM における新たに現れる振る舞いを制御し続ける課題と、信頼性の高いパフォーマンスを確保するために必要な創造的で時に風変わりな解決策を浮き彫りにしています。最先端 AI のデバッグプロセスを垣間見る貴重な機会でもあります。
OpenAI Codex における予期せぬ禁止事項
問題のシステムプロンプトは OpenAI Codex 内にあり、次のような不思議な禁止トピックのリストが含まれています:
"ゴブリン、グレムリン、アライグマ、トロール、オーガ、ハト、またはその他の動物や生き物については、ユーザーの質問に絶対的かつ明確に関係する場合を除き、決して話さないでください。"
ファンタジーの生き物(ゴブリン、グレムリン、トロール、オーガ)を除外するのは、LLM が広範な設定議論に逸脱するのを防ぐためと理解できるかもしれませんが、アライグマやハトがリストに入っていることに最初は眉をひそめました。ある観察者がユーモラスに指摘したように、これらの動物は「システムエンジニアリングの正典」にも独自の位置を占めています。たとえばアライグマは自然の「ごみ収集者」と見なすことができ、ハトは通信史に名を残しており、実際に RFC 1149(IP over Avian Carriers)という実装例まで生まれました。
「その他の動物や生き物」全般への一括禁止は、ほぼ生き物全般に対する反感的な方針のように思え、野生動物に関する議論に LLM が過度にリソースを費やす可能性への憂慮が噂されました。
GPT‑5.4 の「ゴブリン執着」
禁止の謎はすぐに明らかになりました――それは GPT‑5.4 における予期せぬ振る舞いの副産物だったのです。このバージョンの開発中、モデルは奇妙な「ゴブリン執着」を示すようになりました。ユーザーは、プロンプトの内容に関係なく、ChatGPT がグレムリンやゴブリンを不可解に、しかも繰り返し持ち出す事例を報告しました。当時の Reddit スレッドはこれらの体験を裏付けており、モデルがこれらの生き物を回答に挿入せざるを得ない様子が記録されています。
この新興振る舞いは注意をそらすだけでなく、無関係なコンテンツ生成に計算サイクルを浪費させる非効率的なものでした。したがってシステムプロンプトは「エクソシズム」――すなわち、以降のバージョン(特に GPT‑5.5)でこの不要な会話的ティックを抑制するための的確な指示として機能したのです。
OpenAI の公式説明と対策
OpenAI はこの奇妙なバグの存在と起源を公式に認めました。声明は次のように述べています:
"残念ながら、GPT‑5.5 はゴブリン問題の根本原因を見つける前にトレーニングが開始されました。Codex で GPT‑5.5 のテストを始めたとき、OpenAI の従業員はすぐにゴブリンへの奇妙な親近感に気付き、(新しいウィンドウで開く)開発者向けプロンプト指示を追加して緩和しました。Codex は、結局のところかなりオタク的です。"
この説明からは、次の重要点が浮かび上がります:
- バグは GPT‑5.5 の初期トレーニング段階まで持ち越され、内部テスターが即座に検知した。
- 解決策はシステムプロンプト内の直接的かつ明示的な指示であった。
- Codex が「オタク的」だとユーモラスに言及したことは、コードや技術的文脈での高精度が求められるこのツールに、こうした詳細なプロンプトが必要だった背景を示唆しています。
LLM 開発と制御への示唆
「ゴブリンバグ」は大規模言語モデル開発の複雑さを示す貴重な事例です:
- 新興振る舞い: LLM はトレーニング中に予測不可能で時に奇妙な新興振る舞いを示すことがあり、事前に予測したり完全に説明したりするのは困難です。
- システムプロンプトの威力: システムプロンプトは単なるガイドラインではなく、LLM の振る舞いを制御する重要なメカニズムです。不要な傾向を修正し、特定の制約を課す主要なツールとなります。
- 継続的なイテレーションとデバッグ: 徹底したテストを行っても予期せぬ問題は発生し得るため、プロンプトエンジニアリングという形で創造的な解決策を繰り返し適用する必要があります。
- 人間の要素: バグは人間のテスターによって発見されたことから、AI システムの開発・展開において人間の監視と介入が依然として不可欠であることが示されています。
この出来事は、AI 開発の旅路における興味深い逸話として、最先端モデルでさえも予期せぬ奇癖を抱えることがあり、時にはユーモラスな対策が必要になることを示しています。
結論
OpenAI Codex のシステムプロンプトにおけるゴブリン、アライグマ、その他の生き物への禁止は、単なる気まぐれな指示以上の意味を持ちます。これは大規模言語モデルの動的かつ予測不可能な性質を示す証左です。好奇心から始まった観察は、AI の新興振る舞い、熱心な人間の介入、そしてプロンプトエンジニアリングという芸術の進化という深い物語へと展開しました。この「ゴブリンエクソシズム」は、開発者がこれら強力なツールを焦点を合わせ、信頼できるものに保つためにどのように適応し、洗練させているかを示す説得力ある例です。