OpenAIとBroadcomがJalapeño LLM推論チップを発表

OpenAIとBroadcomがJalapeño LLM推論チップを発表

OpenAIとBroadcomは、LLM推論のために特別に設計された最初の「インテリジェンスプロセッサ」であるJalapeñoを発表しました。このカスタムアクセラレータは、フロンティアLarge Language Models(LLM)の特定の要件に合わせてハードウェアレイヤーを最適化することにより、高度なAIをより高速で、より信頼性が高く、より手頃な価格にすることを目的としています。

LLM推論のための高効率アーキテクチャ

Jalapeñoは、以前のAIワークロードから適応された汎用アクセラレータではなく、LLM推論に焦点を当てたゼロベースの設計です。アーキテクチャは、フロンティアAIモデルにとって重要なカーネル、メモリムーブメント、ネットワーキング、およびサービングパターンを中心に最適化されています。

主な技術的目標と成果には以下が含まれます:

  • Performance per Watt: 初期テストでは、第1世代アクセラレータがワットあたりの性能において、現在の最先端ハードウェアよりも大幅に優れていることが示されています。
  • Hardware Utilization: 設計はデータムーブメントを削減し、コンピューティング、メモリ、ネットワークリソースのバランスを取ることで、ハードウェアの理論的ピーク性能に近い実現利用率を達成します。
  • Full-Stack Integration: このチップは、OpenAIの内部ロードマップ(モデル、カーネル、サービングシステム、製品ニーズ)に基づいて、すべてのLLMと動作するように設計されています。

エンジニアリングサンプルは現在、生産目標周波数と電力でラボ内でMLワークロードを実行しており、GPT-5.3-Codex-Sparkモデルも含まれています。

開発サイクルの加速

Jalapeñoは、初期設計から製造テープアウトまでわずか9か月で開発されました。OpenAIはこれを、高性能先進半導体においてこれまでで最も速いASIC開発サイクルの可能性があると説明しています。この急速なスケジュールは以下によって実現されました:

  • Software-Hardware Co-development: OpenAIエンジニアリングチームとBroadcomのシリコン実装専門知識の間での緊密な協力。
  • AI-Driven Design: OpenAI独自のモデルが設計と最適化プロセスの一部を加速するために使用されました。 -n- Industrialization Partners: Broadcomはシリコン実装およびネットワークテクノロジー(Tomahawk networking silicon)を提供し、Celesticaはボード、ラック、およびシステム統合の専門知識を提供しました。

戦略的含意と展開

Jalapeñoは、マルチジェネレーションコンピューティングプラットフォームの最初のイテレーションです。戦略は、チップアーキテクチャ、カーネル、メモリシステム、ネットワーキング、スケジューリングを含むフルスタックインフラストラクチャを構築し、コンピューティングリソースの豊富さを高めることです。

展開タイムライン

  • Initial Deployment: 2026年末に予定されています。
  • Scale: このプラットフォームは、Microsoftおよびその他のパートナーと提携して、「ギガワットスケール」のデータセンターへの展開を意図しています。

エンドユーザー体験への影響

コンピューティング効率を向上させ、コストを削減することにより、OpenAIはこれらのハードウェア改善が直接ユーザーに向けた利益に変換されることを意図しています:ChatGPTでの応答時間の高速化、Codexでのより複雑なタスク実行、そして開発者および企業向けのより手頃な価格のAPI製品。

Sources