OpenAIは2026年8月25日(現地時間)、半導体カンファレンス「Hot Chips」で、Broadcomと共同開発したAI推論チップ「Jalapeño」の初のベンチマーク結果を公開しました。推論とは、学習済みのAIモデルを動かして回答を生成する処理のことです。調査会社SemiAnalysisの公開ベンチマーク「InferenceX」において、NVIDIAの最新ラックシステムGB200 NVL72およびGB300 NVL72と比べ、電力1キロワットあたりのスループット(処理量)で1.5倍から1.9倍、応答までの遅延で1.7分の1から3.6分の1を記録したと主張しています。チップは2026年内に自社データセンターへ小規模導入を始め、2027年に本格展開する計画です。
運営者情報
AI JOURNALは一般社団法人 日本AI導入支援協会が運営する、日本企業のAI活用支援を目的としたメディアです。記事制作にあたっては、経済産業省「AI事業者ガイドライン」をはじめとする公的機関の公表情報等を参考にしています。内容の正確性には十分配慮していますが、誤りや更新漏れがある場合は、お問い合わせフォームよりご連絡ください。掲載情報は公開日時点のものであるため、最新情報は公式サイト等でご確認ください。
InferenceXベンチマークでのJalapeñoの成績

OpenAIが公開した結果によると、JalapeñoはオープンモデルのGPT-OSS-120B、DeepSeek R1、Kimi K2.5を使ったテストで、現行の最先端推論プロセッサーを上回る成績を示しました。主な数値は次の通りです。
| 指標 | NVIDIA GB200/GB300 NVL72との比較 |
|---|---|
| 電力1kWあたりのスループット | 1.5倍から1.9倍 |
| エンドツーエンドの遅延 | 1.7分の1から3.6分の1 |
| 超低遅延設定での推論速度 | 2.1倍から4.1倍 |
システム構成は1ラックに128個のアクセラレーターを搭載し、4ビット精度で1.7エクサFLOPSの演算性能、27.5TBのHBM4メモリー、毎秒約2ペタバイトのメモリー帯域を持ちます。アクセラレーター単体ではMXFP4精度で13.4ペタFLOPS、メモリー帯域は毎秒15.4TBです。
一方で英The Registerは、AMDやNVIDIAのラックが演算性能では1.46倍から2倍、メモリー容量でも12%上回ると指摘しています。またOpenAIは今回のテストで、推論を高速化する一般的な手法である投機的デコーディングを除外しており、実運用に近い条件での比較はこれからという留意点もあります。
Broadcomとの共同開発、着手から9カ月でテープアウト
JalapeñoはOpenAIがBroadcomと共同で設計した推論特化のASIC(特定用途向け半導体)で、両社の提携は2025年10月に発表されていました。開発にはOpenAI自身のAIモデルが活用され、設計着手からテープアウト(製造用データの完成)まで9カ月という短期間で到達したとしています。
設計の柱はデータ移動と通信遅延の最小化です。推論処理のうち、入力を読み込むprefill(プリフィル)と、チップ間の通信がボトルネックになりやすいことをふまえ、処理の各段階で演算・メモリー・ネットワークを協調させる構成を取りました。回答生成中はKVキャッシュ(過去のやり取りを保持する作業用メモリー)をチップの近くに置き続けることで、遅延を抑えています。OpenAIのハードウェア責任者Richard Ho氏は「Jalapeñoは電力あたりでより多くのAI処理をこなしながら、応答もより速く返せる」と述べています。
NVIDIA依存の低減と推論コスト競争への布石
OpenAIはこれまで推論基盤の大部分をNVIDIA製GPUに依存してきました。自社設計チップが電力効率でGPUを上回るなら、データセンターの電力制約が成長の上限になりつつある現状で、同じ電力からより多くの推論を取り出せることになります。ChatGPTをはじめとする自社サービスの提供コストを直接左右するため、2027年の本格展開が計画通り進むかが焦点です。
ただし今回の数値はOpenAI自身が公開したものであり、第三者による追試はこれからです。ベンチマークはチップ単体ではなくソフトウェアを含むプラットフォーム全体の比較になるため、NVIDIAやAMD側のソフトウェア最適化で差が縮む可能性もあります。GoogleのTPU、AmazonのTrainiumなど大手各社が自社チップを推進するなか、モデル開発企業が推論ハードウェアまで垂直統合する流れを象徴する発表といえます。
参考
- Jalapeño: first results(OpenAI)
- OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show(TechCrunch)
- OpenAI’s upcoming Jalapeño chip looks like it’ll be an inference beast(The Register)
- OpenAI says its Jalapeño chip beats Nvidia’s GB300 in first published benchmarks(Tom’s Hardware)





コメント