広告枠(320×50) 広告枠(728×90 相当)
← トップへ

5分ニュース

【5分ニュース】OpenAIのJalapeñoが推論チップ比較で高い処理量を記録

前提知識

AIの回答を作る計算を担う推論チップで、処理量と電力効率を比べる動きが進む。OpenAIのJalapeño(AIの回答生成向けにOpenAIが開発するチップ)は、比較試験で高い処理量を記録した。OpenAIは、応答時の待ち時間を減らす設計も採ったとしている。

3行サマリー

  • Jalapeñoは比較試験で、利用者当たりの処理量と電力効率が高かった。
  • データ移動と通信の待ち時間を減らす設計を採った。
  • 2026年末に小規模展開し、2027年に規模を広げる見込みだ。

狙った目的・効用

OpenAIのJalapeñoは、SemiAnalysisのAI推論チップの性能を比べる試験で、利用可能な最先端の推論プロセッサーを上回る処理量を記録した。比較対象のNvidia Blackwellシステムより、利用者当たりに処理できるトークン数と、電力当たりの処理量が高かったと記事は報じた。ここでトークンは、AIが文章を読む際や作る際に扱う文字のまとまりを指す。 以前は性能の詳しい比較結果が示されていなかったが、今回はHot Chipsで初回の結果が公開された。OpenAIは、入力を読み取る段階と通信の段階で生じる待ち時間を小さくするよう設計したとしている。データ移動と通信遅延を減らし、回答生成中の情報を含むモデル状態を手元の計算機に保持する。各段階に合う計算資源、記憶装置、通信網を組み合わせて動かす仕組みだ。 OpenAIは半導体を設計する企業と協力して開発した。OpenAIのハードウェア責任者Richard Hoは、2026年末に小規模展開を始め、2027年に規模を広げると見積もった。数値の詳細や実際の展開時期は、今回の情報では確定していない。なお、収集情報には「state-of-the」と「最新水準」という語も含まれるが、これは最高水準の製品を指す表現である。

活用チェックポイント

  • 情報システム部門は、AI利用時の待ち時間を記録しているか?
  • 利用部門は、回答速度が必要な業務を分けているか?
  • 調達部門は、AIサービスの基盤変更を把握できるか?
  • 法務部門は、入力データの保存条件を確認できるか?
  • 管理者は、AI利用量が増えた時の制限を設定できるか?

出典

関連記事