要約
OpenAIはHot Chips会議で新しいJalapeñoチップの詳細な情報と初期のベンチマーク結果を発表しました。このチップは、AIタスクの処理能力を向上させるために設計されており、ユーザーあたりのトークン数とキロワットあたりのスループットが、現在の最先端の推論プロセッサを上回ることが確認されました。OpenAIのハードウェア責任者であるリチャード・ホ氏は、Jalapeñoが電力あたりのAI処理量を増加させるとともに、応答時間も短縮する効率的なシステムであると述べています。
Jalapeñoは、NvidiaのBlackwellシステムと比較されていますが、完全な展開が2026年末に予定されており、2027年にはより大規模な展開が見込まれています。OpenAIはBroadcomと協力してこのチップを開発し、AI製品やモデル、チップ、メモリが一体となったマルチジェネレーションプラットフォームを目指しています。
このフルスタックアプローチにより、OpenAIは推論処理中に発生する遅延を最小限に抑えることに成功しました。特に、データ移動と通信の遅延を軽減するように設計されており、モデルの状態とKVキャッシュがローカルに保存されることで、各推論段階において必要な計算、メモリ、ネットワークの組み合わせが最適化されます。
公開日: Tue, 25 Aug 2026 14:22:04 +0000
この記事はAIアシスト編集により作成されています。
📰 元記事: 元記事を読む