概要
- Cerebras と OpenAI が新サービス Ultrafast Mode を発表
- GPT-5.6 Sol がUltrafastで最大750トークン/秒の出力を実現
- 応答速度と品質のトレードオフ を解消する画期的な技術
- 法務・金融・エンジニアリング など幅広い業務で高速化を実証
- 限定プレビュー として一部顧客向けに提供開始
Ultrafast Mode:次世代AI推論の新基準
- Ultrafast Mode は、OpenAI APIの新しいサービス階層として登場
- Cerebras の技術により、初期は選定顧客のみ利用可能で、今後順次拡大予定
- GPT-5.6 Sol がUltrafastで最大 750トークン/秒 の出力速度を実現
- 品質劣化なし で、ミッションクリティカルな作業の高速化を可能に
- 速度と知性のトレードオフ を解消し、従来のAIモデルの課題を克服
ベンチマークと実績
- GPT-5.6 Sol Ultrafast は、Fable 5の11倍、Opus 4.8 Fastの5倍の速度を達成
- Humanity's Last Exam (HLE) ベンチマークで2,500問を 11時間11分 で完答
- 同条件で Claude Fable 5 は 78時間27分 を要する
- 約7倍の高速化 で同等精度を実現
- GDP-Val (経済価値の高いタスク向けベンチマーク)で 5.6倍の高速化 と品質維持を確認
主要ユースケースと価値
- 法務文書、財務モデル、エンジニアリングレポート など高品質・高速推論が求められる分野に最適
- リアルタイム分析・障害対応・サイバー攻撃検知 など、即応性が重要な業務で大きな効果
- エージェント活用 による新たな業務形態や、複数セッションの同時活用を促進
- 生産性向上 :従来数分かかっていたタスクが瞬時に完了
技術的ブレークスルー
- Cerebras Wafer-Scale Engine アーキテクチャを採用
- 44GB SRAM を1チップに搭載し、モデル重みをオンチップ保持
- トークン生成のデータ転送ボトルネック を解消
- モデルサイズの増大にもスムーズに対応可能な拡張性
- 将来の大規模AIモデル でも継続的な速度優位性を確保
今後の展開と利用方法
- Ultrafast Mode は現在 限定プレビュー 中
- 今後利用枠を拡大 予定、アップデート情報の登録が可能
- Cerebras と OpenAI は、UltrafastによるAIイノベーションの加速を目指す