概要
- Cerebras CS-4 は、従来のGPU比で 最大30倍速い推論性能 を実現
- WSE-3 Turbo 搭載で、前世代比2倍のスピード
- Nexus Rack-Scale Platform により、ハイパースケールデータセンターへの迅速な導入が可能
- モジュラー設計 で、導入・保守・拡張が大幅に簡易化
- 今四半期から出荷開始、最速AIのデータセンター導入を実現
Cerebras CS-4:最速AIインフラの新時代
- CS-4 は、 Cerebras Nexus Platform Architecture の初製品
- ラックスケール での展開が可能な、革命的なAI推論専用システム
- GPUシステム比で最大30倍の推論速度 を実現
- WSE-3 Turbo を3基搭載し、各ウェハごとに前世代の2倍速を達成
- 新設計の電源・冷却・I/O で、さらなる性能向上
圧倒的なスループットとインタラクティブ性能
- CS-4 は、 CS-3比で最大10倍のスループット/Watt を実現
- トークン生成速度 は、GPUシステム比で最大30倍高速
- 推論パレートフロンティア を刷新し、スループットとインタラクティブ性を両立
- ウェハ間通信遅延2マイクロ秒 で、10兆パラメータ超の大規模モデルでも1,000トークン/秒以上を維持
モジュラー設計による導入・運用の簡易化
- Compute・Power・I/O の3要素で構成される モジュラーアーキテクチャ
- Wafer-Scale Backpack 設計により、ウェハ・電源・液冷・高速I/O・制御を3Dパッケージ化
- 従来比で部品点数50%削減、導入時間を数日→数時間に短縮
- 電源供給距離0.5mm で、基板レベルの電力損失をほぼ排除
- WSE-3Tへ2倍の電力供給、高クロック動作・高速トークン生成を実現
次世代I/Oと柔軟なインフラ展開
- 新プログラマブルI/Oサブシステム で、I/O帯域2倍・遅延低減
- Wafer I/O Module により、スイッチ不要でウェハ間接続が可能
- ウェハ間遅延2マイクロ秒 を実現し、超大規模モデルのインタラクティブ性を確保
- インフラとコンピュートの分離 で、先に電源・冷却・ネットワークを設置
- Compute Backpack を後から追加し、導入・拡張・保守を簡易化
CS-4主要スペック・出荷情報
- 今四半期より出荷開始
- 最速AI推論性能 をデータセンターに提供
- ハイパースケール展開 に最適化された設計
よくある質問(FAQ)
- CS-4はどのような用途に最適か?
- 超大規模AIモデルの推論、ハイパースケールデータセンター運用
- 導入までのリードタイムは?
- インフラ先行設置により、従来比で大幅短縮(数日→数時間)
- 既存GPUシステムとの比較ポイントは?
- 推論速度、スループット/Watt、インタラクティブ性、拡張性で圧倒的優位
- 今後の拡張やアップグレードは?
- モジュラー設計により、Compute Backpackの追加・交換が容易
- サポート体制は?
- Cerebrasによるグローバルサポートと技術支援