Cerebras、750PFLOPSの「CS-4」発表 AI推論を最大30倍高速化

Cerebras、750PFLOPSの「CS-4」発表 AI推論を最大30倍高速化

※記事を視覚化したイメージであり、実際の事象とは異なります。

本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。[続きを表示]特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]

Cerebras Systemsは2026年8月18日(米太平洋時間)、AI推論向けラックスケールシステム「CS-4」を発表した。3基のWafer Scale Engine 3 Turbo(WSE-3T)を搭載し、同社比較ではGPT-OSS-120Bの1ユーザー当たり生成速度がGPU系システムの最大30倍に達するという。

3基のWSE-3Tを1ラックに搭載

CS-4は、新しい「Nexus」ラックスケール基盤の第1弾。各WSE-3Tは4兆個のトランジスタ、90万個のAI向けコア、44GBのオンチップSRAMを備え、CS-4全体では750PFLOPSのAI演算性能、129.6PB/sのメモリー帯域、7.2Tb/sのI/O帯域をうたう。

従来のCS-3は1基のWSE-3を中核としていたが、CS-4は3基のWSE-3Tを1ラックに統合する。Cerebrasは、演算、電源、I/Oをモジュール化し、データセンターへの導入を効率化したとしている。

GPT-OSS-120Bで「最大30倍」

Cerebrasによると、GPT-OSS-120Bに同一のプロンプトを与えた比較で、CS-4は1ユーザー当たり毎秒4400トークン超を生成し、GPU系システムの最大30倍に達した。実際の速度はモデル構造、コンテキスト長、精度、提供構成などで変わるため、全用途で30倍の性能差があることを意味しない。

同社はまた、CS-3比で最大2倍の生成速度、最大10倍のワット当たりスループットをうたう。初回出荷は2026年第3四半期に始める予定としている。

参考・出典

本サイトの記事や画像は、AIが公的資料や複数の報道を基に事実関係を整理・再構成し制作したものです。特定の報道内容や表現を再利用・要約することを目的としたものではありません。ただし、誤りや不確定な情報が含まれる可能性がありますので、参考の一助としてご覧いただき、実際の判断は公的資料や各出典元の原文をご確認ください。[私たちの取り組み]

ニュースはAIで深化する—。日々の出来事を深掘りし、次の時代を考える視点をお届けします。

本サイトの記事や画像はAIが公的資料や報道を整理し制作したものです。
ただし誤りや不確定な情報が含まれることがありますので、参考の一助としてご覧いただき、
実際の判断は公的資料や他の報道を直接ご確認ください。
[私たちの取り組み]