Cerebras Systems (NASDAQ: CBRS) stellte am 18. August die CS-4 vor, ihren bisher leistungsstärksten KI-Beschleuniger, der auf einer neuen Rack-Scale-Architektur namens Nexus basiert. Das System beherbergt drei WSE-3-Turbo-Wafer pro Rack — jeweils ein 46.225 mm² großer Chip mit vier Billionen Transistoren und 900.000 Rechenkernen.
Die CS-4 liefert 750 Petaflops KI-Rechenleistung, 7,2 Terabit pro Sekunde I/O-Bandbreite und 129,6 Petabyte pro Sekunde Speicherbandbreite. Cerebras behauptet, das System erreiche bis zu 30x schnellere Inferenz als GPU-basierte Lösungen und verbrauche dabei etwa 10x weniger Energie pro Token.
Die Ankündigung positioniert Cerebras als ernsthaften Herausforderer von Nvidias Dominanz bei KI-Inferenz, insbesondere bei großen Sprachmodellen, wo Token-Durchsatz und Latenz entscheidend sind. Das System kann über 1.000 Tokens pro Sekunde bei Modellen mit 10 Billionen Parametern verarbeiten.
Die ersten Lieferungen sind für Q3 2026 geplant. Die CS-4 kommt in einem Moment, in dem die Nachfrage nach KI-Inferenz-Hardware steigt und große Cloud-Anbieter und KI-Unternehmen um Rechenkapazitäten für wachsende Workloads konkurrieren.




