Von der Software zum Silizium

Am 24. Juni 2026 enthüllte OpenAI seinen ersten maßgeschneiderten Prozessor — ein entscheidender Schritt vom Software- zum Full-Stack-Infrastrukturanbieter. Entwickelt in Zusammenarbeit mit Broadcom in einem beschleunigten Neun-Monats-Zyklus, ist der Chip mit dem Codenamen Jalapeño ein retikelgroßer ASIC, der speziell für die Inferenz großer Sprachmodelle entwickelt wurde.

Im Gegensatz zu Nvidias Allzweck-GPUs ist Jalapeño ausschließlich für die Ausführung vortrainierter Modelle optimiert. Erste Tests zeigen eine deutlich bessere Leistung pro Watt als aktuelle Alternativen, so OpenAI.

Warum Inferenz wichtig ist

Inferenz — der Prozess der Ausführung von KI-Modellen zur Beantwortung von Anfragen — macht den Großteil der KI-Rechenkosten aus. Da OpenAI Produkte wie Codex, ChatGPT und agentische KI-Tools skaliert, haben selbst kleine prozentuale Einsparungen bei den Inferenzkosten enorme Auswirkungen auf das Geschäftsergebnis.

Full-Stack-Ambition

Jalapeño repräsentiert mehr als einen Chip: Es ist die physische Manifestation von OpenAIs Vertikalintegrationsstrategie. Das Unternehmen entwirft jetzt Chip-Architektur, Kernel, Speichersysteme, Netzwerke, Scheduling und Deployment — alles optimiert auf ein einziges Ziel: schnellere, zuverlässigere und erschwinglichere KI.

Der Chip soll Ende 2026 in Betrieb genommen werden und in den folgenden Jahren hochskalieren.