Von der Software zum Silizium
Am 24. Juni 2026 enthüllte OpenAI seinen ersten maßgeschneiderten Prozessor — ein entscheidender Schritt vom Software- zum Full-Stack-Infrastrukturanbieter. Entwickelt in Zusammenarbeit mit Broadcom in einem beschleunigten Neun-Monats-Zyklus, ist der Chip mit dem Codenamen Jalapeño ein retikelgroßer ASIC, der speziell für die Inferenz großer Sprachmodelle entwickelt wurde.
Im Gegensatz zu Nvidias Allzweck-GPUs ist Jalapeño ausschließlich für die Ausführung vortrainierter Modelle optimiert. Erste Tests zeigen eine deutlich bessere Leistung pro Watt als aktuelle Alternativen, so OpenAI.
Warum Inferenz wichtig ist
Inferenz — der Prozess der Ausführung von KI-Modellen zur Beantwortung von Anfragen — macht den Großteil der KI-Rechenkosten aus. Da OpenAI Produkte wie Codex, ChatGPT und agentische KI-Tools skaliert, haben selbst kleine prozentuale Einsparungen bei den Inferenzkosten enorme Auswirkungen auf das Geschäftsergebnis.
Full-Stack-Ambition
Jalapeño repräsentiert mehr als einen Chip: Es ist die physische Manifestation von OpenAIs Vertikalintegrationsstrategie. Das Unternehmen entwirft jetzt Chip-Architektur, Kernel, Speichersysteme, Netzwerke, Scheduling und Deployment — alles optimiert auf ein einziges Ziel: schnellere, zuverlässigere und erschwinglichere KI.
Der Chip soll Ende 2026 in Betrieb genommen werden und in den folgenden Jahren hochskalieren.
Quellen
- techcrunch.comOpenAI unveils its first custom chip, built by Broadcom — TechCrunch
- nytimes.comOpenAI and Broadcom Unveil Custom A.I. Chip Design — The New York Times
- tomshardware.comOpenAI and Broadcom unveil custom-built Jalapeño inference processor — Tom's Hardware
- openai.comOpenAI and Broadcom unveil LLM-optimized inference chip — OpenAI




