OpenAI enthüllt Jalapeno ASIC für schnellere KI-Inferenz

OpenAI stellt mit Jalapeno seinen ersten hausinternen ASIC vor, entwickelt mit Broadcom, um KI-Inferenz effizienter zu machen. Ein Muster wurde geliefert; erste Einsätze sind bis Ende 2026 geplant, breitere Rollouts folgen in späteren Jahren.

OpenAI enthüllt Jalapeno ASIC für schnellere KI-Inferenz
Reading time: 3 Minutes

Ein kompakter Chip traf diese Woche bei OpenAI ein und fühlte sich nach mehr als nur Hardware an. Es war ein Statement. Mit dem Namen Jalapeno markiert der neue ASIC OpenAIs ersten eigenen Chipversuch, entwickelt in Zusammenarbeit mit Broadcom, um die KI-Inferenz für das Unternehmen zu beschleunigen, das ChatGPT in die Welt brachte.

OpenAI bezeichnet das Design als Intelligenzprozessor und beschreibt ihn als den ersten Beschleuniger in einer Plattform, die das Unternehmen zusammenstellt, um fortgeschrittene Modelle schneller, zuverlässiger und in größerem Umfang auszuführen. Broadcom wird den Siliziumchip fertigen. OpenAI gibt an, Jalapeno in etwa neun Monaten entworfen und auch große Teile der umgebenden Rechensysteme entwickelt zu haben, in denen diese Chips laufen werden.

Warum das für KI-Rechenleistung wichtig ist

GPUs von Nvidia sind das Rückgrat moderner KI. Sie sind flexibel und leistungsstark. Allerdings haben sie hohe Preise und Lieferengpässe. ASICs tauschen einen Teil der Flexibilität gegen Effizienz und Kosteneinsparungen ein. Das macht sie attraktiv, wenn eine Arbeitslast stark optimiert werden kann. Jalapeno ist OpenAIs Wette darauf, dass sorgfältig abgestimmte Hardware mehr Rechenleistung pro Watt liefern und dem Unternehmen helfen kann, den Zugang zu fortschrittlichen Modellen zu skalieren.

Trennt sich OpenAI von Nvidia? Nicht ganz. Es ist vielmehr Diversifikation, angetrieben von einer Nachfrage, die weiter beschleunigt. Anfang dieses Jahres schloss OpenAI Vereinbarungen zur Nutzung von Amazons Trainium-Chips und unterzeichnete Partnerschaften mit AMD und Cerebras. Jetzt, mit Broadcom als Hersteller von Jalapeno, will OpenAI eine weitere verlässliche Quelle für rohe Rechenleistung hinzufügen, während es Racks mit kundenspezifischer Hardware aufbaut, die bei voller Ambition rund zehn Gigawatt Leistung erfordern könnten.

Es gibt auch praktische Meilensteine. Ein physisches Muster von Jalapeno wurde am Mittwoch geliefert. Die Unternehmen sagen, sie erwarten erste Einsätze bis Ende 2026 und breitere Rollouts in den folgenden Jahren. Wenn die Zeitpläne eingehalten werden, könnten wir den Beginn einer erheblichen Verschiebung beobachten, wie große Sprachmodelle in der Produktion bereitgestellt werden.

Broadcom spürte die Nachricht. Die Aktie stieg nach der Ankündigung um etwa zwei Prozent. Der Chiphersteller gehört zu den Gewinnern des KI-Marktes, mit Kursgewinnen von ungefähr zehn Prozent im bisherigen Jahresverlauf und einem fast siebenfachen Anstieg seit Ende 2022, da große Cloud-Anbieter und KI-Labore maßgeschneiderte Siliziumchips in Auftrag geben.

Es gibt Kompromisse. ASICs sind weniger flexibel als universelle GPUs und funktionieren daher am besten in Kombination mit einem präzisen Software- und Systemstack. OpenAIs Argument ist, dass das Unternehmen durch die eigene Gestaltung eines größeren Teils dieses Stacks bessere Effizienz erzielen und den Zugang zu leistungsfähigen KI-Tools erweitern kann. Kurz gesagt: Baue den Motor, optimiere das Fahrzeug, und du kommst weiter bei geringeren Kosten.

Der wahre Test wird die Leistung bei realen Arbeitslasten sein und wie schnell OpenAI die Produktion mit Broadcom hochfahren kann. Für den Moment ist Jalapeno ein mutiger Schritt in Richtung Hardware-Unabhängigkeit und eine Erinnerung daran, dass sich die KI-Lieferkette von Standardbauteilen zu maßgeschneiderten Plattformen entwickelt, die für eine neue Klasse von Software entwickelt wurden.

Lena Wagner

"Smartphone-Expertin mit einem Auge fürs Detail. Ich teste nicht nur die Leistung, sondern auch die Usability im Alltag."

Leave a Comment

Comments

No comments yet.