OpenAI behauptet, dass sein Jalapeño-Chip die Nvidia GB300 in zwei Inferenz-Benchmarks bei 700 Watt übertroffen hat, mit einer geplanten Bereitstellung bis Ende 2026, um Kosten zu senken und die Reaktionszeiten zu verkürzen.
Wichtig zu merken
OpenAI versichert, dass Jalapeño in den Tests bei der Durchsatzrate pro Einheit Leistungsaufnahme und bei der Reaktionsgeschwindigkeit die Nase vorn hatte.
Dieser Inferenzchip mit 700 Watt soll die Kosten in Rechenzentren senken und gleichzeitig die KI-Modelle schneller bereitstellen.
Jalapeño ist nicht für das Training von Modellen ausgelegt und wurde nicht mit Nvidias neuester Vera-Rubin-Generation verglichen.
Die Benchmarks von OpenAI
OpenAI hat angegeben, dass sein hauseigener Prozessor Jalapeño in Tests die Nvidia GB300 übertroffen hat – gemessen an der Menge an KI-Berechnungen pro Einheit verbrachter Leistung sowie an der Geschwindigkeit der Antwortausgabe.
Richard Ho, Leiter der Chips bei OpenAI, erklärt, dass Jalapeño eine hohe Durchsatzrate mit geringer Latenz kombiniert, was es Kunden ermöglichen könnte, Modelle zu wählen, die entweder auf niedrigere Kosten oder auf schnellere Antworten optimiert sind.
Jalapeño wurde mit Broadcom entwickelt und erreichte diese Ergebnisse im Betrieb bei 700 Watt, so Ho. Der Energieverbrauch ist einer der wichtigsten Kostenposten von Rechenzentren.
Das könnte Sie auch interessieren: Der RWA-Markt schießt um 48,7 % nach oben – aber ein einziger Token erklärt fast alles
Die Ausgangslage bei Nvidia
Allerdings hat der Vergleich auch seine Grenzen.
Jalapeño wurde nicht gegen Nvidias neuere Vera-Rubin-Generation getestet, die bereits ausgeliefert wird, und der OpenAI-Chip ist speziell für Inferenz ausgelegt, nicht für das Training von Modellen. Nvidia bleibt zudem ein zentraler Lieferant für OpenAI.
OpenAI stützt sich außerdem für einen Teil seiner Inferenz-Workloads auf die Technologie von Cerebras Systems – insbesondere bei kleineren Modellen. Ho zufolge kann Jalapeño jedoch auch größere Modelle unterstützen. „Wir haben einen kolossalen Bedarf an Rechenleistung“, betont er.
Die öffentlichen Tests nutzten ein kleines Open-Source-Modell von OpenAI sowie Modelle von DeepSeek und Moonshot AI. Die deutlichsten Verbesserungen wären beim großen Moonshot-Modell Kimi zu sehen gewesen. Eine zweite Chip-Version ist bereits sehr weit fortgeschritten, wobei ein Tape-out in den nächsten Monaten erwartet wird, während OpenAI bereits mit den Arbeiten für eine dritte Generation begonnen hat.
Jalapeño knüpft an die Ankündigung vom 24. Juni von OpenAI mit Broadcom an, als beide Gruppen angegeben hatten, der Chip sei innerhalb von neun Monaten von der Design-Phase zum industriellen Tape-out übergegangen – mit Unterstützung der OpenAI-Modelle. Es handelte sich um die erste Generation.
Weiter: Nvidia treibt das Projekt für eine KI im Weltraum 2027 von SpaceX voran, trotz des Rückgangs der beiden Aktien
