🚨 ON-CHAIN-WARNUNG: Grok 4.5 fordert Claude Opus mit einer preiswerten Strategie heraus
SpaceXAI’s Grok 4.5 wird als kosteneffiziente Lösung positioniert: Es kostet 2 US-Dollar pro einer Million Input-Tokens und 6 US-Dollar pro einer Million Output-Tokens – deutlich weniger als Claude Opus 4.8 mit 5–30 US-Dollar pro Million Tokens. Elon Musk erkennt an, dass Grok 4.5 Opus 4.7 entspricht, aber schneller ist; dafür opfert es einige komplexe Verarbeitungsfähigkeiten zugunsten der Geschwindigkeit.
Die Benchmark-Leistung von Grok 4.5 ist durchwachsen: Es erreicht 53% auf DeepSWE 1.1 und 64,7% auf SWE Bench Pro und liegt damit über GPT-5.5. Der Vergleich zu GPT-5.5 statt zur neu veröffentlichten 5.6-Version legt jedoch nahe, dass SpaceXAI nach einem Lichtblick in einem ungleichen Wettbewerb sucht.
Der Kompromiss spiegelt Musks pragmatischen Ansatz wider: Fokus auf das Segment „gut genug & günstig“, das den täglichen Bedarf der Tesla- und SpaceX-Engineering-Teams abdeckt. Die Stärke von Grok 4.5 liegt in seiner Token-Effizienz: Es verwendet 15.954 Output-Tokens pro Aufgabe auf SWE Bench Pro, im Vergleich zu 67.020 Tokens bei Opus 4.8 – das ergibt einen 4,2-fachen Unterschied.
#halvingjobs #KünstlicheIntelligenz
SpaceXAI’s Grok 4.5 wird als kosteneffiziente Lösung positioniert: Es kostet 2 US-Dollar pro einer Million Input-Tokens und 6 US-Dollar pro einer Million Output-Tokens – deutlich weniger als Claude Opus 4.8 mit 5–30 US-Dollar pro Million Tokens. Elon Musk erkennt an, dass Grok 4.5 Opus 4.7 entspricht, aber schneller ist; dafür opfert es einige komplexe Verarbeitungsfähigkeiten zugunsten der Geschwindigkeit.
Die Benchmark-Leistung von Grok 4.5 ist durchwachsen: Es erreicht 53% auf DeepSWE 1.1 und 64,7% auf SWE Bench Pro und liegt damit über GPT-5.5. Der Vergleich zu GPT-5.5 statt zur neu veröffentlichten 5.6-Version legt jedoch nahe, dass SpaceXAI nach einem Lichtblick in einem ungleichen Wettbewerb sucht.
Der Kompromiss spiegelt Musks pragmatischen Ansatz wider: Fokus auf das Segment „gut genug & günstig“, das den täglichen Bedarf der Tesla- und SpaceX-Engineering-Teams abdeckt. Die Stärke von Grok 4.5 liegt in seiner Token-Effizienz: Es verwendet 15.954 Output-Tokens pro Aufgabe auf SWE Bench Pro, im Vergleich zu 67.020 Tokens bei Opus 4.8 – das ergibt einen 4,2-fachen Unterschied.
#halvingjobs #KünstlicheIntelligenz
