Grok Voice belegt Platz 1 auf der Task-Success-Rate-Leaderboard von Artificial Analysis

Grok Voice Think Fast 2.0 (High) erzielte 94,6%

Und liegt damit vor GPT-Live/Astra, Gemini Live, GPT-Realtime und jedem anderen Modell auf dem Leaderboard

Und dieser Benchmark misst tatsächlich, ob der Voice-Agent die Aufgabe erfolgreich abschließt – mit dem richtigen abschließenden Tool-Call

Nicht nur, wie gut die Stimme klingt... sondern ob er die Arbeit wirklich erledigt

Grok führt das Feld bei #1 an