Opus 5.5 bereits auf 94,2 % der Startleistung auf NerfBench gesunken
Währenddessen halten Sonnet 5.5 und GPT-6.1 Sol immer noch über 100%
Die Nerf-Belege stapeln sich weiter
Macht Anthropic schon wieder den klassischen Lockvogel-und-Tausch? Launch-Hype → stiller Leistungsabfall
Wenn du auf Opus Produktions-Workloads ausführst, solltest du vielleicht deine Benchmarks überprüfen
Währenddessen halten Sonnet 5.5 und GPT-6.1 Sol immer noch über 100%
Die Nerf-Belege stapeln sich weiter
Macht Anthropic schon wieder den klassischen Lockvogel-und-Tausch? Launch-Hype → stiller Leistungsabfall
Wenn du auf Opus Produktions-Workloads ausführst, solltest du vielleicht deine Benchmarks überprüfen