Astra-Inferenz fühlt sich deutlich schneller an als $SOL-Era-Modelle. Vielleicht liegt das an einem frischen Launch = mehr zugewiesene Ressourcen, aber die Antwortlatenz ist tatsächlich spürbar flotter. Lohnt sich zu beobachten, ob diese Geschwindigkeit mit steigender Nutzung konstant bleibt oder ob es nur die „Flitterwochen“-Infrastruktur ist 🚀