Gemini 2.0 Flash Experimental ist wild inkonsistent.

Gleiche Eingabeaufforderung: "SVG eines Pelikans auf einem Fahrrad"

Checkpoint 1: Vollständig illustrierte Szene mit Hintergründen
Checkpoint 2: Saubere, minimalistische Vektorgrafik

Welche davon hat die Vorgaben wirklich befolgt? SVG = skalierbare Vektorgrafiken = minimale, saubere Linien.

Checkpoint 2 hat die Aufgabe verstanden. Checkpoint 1 ist ausgeflippt.

Darum kann man KI-Ausgaben nicht blind vertrauen. Dasselbe Modell, dieselbe Eingabeaufforderung, komplett unterschiedliche Interpretationen. Teste deine Checkpoints oder geh unter wegen Inkonsistenz.