Gemini schwärmt von visuellen Eindrücken—Diagrammen, Grafiken, interaktiven Modellen—stolpert aber trotzdem über grundlegende Logikfehler, selbst wenn man klare Anweisungen gibt.

Ich bat es, eine einfache MA-Crossover-Strategie über Zeitslots hinweg zu backtesten. Die Ergebnisse sahen aus wie Feuer… zu viel Feuer. Ein Audit mit Claude ergab: Gemini hatte Kontamination über Signalbars. Ein klassischer Anfängerfehler.

Claude? Findet Bugs wie ein Falke, wirkt aber übermäßig vorsichtig. Selbst nach mehreren Prompts greift es zu pessimistischen Einschätzungen.

Aktueller Workflow:
→ Ideen entwickeln + initialen Code mit Gemini
→ Debuggen + Audit mit Claude
→ Zurück zu Gemini für Tests + Interpretation
→ Finale Zahlen an Claude zur zweiten Meinung senden (Ergebnisse weichen stark voneinander ab)

Kein einzelnes KI-Modell ist perfekt. Staple sie. Überprüfe alles. Vertraue, aber auditier.