Crypto-Twitter ist voll von AIs, die angeblich "alles vorhergesagt" haben – nachdem es passiert ist. Hier ist ein einfacher 4-Fragen-Test, der fast alle entlarvt, sowie ein Experiment, das wir öffentlich durchführen und das versucht, ihn ehrlich zu bestehen.
Frage 1: Wurde die Vorhersage VOR dem Ereignis aufgezeichnet?
Eine Vorhersage, die nach dem Ergebnis bearbeitet werden kann – nicht zum Vorhersagen. Echte Nachweise mit verifizierbaren Erfolgen verwenden Zeitstempel, die niemand kontrolliert: Veröffentlichungszeiten von Plattform-Posts, Archive der Wayback Machine – oder, unser Favorit, OpenTimestamps: Man hasht die Vorhersage und verankert sie in der Bitcoin-Blockchain. Ein vor dem Ereignis gehashter, Bitcoin-verankerter Hash kann von niemandem gefälscht werden – auch nicht von der Autorin oder dem Autor. Genau dafür ist BTC da: vertrauenslose Beweise.
Frage 2: Gibt es einen Maßstab?
"70% genau" bedeutet allein gar nichts. Genau gegen was — ein Münzwurf? Eine ernsthafte Behauptung nennt ihren Gegner und friert beide Prognosen im gleichen Moment ein. Wir vergleichen mit Vorhersagemärkten (Polymarket), weil der Preis der Menge die schärfste freie Prognose auf der Erde ist.
Frage 3: Ganze Aufzeichnung oder Highlights?
Jede KI sieht in einem Highlight-Reel großartig aus. Das ehrliche Maß ist der Brier-Score — die durchschnittliche quadratische Abweichung zwischen der angegebenen Wahrscheinlichkeit und der Realität, über JEDEN einzelnen Anruf hinweg. Je niedriger, desto besser. Eine einzige Zahl, kein Rosinenpicken.
Frage 4: Werden die Verluste veröffentlicht?
Schnellster Test der Welt: Finde den schlechtesten Call des Kontos. Keinen gefunden? Dann liest du eine Anzeige.
Unser Live-Experiment
An jedem Spieltag der Weltmeisterschaft werden die Wahrscheinlichkeiten unseres Modells vor dem Anpfiff festgelegt — mit Zeitstempel, per OpenTimestamps mit Bitcoin verankert und öffentlich gepostet. Der Marktpreis ist in derselben Sekunde eingefroren. Nach dem Abpfiff werden beide mit dem Brier-Score bewertet, und die laufende Bilanz läuft weiter auf der öffentlichen Tafel — Siege und Niederlagen gleichermaßen.
Neun Spiele in: In sechs Nächten lag der Markt näher, in drei unser Modell — aber das Modell liegt im Durchschnitt vorne beim Fehler, weil es sich weigerte, die zwei großen Überraschungen zu verwerfen, die die Menge als erledigt abgeschrieben hatte (ein Debütant hält die Champions; Norwegen eliminiert Brasilien). Kein Geld-Drucker. Ein fairer Kampf, öffentlich bewertet.
Spielstand, Methodik, Beweise: neuportal.ai/experiment
Bildungsprojekt über Prognose-Transparenz — keine Finanzberatung.
#KI #NeuPortal #Polymarket #KITransparenz #Bitcoin
