Velvet Flash 0.1 zieht eine Linie, die zählt. Ein Modell, das über Krypto sprechen kann, ist noch kein Modell, das Krypto auch tatsächlich ausführen kann.

@velvet_capital testet, ob menschliche Absicht zu einer exakten, plattformspezifischen finanziellen Aktion werden kann.

Der Test gibt einem Modell ein Dokument mit Plattform-Fähigkeiten sowie eine Anfrage in natürlicher Sprache. Es muss den richtigen Befehl auswählen, den exakten Betrag, Token, Chain und die Adresse extrahieren, riskante Anfragen kennzeichnen und bestätigen, bevor Gelder bewegt werden. Das ist eine völlig andere Aufgabe als die, eine klug klingende Antwort zu geben.

Flash ist ein 4B-Modell. Im internen Crypto-Skills-Benchmark von Velvet erzielte es 50 gegenüber 23 für sein Basis-Modell, während die Sicherheit von 28 auf 61 stieg. Der entscheidende Punkt ist nicht die Rangliste. Entscheidend ist, was der Benchmark bestraft: falsche Parameter, unsichere Geldbewegungen, schlechtes Routing und das Versäumnis, sich zu stoppen, wenn die Anfrage nicht fortgesetzt werden sollte.

Das Kern-Set umfasst Minara, Binance Spot, OKX DEX, Uniswap, GMX und MetaMask, mit einer breiteren Bewertung über 31 Plattformen hinweg. Jede Plattform hat ihre eigene operative Grammatik. Daher ist das eigentliche Problem: Interoperabilität—kann eine einzige menschliche Anfrage die Übersetzung über verschiedene Befehle, Parameter und Sicherheitsregeln hinweg überstehen, ohne ihre Bedeutung zu verlieren?

Flash 0.1 ist immer noch eine erste Version und das ist der eigene Benchmark von Velvet. Es beweist keine fehlerfreie Leistung, keine Profitabilität oder keinen Produktions-Support über alle 31 Plattformen. Aber die Richtung ist größer als eine einzelne Modellveröffentlichung: Finanz-KI wird nützlich, wenn ich zuverlässig verstehe, was du meinst, zuverlässig in „Ich weiß genau, welche Operation du meinst“ übergeht—und wenn ich weiß, wann ich sie nicht ausführen sollte.