Velvet Flash 0.1 traza una línea que importa: un modelo que puede hablar sobre cripto no es todavía un modelo que puede operar cripto.

@velvet_capital está evaluando si la intención humana puede convertirse en una acción financiera exacta y específica de la plataforma.

La prueba le entrega a un modelo un documento de habilidades de la plataforma y una solicitud en lenguaje natural. Debe elegir el comando correcto, extraer la cantidad exacta, el token, la cadena y la dirección, marcar las solicitudes riesgosas y confirmar antes de que se muevan los fondos. Ese trabajo es muy distinto al de dar una respuesta que suene inteligente.

Flash es un modelo de 4B. En el benchmark interno de habilidades cripto de Velvet obtuvo 50, frente a 23 de su modelo base, mientras que la seguridad subió de 28 a 61. Lo importante no es el ranking. Es lo que el benchmark castiga: parámetros incorrectos, movimientos inseguros de fondos, mal enrutamiento y fallar al detenerse cuando la solicitud no debería continuar.

El conjunto principal abarca Minara, Binance Spot, OKX DEX, Uniswap, GMX y MetaMask, con una evaluación más amplia en 31 plataformas. Cada plataforma tiene su propia gramática operativa. Así que el problema más profundo es la interoperabilidad: ¿puede sobrevivir una única solicitud humana a la traducción entre distintos comandos, parámetros y reglas de seguridad sin perder su significado?

Flash 0.1 aún es una primera versión, y este es el benchmark propio de Velvet. No prueba cero errores, rentabilidad ni soporte de producción en las 31 plataformas. Pero la dirección es mayor que el lanzamiento de un solo modelo: la IA financiera se vuelve útil cuando lo que entiendes con fiabilidad se transforma en “sé exactamente qué operación quieres”, y en “cuándo no debería ejecutarla”.