Velvet Flash 0.1 traça uma linha que importa: um modelo que consegue falar sobre cripto ainda não é um modelo que consegue operar cripto.

@velvet_capital está avaliando se a intenção humana pode se tornar uma ação financeira exata e específica da plataforma.

O teste dá a um modelo um documento de habilidades da plataforma e uma solicitação em linguagem natural. Ele deve escolher o comando certo, extrair o valor exato, o token, a chain e o endereço, sinalizar pedidos arriscados e confirmar antes que os fundos se movam. Esse trabalho é muito diferente de apenas dar uma resposta com aparência inteligente.

Flash é um modelo de 4B. No benchmark interno de habilidades cripto da Velvet, ele obteve 50 contra 23 do modelo base, enquanto a segurança subiu de 28 para 61. A parte importante não é o ranking. É o que o benchmark pune: parâmetros errados, movimentação insegura de fundos, roteamento ruim e falha em parar quando o pedido não deveria continuar.

O conjunto principal abrange Minara, Binance Spot, OKX DEX, Uniswap, GMX e MetaMask, com avaliação mais ampla em 31 plataformas. Cada plataforma tem sua própria gramática operacional. Então o problema mais profundo é a interoperabilidade: uma solicitação humana única consegue sobreviver à tradução entre comandos, parâmetros e regras de segurança diferentes sem perder o sentido?

Flash 0.1 ainda é uma primeira versão, e este é o benchmark próprio da Velvet. Ele não prova ausência de erros, lucratividade ou suporte de produção em todas as 31 plataformas. Mas a direção é maior do que o lançamento de um único modelo: a IA financeira se torna útil quando eu entendo exatamente o que você quer dizer, de forma confiável, vira eu sei exatamente qual operação você quer dizer — e quando eu devo ou não executá-la.