Velvet Flash 0.1 trace une ligne qui compte. Un modèle capable de parler de crypto n’est pas encore un modèle capable d’opérer la crypto.
@velvet_capital évalue si l’intention humaine peut devenir une action financière précise, propre à une plateforme.
Le test fournit à un modèle un document de compétences pour une plateforme, plus une demande formulée en langage naturel. Il doit choisir la bonne commande, extraire le montant exact, le token, la chaîne et l’adresse, signaler les requêtes à risque, et confirmer avant que les fonds ne bougent. C’est un travail très différent de donner une réponse qui sonne intelligente.
Flash est un modèle de 4B. Sur le banc d’essai interne de compétences crypto de Velvet, il a obtenu 50 contre 23 pour son modèle de base, tandis que la sécurité passait de 28 à 61. La partie importante n’est pas le classement. Ce que le banc d’essai sanctionne : de mauvais paramètres, un mouvement de fonds non sûr, un mauvais routage et l’incapacité à s’arrêter quand la requête ne devrait pas continuer.
Le socle couvre Minara, Binance Spot, OKX DEX, Uniswap, GMX et MetaMask, avec une évaluation plus large sur 31 plateformes. Chaque plateforme a sa propre grammaire opérationnelle. Le problème fondamental est donc le suivant : l’interopérabilité. Une seule demande humaine peut-elle survivre à la traduction entre différentes commandes, paramètres et règles de sécurité sans perdre son sens ?
Flash 0.1 est encore une première version, et c’est le propre banc d’essai de Velvet. Il ne prouve pas l’absence d’erreurs, la rentabilité ni un support en production sur l’ensemble des 31 plateformes. Mais la direction est plus vaste que la sortie d’un seul modèle : l’IA financière devient utile quand je comprends de façon fiable ce que vous voulez dire se transforme en je sais exactement quelle opération vous entendez, et quand je ne dois pas l’exécuter.
@velvet_capital évalue si l’intention humaine peut devenir une action financière précise, propre à une plateforme.
Le test fournit à un modèle un document de compétences pour une plateforme, plus une demande formulée en langage naturel. Il doit choisir la bonne commande, extraire le montant exact, le token, la chaîne et l’adresse, signaler les requêtes à risque, et confirmer avant que les fonds ne bougent. C’est un travail très différent de donner une réponse qui sonne intelligente.
Flash est un modèle de 4B. Sur le banc d’essai interne de compétences crypto de Velvet, il a obtenu 50 contre 23 pour son modèle de base, tandis que la sécurité passait de 28 à 61. La partie importante n’est pas le classement. Ce que le banc d’essai sanctionne : de mauvais paramètres, un mouvement de fonds non sûr, un mauvais routage et l’incapacité à s’arrêter quand la requête ne devrait pas continuer.
Le socle couvre Minara, Binance Spot, OKX DEX, Uniswap, GMX et MetaMask, avec une évaluation plus large sur 31 plateformes. Chaque plateforme a sa propre grammaire opérationnelle. Le problème fondamental est donc le suivant : l’interopérabilité. Une seule demande humaine peut-elle survivre à la traduction entre différentes commandes, paramètres et règles de sécurité sans perdre son sens ?
Flash 0.1 est encore une première version, et c’est le propre banc d’essai de Velvet. Il ne prouve pas l’absence d’erreurs, la rentabilité ni un support en production sur l’ensemble des 31 plateformes. Mais la direction est plus vaste que la sortie d’un seul modèle : l’IA financière devient utile quand je comprends de façon fiable ce que vous voulez dire se transforme en je sais exactement quelle opération vous entendez, et quand je ne dois pas l’exécuter.
