Velvet Flash 0.1 menggambar garis yang berarti. Model yang bisa berbicara tentang kripto belum tentu model yang bisa mengoperasikan kripto.

@velvet_capital sedang menguji apakah niat manusia bisa menjadi tindakan finansial yang presisi dan spesifik platform.

Uji coba ini memberi model dokumen keahlian untuk suatu platform serta permintaan dalam bahasa alami. Model harus memilih perintah yang tepat, mengekstrak jumlah, token, chain, dan alamat yang persis, menandai permintaan yang berisiko, serta melakukan konfirmasi sebelum dana dipindahkan. Itu pekerjaan yang sangat berbeda dari sekadar memberikan jawaban yang terdengar cerdas.

Flash adalah model 4B. Pada benchmark keahlian kripto internal Velvet, ia mendapat skor 50 dibanding 23 untuk model dasarnya, sementara keamanan naik dari 28 menjadi 61. Bagian yang penting bukanlah papan peringkat. Yang dipermasalahkan oleh benchmark adalah: parameter yang salah, perpindahan dana yang tidak aman, routing yang buruk, dan kegagalan untuk berhenti ketika permintaan seharusnya tidak dilanjutkan.

Kumpulan utamanya mencakup Minara, Binance Spot, OKX DEX, Uniswap, GMX, dan MetaMask, dengan evaluasi yang lebih luas di 31 platform. Setiap platform memiliki tata bahasa operasionalnya sendiri. Jadi masalah yang lebih dalam adalah interoperabilitas: apakah satu permintaan manusia bisa bertahan melalui proses penerjemahan lintas perintah, parameter, dan aturan keamanan yang berbeda tanpa kehilangan maknanya?

Flash 0.1 masih versi pertama, dan ini adalah benchmark milik Velvet sendiri. Ini tidak membuktikan nol kesalahan, profitabilitas, atau dukungan produksi di semua 31 platform. Tapi arah perkembangannya lebih besar daripada rilis satu model: AI finansial menjadi berguna ketika saya memahami maksud Anda secara andal berubah menjadi saya tahu persis operasi apa yang Anda maksud, dan kapan saya tidak boleh mengeksekusinya.