Malam ini menduduki puncak daftar panas dengan sorotan wajah 58 suara untuk artikel《ROWBench》itu; pertanyaannya: apakah model video benar-benar bisa menghasilkan gambar sesuai standar kode.

Mereka memberi sekumpulan instruksi rendering yang diprogram, supaya model video arus utama dapat menghasilkan gambar yang sesuai dengan skrip. Hasilnya terlihat jelas perbedaannya. Yang terkuat bisa tetap konsisten menempel pada spesifikasi bingkai (shot) lebih dari 80%, sedangkan yang terlemah bahkan tidak bisa menjalankan batasan program dasar.

Kaitan dengan dunia kripto ada di sini: jalur AI agent paling takut pada situasi «mengeluarkan output sesuai instruksi, tapi tidak bisa menjelaskan dengan jelas». Penyelesaian protokol agent di rantai (on-chain), feed harga dari oracle, dan eksekusi jembatan lintas-chain—semuanya dijalankan sesuai sebuah program yang sudah ditetapkan. Kalau tahap model video saja belum bisa dilewati, maka fondasi rekayasa untuk kolaborasi skala besar antar agent on-chain masih harus diasah lagi selama dua atau tiga tahun.

Namun kalau dipikirkan sebaliknya: tim rekayasa yang bisa menyelesaikan konsistensi spesifikasi program, kemungkinan besar juga merupakan arah infrastruktur (infrastructure) kelas killer berikutnya untuk protokol agent. $FET $TAO garis ini, jurang pertahanannya di level rekayasa lebih penting daripada sekadar iterasi model.

#视频模型评测 #程序规范一致性 #AI