18 Agustus, menurut pengungkapan MaxForAI, proyek AI J-Space Cognition Suite yang hari ini meledak di platform X mendapat kritik dari komunitas. Proyek ini dituduh tidak dapat direproduksi dari hasil pengujian DeepSeek V4 yang dipromosikannya. Sebelumnya, proyek tersebut mengklaim bahwa V4 Flash yang dipadukan dengan J-Space dapat menyamai GLM-5.3, sementara V4 Pro mampu melampaui Fable 5 di beberapa Agent Benchmark, serta kecepatan meningkat 2,53 kali dan efisiensi Token meningkat 2,21 kali.
Pengguna GitHub GoForceX melakukan pengujian ulang dengan konkurensi tinggi menggunakan subset 87 soal dari Terminal Bench 2.1, dan memastikan modul terkait J-Space berhasil dimuat. Hasilnya menunjukkan bahwa setelah J-Space ditambahkan, skor Benchmark justru sedikit menurun. Penggunaan serta biaya Token juga meningkat, yang berlawanan dengan arah peningkatan performa, kecepatan, dan efisiensi Token yang diklaim proyek.
Komunitas kemudian meminta proyek untuk mempublikasikan konfigurasi evaluasi lengkap, hasil per soal, log eksekusi, waktu asli, serta data konsumsi Token. Saat ini, proyek terutama hanya menyediakan ringkasan hasil, belum menawarkan catatan eksperimen orisinal lengkap yang cukup untuk memverifikasi angka-angka presisi tersebut. Perlu dicatat bahwa menanggapi tuduhan, penulis proyek pernah menjawab bahwa data terkait «memang dibesar-besarkan», dan menyatakan peningkatan aktual kira-kira berada di kisaran 1,6 kali hingga 3 kali. Hingga saat ini, penulis belum memberikan respons resmi terhadap kritik komunitas, dan beberapa Issue terkait telah dihapus.
🧧🧧🧧回复221获得$SOL 🧧🧧🧧
🎁🎁🎁👇👇👇🎁🎁🎁
Pengguna GitHub GoForceX melakukan pengujian ulang dengan konkurensi tinggi menggunakan subset 87 soal dari Terminal Bench 2.1, dan memastikan modul terkait J-Space berhasil dimuat. Hasilnya menunjukkan bahwa setelah J-Space ditambahkan, skor Benchmark justru sedikit menurun. Penggunaan serta biaya Token juga meningkat, yang berlawanan dengan arah peningkatan performa, kecepatan, dan efisiensi Token yang diklaim proyek.
Komunitas kemudian meminta proyek untuk mempublikasikan konfigurasi evaluasi lengkap, hasil per soal, log eksekusi, waktu asli, serta data konsumsi Token. Saat ini, proyek terutama hanya menyediakan ringkasan hasil, belum menawarkan catatan eksperimen orisinal lengkap yang cukup untuk memverifikasi angka-angka presisi tersebut. Perlu dicatat bahwa menanggapi tuduhan, penulis proyek pernah menjawab bahwa data terkait «memang dibesar-besarkan», dan menyatakan peningkatan aktual kira-kira berada di kisaran 1,6 kali hingga 3 kali. Hingga saat ini, penulis belum memberikan respons resmi terhadap kritik komunitas, dan beberapa Issue terkait telah dihapus.
🧧🧧🧧回复221获得$SOL 🧧🧧🧧
🎁🎁🎁👇👇👇🎁🎁🎁