Google meluncurkan Gemini 3.7 Flash hanya tiga minggu setelah versi 3.6, dengan skor DeepSWE 65,3% dan tarif peluncuran yang ditetapkan sebesar setengah dari pendahulunya.

Poin penting:

  • Gemini 3.7 Flash meningkatkan skor DeepSWE v1.1 menjadi 65,3% dan mencapai 1.588 Elo dalam pengembangan web.

  • Tarif promosi adalah 0,75 $ per satu juta token untuk input dan 3,75 $ per satu juta token untuk output hingga 2026.

  • Model ini sedang dalam proses penerapan di Spark dan tersedia di seluruh penawaran AI Google untuk pengembang dan perusahaan.

Peluncuran Gemini 3.7

Google mengumumkan Gemini 3.7 Flash pada 13 Agustus, hanya tiga minggu setelah Gemini 3.6 Flash. Grup tersebut menjelaskan bahwa masukan dari pengembang dan penyesuaian algoritmik mendorong iterasi ini, dengan fokus utama pada penggunaan untuk rekayasa perangkat lunak, pengembangan web, dan tugas-tugas pengetahuan. Kecepatan rilisnya tidak biasa, sangat tinggi.

Peningkatannya paling terlihat pada pemrograman. DeepSWE v1.1 melonjak menjadi 65,3 %, dibanding sekitar 49 % untuk 3.6 Flash, sementara FrontierCode 1.1 Main naik dari 34,4 % menjadi 43,6 %. Pengembangan web menunjukkan tren yang sama, dengan Elo WebDev Arena naik dari 1 538 menjadi 1 588.

Google indique bahwa model « menghasilkan antarmuka yang lebih fungsional dan aplikasi yang lengkap dalam lebih sedikit permintaan ». Performa pada tugas-tugas pengetahuan juga meningkat. Benchmark GDP.pdf naik dari 22,0 % menjadi 34,0 %, sementara AutomationBench naik dari 17,0 % menjadi 30,4 %. Google mengatakan telah memperkuat pagar pengaman, terutama terhadap penggunaan CBRN dan serangan siber.

Baca juga: Anthropic menargetkan kesepakatan Decart senilai 6 Md$ sambil menyiapkan langkah menuju pencatatan saham (IPO)

Performa AI

Uji eksternal mengonfirmasi kemajuan ini. Niko Grupen, kepala riset terapan di Harvey, menyoroti peningkatan 2,6 poin pada tingkat keberhasilan keseluruhan dibanding 3.6 Flash pada benchmark Legal Agent Bench. Kyrill Hux, co-founder Nunu.ai, menilai bahwa langkah-langkah internal menempatkan 3.7 Flash setara dengan model frontier berukuran menengah, dengan biaya yang kira-kira dibelah dua.

Penurunan harga memperkuat argumen ini, sementara agen dengan volume tinggi dapat menghasilkan biaya besar melalui rangkaian perulangan perencanaan, panggilan alat, dan penagihan kembali. Google menyatakan bahwa 3.7 Flash mengikuti instruksi dengan lebih ketat dan menangani hambatan dengan lebih baik, yang dapat mengurangi kebutuhan intervensi manusia dalam alur kerja rekayasa dan manajemen. Model ini kini tersedia secara umum.

Gemini 3.6 Flash diluncurkan pada 21 Juli dengan harga 1,50 $ per satu juta token untuk input dan 7,50 $ per satu juta token untuk output.

Tiga minggu kemudian, 3.7 Flash tiba di harga masing-masing 0,75 $ dan 3,75 $, hingga 31 Desember, sambil meningkatkan skor benchmark dan diterapkan di Spark untuk pelanggan AI Pro dan Ultra. Rangkaian cepat ini memperpanjang siklus pembaruan model Flash Google yang dipercepat.

Tunggu: Volume perdagangan Virtuals Protocol meledak 180 %, para bullish menargetkan 0,68 $