FLock telah merilis model THIS/THAT 1.1, dengan tingkat keberhasilannya pada 1.710 tes keputusan kompleks meningkat dari 40,6% menjadi 77,5%. Tim tersebut mengatakan versi baru ini mengungguli GLM-5.3, Kimi K3, DeepSeek V4.1 Flash, dan V4 Pro pada tes yang sama.
Menurut Foresight News, model tersebut mencapai skor sempurna pada semua 68 tes keputusan sebelumnya dan, di 19 kategori tugas pada tolok ukur terbaru, melampaui GPT-5.6 dan Claude Opus 5 dalam empat kategori sekaligus menyamai hasil terbaik pada dua kategori lainnya. Pada tugas “kombinasi terbaik dalam anggaran”, tingkat keberhasilannya mencapai 67,8%, sekitar empat kali GPT-5.6 dan lima kali Claude Opus 5.
FLock mengatakan bahwa keuntungan tersebut terbatas pada tugas tolok ukur yang relevan dan tidak mewakili peringkat kemampuan secara umum. Versi baru mempertahankan 1,88 miliar parameter, nol token yang dihasilkan, serta latensi pengujian sekitar 30,9 milidetik. Tim mengatakan peningkatan tersebut berasal dari optimasi data pelatihan, bukan dari ukuran model yang lebih besar, dan bahwa FLock merilis upgrade 1,1 satu hari setelah versi 1.0 sambil mempertahankan skala model dan latensi inferensi yang tidak berubah.
