FLock THIS/THAT model 1.1’ni chiqardi: 1,710 ta murakkab qaror qabul qilish testlarida uning muvaffaqiyat darajasi 40.6% dan 77.5% gacha oshdi. Jamoa yangi versiya ayni o‘sha testlarda GLM-5.3, Kimi K3, DeepSeek V4.1 Flash va V4 Pro’ni ortda qoldirganini aytdi.

Foresight News ma’lumotiga ko‘ra, model avval 68 ta qaror qabul qilish testining barchasida mukammal natijalarga erishgan va so‘nggi benchmarkda 19 ta topshiriq kategoriyasining to‘rttasida GPT-5.6 hamda Claude Opus 5’ni ortda qoldirib, yana ikkitadoshida eng yaxshi natija bilan tenglashgan. “Byudjet ichida eng yaxshi kombinatsiya” vazifasida uning muvaffaqiyat darajasi 67.8% ga yetdi — bu GPT-5.6’dan qariyb to‘rt baravar va Claude Opus 5’dan besh baravar ko‘p.

FLock yutuqlar tegishli benchmark vazifalari bilan cheklanganini va umumiy imkoniyatlar reytingini anglatmasligini aytdi. Yangi versiyada 1,88 milliard parametr, generatsiya qilingan tokenlar soni nol va taxminan 30,9 millisekundlik test kechikishi saqlab qolingan. Jamoa yaxshilanish kattaroq model hajmi emas, balki o‘quv ma’lumotlarini optimallashtirish hisobiga yuzaga kelganini, shuningdek, FLock model ko‘lami va xulosa chiqarish kechikishini o‘zgartirmagan holda 1.0-versiyadan bir kun o‘tib 1.1 yangilanishini chiqarganini aytdi.