FLock a publié le modèle THIS/THAT 1.1, dont le taux de réussite sur 1 710 tests de décision complexes est passé de 40,6 % à 77,5 %. L’équipe a déclaré que la nouvelle version surpassait GLM-5.3, Kimi K3, DeepSeek V4.1 Flash et V4 Pro dans les mêmes tests.

Selon Foresight News, le modèle a obtenu des scores parfaits à l’ensemble des 68 tests de décision précédemment et, sur les 19 catégories de tâches de l’évaluation la plus récente, a dépassé GPT-5.6 et Claude Opus 5 dans quatre catégories tout en égalant le meilleur résultat dans deux autres. Dans la tâche « meilleure combinaison dans le budget », son taux de réussite a atteint 67,8 %, soit environ quatre fois GPT-5.6 et cinq fois Claude Opus 5.

FLock a déclaré que les gains étaient limités aux tâches de référence pertinentes et ne représentaient pas un classement général des capacités. La nouvelle version conserve 1,88 milliard de paramètres, zéro jetons générés et une latence de test d’environ 30,9 millisecondes. L’équipe a indiqué que l’amélioration provenait de l’optimisation des données d’entraînement plutôt que de la taille d’un modèle plus grand, et que FLock a publié la mise à niveau 1.1 un jour après la version 1.0 tout en conservant la taille du modèle et la latence d’inférence inchangées.