FLock hat das Modell THIS/THAT 1.1 veröffentlicht; die Erfolgsquote bei 1.710 komplexen Entscheidungstests stieg von 40,6 % auf 77,5 %. Das Team erklärte, die neue Version habe in denselben Tests GLM-5.3, Kimi K3, DeepSeek V4.1 Flash und V4 Pro übertroffen.

Laut Foresight News erzielte das Modell bei allen 68 Entscheidungstests zuvor perfekte Ergebnisse und übertraf in den 19 Aufgabenbereichen im neuesten Benchmark GPT-5.6 und Claude Opus 5 in vier Kategorien, während es in zwei weiteren Kategorien das beste Ergebnis erreichte. Bei der Aufgabe „beste Kombination innerhalb des Budgets“ lag die Erfolgsquote bei 67,8 %, etwa viermal so hoch wie GPT-5.6 und fünfmal so hoch wie Claude Opus 5.

FLock sagte, die Gewinne seien auf die relevanten Benchmark-Aufgaben begrenzt gewesen und stellten keine allgemeine Rangliste der Fähigkeiten dar. Die neue Version behält 1,88 Milliarden Parameter, null generierte Tokens und eine Testlatenz von etwa 30,9 Millisekunden bei. Das Team erklärte, die Verbesserung sei auf die Optimierung der Trainingsdaten zurückzuführen gewesen und nicht auf eine größere Modellgröße. Außerdem habe FLock das Upgrade auf 1,1 einen Tag nach Version 1.0 veröffentlicht, wobei Modellskala und Inferenzlatenz unverändert geblieben seien.