FLock đã phát hành mô hình THIS/THAT 1.1, với tỷ lệ thành công trên 1.710 bài kiểm tra quyết định phức tạp tăng từ 40,6% lên 77,5%. Nhóm cho biết phiên bản mới đã vượt trội hơn GLM-5.3, Kimi K3, DeepSeek V4.1 Flash và V4 Pro trong cùng các bài kiểm tra này.

Theo Foresight News, mô hình đã đạt điểm tuyệt đối ở cả 68 bài kiểm tra quyết định trước đó và, trong 19 nhóm nhiệm vụ của benchmark mới nhất, vượt GPT-5.6 và Claude Opus 5 ở bốn hạng mục trong khi sánh ngang kết quả tốt nhất ở hai hạng mục khác. Ở nhiệm vụ “tổ hợp tốt nhất trong ngân sách”, tỷ lệ thành công đạt 67,8%, cao gấp khoảng bốn lần GPT-5.6 và gấp năm lần Claude Opus 5.

FLock cho biết các mức tăng chỉ giới hạn trong các tác vụ thuộc benchmark liên quan và không đại diện cho việc xếp hạng năng lực tổng quát. Phiên bản mới vẫn giữ 1,88 tỷ tham số, 0 token được tạo ra và độ trễ kiểm thử khoảng 30,9 mili giây. Nhóm cho biết sự cải thiện đến từ tối ưu hóa dữ liệu huấn luyện chứ không phải do tăng kích thước mô hình, và rằng FLock đã phát hành bản nâng cấp 1.1 chỉ một ngày sau phiên bản 1.0 trong khi vẫn giữ nguyên quy mô mô hình và độ trễ suy luận.