Kimi publicó PerceptionBench de código abierto, un punto de referencia de percepción visual con 3.000 preguntas verificadas manualmente. Los resultados de la evaluación muestran que GPT-5.6-Sol lideró 16 modelos multimodales grandes con un 59,7% de precisión, mientras que ningún modelo superó el 60%.
