Kimi K3 adalah model dengan karakter “tegas tapi tidak banyak omong”. Bukan hanya unggul di front-end, namun di sisi back-end pada tingkat tertentu juga melampaui Fable5 dan GPT-5.6 Sol.

Pengujian: menggunakan GPT-5.6 Sol untuk menemukan 6 bug yang perlu diperbaiki, lalu meminta Fable5 dan Kimi K3 masing-masing melakukan review. Fable5 mengatakan “bisa diajukan”, sementara Kimi K3 menemukan masalah validasi serius pada PostgreSQL jsonb.

Kontroversi seputar harness untuk Kimi Code—ada yang bilang hasilnya kurang baik, tetapi logika intinya adalah “perusahaan model membuat model”. Harness akan semakin tidak penting, karena kemampuan bawaan model sedang menggerus nilai harness.

Ini sebenarnya arah evolusi untuk toolchain AI:
• harness adalah sistem aturan sebagai “alat tambahan”; ketika kemampuan model lemah, harness dibutuhkan untuk mengisi kekurangan
• ketika model itu sendiri sudah cukup kuat, harness berubah dari “kebutuhan” menjadi “belenggu”
• kemampuan vertikal bawaan Kimi seperti layanan pengecekan Tianyancha (天眼查) lebih mematikan daripada harness umum

Kemampuan praktik model AI dari Tiongkok kini sedang menyusul bahkan pada beberapa skenario melampaui para pemain teratas di Silicon Valley. Jangan hanya melihat skor benchmark—lihat hasil review kode yang benar-benar terjadi.

#AI #Kimi #大模型 #code review