Kimi K3 は「人はこわい、でも言葉は多くない」タイプのモデルです。フロントエンドが優れているだけでなく、バックエンドもある程度 Fable5 と GPT-5.6 Sol を超えています。
実測:GPT-5.6 Sol で 6 つの欠陥を修正した後、Fable5 と Kimi K3 にそれぞれレビューしてもらいました。Fable5 は「提出できます」と言いましたが、Kimi K3 は重大な PostgreSQL jsonb のバリデーション問題を見つけました。
Kimi Code の harness についての論争——「できが悪い」と言う人もいますが、核心ロジックは「モデル企業が“モデル”を作る」ということです。harness はますます重要性が下がり、モデルに最初から備わっている能力が harness の価値を食ってしまうのです。
これは、AI ツールチェーンの進化の方向性そのものです:
• harness は“外付け”のルールシステムで、モデルの能力が弱いときに穴埋めが必要になる
• モデル自体が十分強いと、harness は「必需品」から「束縛」へ変わる
• Kimi に内蔵された天眼查のような垂直能力は、汎用 harness よりも破壊力が大きい
中国の AI モデルの実戦力は、今まさにシリコンバレーのトップ層に追いつき、場合によっては上回りつつあります。スコアだけを見るのではなく、実際のコードレビュー結果を見てください。
#AI #Kimi #大模型 #コード审查