主要7つの主流モデル最新バージョン:
智谱: GLM-5.3 発売日:2026-08-14
Moonshot: kimi k3 発売日:2026-07-16
deepseek: deepseek-v4-pro 発売日:2026-08-13
阿里巴巴: Qwen3.8-Max 発売日:2026-08-03
xAI: Grok4.6 発売日:2026-08-12
OpenAI: GPT-5.6 発売日:2026-07-09
Anthropic: Claude Opus5 発売日:2026-07-24
2026年7〜8月の今回の反復に共通する主な流れ:
1、「質問に答える」から「自律的にタスクを完遂する」へ。
2、プログラミングAgent能力が、すべてのメーカーの軍拡競争の焦点となっている。長いコンテキスト(百万Token)が標準装備になり、絶対的なベンチマーク(スコア)ではなく、トークン効率が新たな差別化指標になった。
3、オープンソースモデル(K3、GLM-5.3、Qwen3.8-Max)は、クローズドのフラッグシップに接近し、さらには一部で上回るところまで来ている。
大規模モデルは本当にますますすごくなっている。エージェントやAI大規模モデルの使い方を理解していない人は、将来の識字/非識字の基準になってしまうのだろうか?
智谱: GLM-5.3 発売日:2026-08-14
Moonshot: kimi k3 発売日:2026-07-16
deepseek: deepseek-v4-pro 発売日:2026-08-13
阿里巴巴: Qwen3.8-Max 発売日:2026-08-03
xAI: Grok4.6 発売日:2026-08-12
OpenAI: GPT-5.6 発売日:2026-07-09
Anthropic: Claude Opus5 発売日:2026-07-24
2026年7〜8月の今回の反復に共通する主な流れ:
1、「質問に答える」から「自律的にタスクを完遂する」へ。
2、プログラミングAgent能力が、すべてのメーカーの軍拡競争の焦点となっている。長いコンテキスト(百万Token)が標準装備になり、絶対的なベンチマーク(スコア)ではなく、トークン効率が新たな差別化指標になった。
3、オープンソースモデル(K3、GLM-5.3、Qwen3.8-Max)は、クローズドのフラッグシップに接近し、さらには一部で上回るところまで来ている。
大規模モデルは本当にますますすごくなっている。エージェントやAI大規模モデルの使い方を理解していない人は、将来の識字/非識字の基準になってしまうのだろうか?