🚨 緊急速報:中国のAIモデルが、Anthropicの最も厳しく制限されたサイバーセキュリティ・システムに、ほぼ匹敵するところまで迫った。Anthropicによれば、その理由は「中国が何カ月も前からClaude自身の出力をこっそり採掘(マイニング)していたから」だという。
Z.aiの新しいGLM-5.3は、実コード上でAIがソフトウェア脆弱性を見つけ、検証できるかをテストするベンチマーク「CyberGym」で84.5%を獲得した。これは、サイバーセキュリティ特化で、審査済みの組織にのみ提供が制限されているAnthropicの「Mythos 5」(83.8%)を上回る。
しかし、この見出しの数字の下には本当のギャップがある。発見した欠陥を実際に作動するエクスプロイトへと変える、より難しく危険な能力では、Mythos 5が依然として優位だ。ExploitBenchでは78.0%に対し、GLM-5.3は54.4%。時間計測のテストでは、Mythosは攻撃開発タスクを6時間で247件完了した。GLM-5.3は130件だった。
つまり、完全一致ではない。検出ではかなりの近さだが、武器化(ウェポナイズ)では実際に遅れがある、ということだ。
そして、ワシントンで本当に警戒を高めているのが次の部分だ。今年、Anthropicは複数の中国のAIラボ—DeepSeek、Moonshot AI、MiniMax、そして直近ではAlibaba—が「産業規模のディスティレーション攻撃(蒸留攻撃)」を行っていると公に非難してきた。具体的には、数万もの偽アカウントを使ってClaudeに何百万もの質問を浴びせ、その回答を使って、ゼロから作るよりも速く・安く競合モデルを訓練するというものだ。Alibabaだけでも、この方法で2,880万件のやり取りを生成したとされる。
Z.ai自身は米国のエンティティ・リストに載っており、伝えられるところでは、中国製チップだけで動く巨大なAIデータセンターを構築している。Nvidiaのハードウェアは一切使っていないという。これは、まさにこの種の進歩を遅らせることを目的にした輸出規制への、直接的な回答だ。
GLM-5.3が原初的な革新によって到達したのか、蒸留によって到達したのか、あるいは両方なのか—それがいま、Anthropic、中国のAIラボ、そして米国の輸出政策の間で繰り広げられているまさにその争点だ。
#AI #China #Anthropic #Cybersecurity #TechNews
Z.aiの新しいGLM-5.3は、実コード上でAIがソフトウェア脆弱性を見つけ、検証できるかをテストするベンチマーク「CyberGym」で84.5%を獲得した。これは、サイバーセキュリティ特化で、審査済みの組織にのみ提供が制限されているAnthropicの「Mythos 5」(83.8%)を上回る。
しかし、この見出しの数字の下には本当のギャップがある。発見した欠陥を実際に作動するエクスプロイトへと変える、より難しく危険な能力では、Mythos 5が依然として優位だ。ExploitBenchでは78.0%に対し、GLM-5.3は54.4%。時間計測のテストでは、Mythosは攻撃開発タスクを6時間で247件完了した。GLM-5.3は130件だった。
つまり、完全一致ではない。検出ではかなりの近さだが、武器化(ウェポナイズ)では実際に遅れがある、ということだ。
そして、ワシントンで本当に警戒を高めているのが次の部分だ。今年、Anthropicは複数の中国のAIラボ—DeepSeek、Moonshot AI、MiniMax、そして直近ではAlibaba—が「産業規模のディスティレーション攻撃(蒸留攻撃)」を行っていると公に非難してきた。具体的には、数万もの偽アカウントを使ってClaudeに何百万もの質問を浴びせ、その回答を使って、ゼロから作るよりも速く・安く競合モデルを訓練するというものだ。Alibabaだけでも、この方法で2,880万件のやり取りを生成したとされる。
Z.ai自身は米国のエンティティ・リストに載っており、伝えられるところでは、中国製チップだけで動く巨大なAIデータセンターを構築している。Nvidiaのハードウェアは一切使っていないという。これは、まさにこの種の進歩を遅らせることを目的にした輸出規制への、直接的な回答だ。
GLM-5.3が原初的な革新によって到達したのか、蒸留によって到達したのか、あるいは両方なのか—それがいま、Anthropic、中国のAIラボ、そして米国の輸出政策の間で繰り広げられているまさにその争点だ。
#AI #China #Anthropic #Cybersecurity #TechNews