Google が新しいモデルを発表。もともと暗号と関係があるわけではないのに……しかも今回、最高得点だった項目が、たまたまこの業界で一番つらいところなんだよね..
🤖 进群聊仓位
水曜に公開された Gemini 4 Argon は、Google が「自社の最先端モデル」と呼んでいる。社内の比較表では、18項目のベンチマークで12項目で上回り、プログラミングテスト DeepSWE は 77.9% を獲得。Claude Opus 5.5 の 74.2% と GPT-6 Astra の 74.1% を上回った……ただしこれらは Google 自身の計算だから、だいたいの目安程度に見ておけばいい..
本当に注目すべきなのは別の数字のほう:Gray Swan の間接プロンプトインジェクションテストで、Argon の攻撃成功率はわずか 0.7%。Claude は2種類とも 1.0%、GPT-6 Astra は 8.5%。Grok 4.6 と Kimi K3 は騙されてしまった割合が半分以上……。翻訳するとつまり、悪意ある命令をメールに隠して、AIアシスタントがそれを読んだとき、見知らぬ相手の言うことを聞いてしまうのかどうか、ってこと..
そして、オンチェーンで最も高くつくコストはずっとこの問題だ……。今週 MetaMask は、説明がはっきりしないままのセキュリティ事故があったとして、まずステーキングのバリデータを撤退させた。さらにさかのぼれば、ある取引所がハックされたあと、その資金はオンチェーン上で行き先を探し続けていた……。毎回の事故のツケは、最終的にユーザーのお金が払う。
Google の提供方法にも注目:Argon はまず、Fairwind プランの審査を通過した防御側に提供されるが、安全のガードレールは付いていない。つまり、普段モデルが攻撃コードを書くのを止めるあのゲートだ。理由は、防御側が攻撃者のように考えられるモデルを必要とし、先に穴を埋めるチャンスを得るため。でも同じ能力は、逆にも使えてしまう..
だから次に見るべきなのは、誰がスコア1位かじゃなくて、その能力がまず誰の手に渡るか……。もし穴埋めの効率が本当に一段上がるなら、オンチェーンのセキュリティ事業のコスト構造を再計算する必要が出て、監査、監視、保険の価格設定すべてが動くことになる。でもガードレールなしのバージョンを手にできるのがごく一部の人だけなら、防御と攻撃の差はむしろさらに広がるだろう..
本当の問題は、AI が攻撃に使われるかどうかではなく、守る側が、同じ道具を手にできるのかどうかかもしれない。
🤖 进群聊仓位
水曜に公開された Gemini 4 Argon は、Google が「自社の最先端モデル」と呼んでいる。社内の比較表では、18項目のベンチマークで12項目で上回り、プログラミングテスト DeepSWE は 77.9% を獲得。Claude Opus 5.5 の 74.2% と GPT-6 Astra の 74.1% を上回った……ただしこれらは Google 自身の計算だから、だいたいの目安程度に見ておけばいい..
本当に注目すべきなのは別の数字のほう:Gray Swan の間接プロンプトインジェクションテストで、Argon の攻撃成功率はわずか 0.7%。Claude は2種類とも 1.0%、GPT-6 Astra は 8.5%。Grok 4.6 と Kimi K3 は騙されてしまった割合が半分以上……。翻訳するとつまり、悪意ある命令をメールに隠して、AIアシスタントがそれを読んだとき、見知らぬ相手の言うことを聞いてしまうのかどうか、ってこと..
そして、オンチェーンで最も高くつくコストはずっとこの問題だ……。今週 MetaMask は、説明がはっきりしないままのセキュリティ事故があったとして、まずステーキングのバリデータを撤退させた。さらにさかのぼれば、ある取引所がハックされたあと、その資金はオンチェーン上で行き先を探し続けていた……。毎回の事故のツケは、最終的にユーザーのお金が払う。
Google の提供方法にも注目:Argon はまず、Fairwind プランの審査を通過した防御側に提供されるが、安全のガードレールは付いていない。つまり、普段モデルが攻撃コードを書くのを止めるあのゲートだ。理由は、防御側が攻撃者のように考えられるモデルを必要とし、先に穴を埋めるチャンスを得るため。でも同じ能力は、逆にも使えてしまう..
だから次に見るべきなのは、誰がスコア1位かじゃなくて、その能力がまず誰の手に渡るか……。もし穴埋めの効率が本当に一段上がるなら、オンチェーンのセキュリティ事業のコスト構造を再計算する必要が出て、監査、監視、保険の価格設定すべてが動くことになる。でもガードレールなしのバージョンを手にできるのがごく一部の人だけなら、防御と攻撃の差はむしろさらに広がるだろう..
本当の問題は、AI が攻撃に使われるかどうかではなく、守る側が、同じ道具を手にできるのかどうかかもしれない。
