أطلقت Google نموذجًا جديدًا… لا علاقة له بالتشفير في الأصل.. لكن البند الذي سجل أعلى درجة هذه المرة هو بالضبط أكثر نقطة ألمًا في هذه الصناعة..

🤖 进群聊仓位

في يوم الأربعاء، أطلقت Google Gemini 4 Argon، وتصفه كنموذجها الرائد… في جدول المقارنة الخاص بها، يتصدر في 12 من أصل 18 معيارًا، واختبار البرمجة DeepSWE حقق 77.9%، متجاوزًا 74.2% لـ Claude Opus و74.1% لـ GPT-6 Astra.. لكن هذه حسابات من Google نفسها، فاعتبرها تقريبًا فقط..

الأهم حقًا هو مجموعة أرقام أخرى: في اختبار Gray Swan للحقن غير المباشر عبر التلميحات، كانت نسبة نجاح هجوم Argon 0.7% فقط، وكلا إصدارَي Claude 1.0%، وGPT-6 Astra 8.5%، بينما Grok 4.6 وKimi K3 خدعَا بأكثر من نصف المرات.. ترجمتها ببساطة: إخفاء تعليمات خبيثة داخل رسالة بريد إلكتروني، ثم معرفة ما إذا كان مساعد AI سيطيع كلام الغريب أم لا..

أما أغلى تكلفة على السلسلة، فكانت دائمًا هذه… هذا الأسبوع، سحبت MetaMask أولًا مدققي التوقيع المشدّدين بسبب حادث أمني لم تتم توضيح ملابساته؛ وقبل ذلك، بعد أن تعرض أحد المَصارف للقرصنة، ظلت الأموال تبحث عن طريقها على السلسلة… وفي كل حادثة في النهاية، يدفع المال مستخدمو النظام..

ومن الجدير بالانتباه أيضًا طريقة تسليم Google: تمنح Argon أولًا المدافعين الذين اجتازوا تدقيق خطة Fairwind، وبدون حواجز أمان—أي بوابة تُغلق عادةً أمام النماذج لكتابة كودات الهجوم.. والسبب هو أن المدافعين يحتاجون إلى نموذج يفكر مثل المهاجمين كي تتاح لهم فرصة سد الثغرات أولًا.. لكن نفس المهارة يمكن استخدامها بالعكس أيضًا..

لذا ما يستحق المتابعة ليس من يتصدر النتائج أولًا، بل من ستصل إليه هذه القدرة أولًا.. إذا ارتفعت كفاءة سد الثغرات بمقدار درجة واحدة فعلًا، فسيتعين إعادة حساب هيكل تكلفة أعمال أمن السلسلة: تسعير التدقيق والمراقبة والتأمين كلها ستتغير.. لكن إذا بقيت النسخة التي بلا حواجز متاحة لثلة صغيرة فقط، فستتسع فجوة الدفاع والهجوم أكثر فأكثر..

قد لا تكون المشكلة إذن هي ما إذا كان الذكاء الاصطناعي سيُستخدم للهجوم، بل ما إذا كان الطرف المدافع—يمكنه أن يحصل على نفس الأداة.