Google lanza un nuevo modelo, que en realidad no tiene mucho que ver con la criptografía.. Pero en esta ocasión, la opción con la puntuación más alta justo corresponde al punto más doloroso de esta industria..
🤖 进群聊仓位
El Gemini 4 Argon, presentado el miércoles, que Google describe como su modelo más avanzado.. En su propia tabla comparativa, de 18 benchmarks lidera en 12; en la prueba de programación DeepSWE logra un 77.9%, por encima del 74.2% de Claude Opus 5.5 y del 74.1% del GPT-6 Astra.. Pero ojo: son cálculos de Google, tómalo como referencia..
Lo que de verdad hay que vigilar es otro conjunto de cifras: en las pruebas de inyección indirecta de prompts de Gray Swan, la tasa de éxito del ataque de Argon es solo del 0.7%; las dos versiones de Claude son 1.0%; el GPT-6 Astra es 8.5%, y Grok 4.6 y Kimi K3 también caen, engañados en más de la mitad.. Traducido: esconder instrucciones maliciosas dentro de un correo, y cuando el asistente de IA lo lea, ¿obedecerá las órdenes de un desconocido..
Y el costo más caro en la cadena, siempre ha sido esto.. Esta semana MetaMask, por un incidente de seguridad que no se explicó bien, primero retiró a los validadores en staking; y yendo un paso más atrás, después de que hackearan a un exchange, ese dinero siguió buscando salida por la red.. En cada accidente, al final son las cuentas de los usuarios las que pagan..
La forma de entrega de Google también merece atención: Argon primero se entrega a los defensores que pasaron la revisión del plan Fairwind, y no incluye medidas de seguridad: es decir, esa “portilla” que normalmente bloquea al modelo para escribir código de ataque.. La razón es que los defensores necesitan un modelo que piense como un atacante para poder cerrar huecos primero.. Pero esa misma habilidad, al revés, también puede usarse..
Así que lo que vale la pena mirar a continuación no es quién saca la puntuación más alta, sino quién termina teniendo primero esas capacidades.. Si cerrar huecos de verdad aumenta en un orden de magnitud, habrá que recalcular toda la estructura de costos del negocio de la seguridad on-chain: precios de auditoría, monitoreo y seguros tendrán que moverse.. Pero si solo un pequeño grupo consigue la versión sin protecciones, la brecha entre ataque y defensa solo se hará aún mayor..
El problema real quizá no sea si la IA se usará para atacar, sino si la parte que defiende puede conseguir la misma herramienta.
🤖 进群聊仓位
El Gemini 4 Argon, presentado el miércoles, que Google describe como su modelo más avanzado.. En su propia tabla comparativa, de 18 benchmarks lidera en 12; en la prueba de programación DeepSWE logra un 77.9%, por encima del 74.2% de Claude Opus 5.5 y del 74.1% del GPT-6 Astra.. Pero ojo: son cálculos de Google, tómalo como referencia..
Lo que de verdad hay que vigilar es otro conjunto de cifras: en las pruebas de inyección indirecta de prompts de Gray Swan, la tasa de éxito del ataque de Argon es solo del 0.7%; las dos versiones de Claude son 1.0%; el GPT-6 Astra es 8.5%, y Grok 4.6 y Kimi K3 también caen, engañados en más de la mitad.. Traducido: esconder instrucciones maliciosas dentro de un correo, y cuando el asistente de IA lo lea, ¿obedecerá las órdenes de un desconocido..
Y el costo más caro en la cadena, siempre ha sido esto.. Esta semana MetaMask, por un incidente de seguridad que no se explicó bien, primero retiró a los validadores en staking; y yendo un paso más atrás, después de que hackearan a un exchange, ese dinero siguió buscando salida por la red.. En cada accidente, al final son las cuentas de los usuarios las que pagan..
La forma de entrega de Google también merece atención: Argon primero se entrega a los defensores que pasaron la revisión del plan Fairwind, y no incluye medidas de seguridad: es decir, esa “portilla” que normalmente bloquea al modelo para escribir código de ataque.. La razón es que los defensores necesitan un modelo que piense como un atacante para poder cerrar huecos primero.. Pero esa misma habilidad, al revés, también puede usarse..
Así que lo que vale la pena mirar a continuación no es quién saca la puntuación más alta, sino quién termina teniendo primero esas capacidades.. Si cerrar huecos de verdad aumenta en un orden de magnitud, habrá que recalcular toda la estructura de costos del negocio de la seguridad on-chain: precios de auditoría, monitoreo y seguros tendrán que moverse.. Pero si solo un pequeño grupo consigue la versión sin protecciones, la brecha entre ataque y defensa solo se hará aún mayor..
El problema real quizá no sea si la IA se usará para atacar, sino si la parte que defiende puede conseguir la misma herramienta.
