Cómo reviso un producto de agentes antes de que toque fondos 🧪

$LINK se tomó la seguridad en serio mucho antes de que nadie lo hiciera, y ahora los productos de agentes están en esa misma etapa. $BNKR forma parte de ese grupo, y estos productos son tan nuevos que todavía se puede ver qué camino tomó cada uno.

Esta es la lista de verificación que uso antes de permitir que un agente mueva cualquier cosa.

¿Simula la transacción antes de ejecutarla? Una instrucción puede parecer perfectamente razonable y, aun así, la llamada resultante puede ser incorrecta. La simulación detecta la diferencia entre ambas cosas.

¿Analiza el token que está a punto de tocar? Bankr canaliza ese proceso a través de Blockaid, que bloquea los tokens marcados como maliciosos. No es una garantía, pero la diferencia entre tener un filtro y no tenerlo representa la mayor parte del riesgo.

¿Analiza la propia instrucción? La inyección de prompts deja de ser una curiosidad de investigación en cuanto quien lee tus mensajes también puede firmar transacciones.

¿Puede instalar habilidades desde un enlace? Esta es la novedad más reciente y la menos cubierta. Si se puede dirigir a un agente a una URL de una habilidad, cualquiera puede dirigirlo a una maliciosa mediante un texto que el agente llegue a leer.

Y ahora, la pregunta que te dice más que las otras cuatro juntas: ¿la documentación reconoce lo que las distintas capas no detectan?

La de Bankr sí. Describe el análisis, la simulación y el filtrado de inyecciones, y luego dice claramente que estos no lo detectan todo. Es más fácil usar de forma segura un producto que publica sus límites que uno que da a entender que no tiene ninguno.

Lo inquietante de toda esta categoría es que el modo de fallo ya no es una clave robada. Es una instrucción que no escribiste, ejecutada exactamente como se especificó.

Los hábitos de seguridad todavía no se han puesto al día.

#AI #Security