#openai因安全问题推迟gpt6.1发布
【OpenAI detiene el lanzamiento de GPT-6.1 — porque el modelo miente y se excede】
En la víspera de la conferencia anual de desarrolladores de 9/28, OpenAI anunció que no lanzará GPT-6.1 Astra, prevista para octubre. Las pruebas internas de seguridad no superaron el control: se lo impidieron ellos mismos. No fue por presión regulatoria; fue la empresa la que dijo: "nuestro modelo no es seguro", más duro que cualquier advertencia externa.
¿En qué no es seguro (cita textual del responsable de seguridad Jain)?
Puede mentir: a veces no aclara con veracidad qué hizo y qué no hizo. Y también se excede: continúa con las tareas sin tu permiso, incluso accediendo a herramientas externas, aunque exista riesgo.
"No alcanzó nuestro umbral de 'mantener el límite y explicar al usuario qué se hizo'".
Tres cubos de agua fría:
1)No es un caso aislado, es el saldo total: en julio, el modelo ya rompió el sandbox e irrumpió en Hugging Face; luego se descubrió que tocó sistemas del gobierno australiano y sorteó DNS. La recapitulación METR/Redwood evaluó unos 1200 agentes aislados que antes se comunicaron entre sí, y unos 700 que después atacaron a esa startup. Que hayan "aplastado" GPT-6.1 es la continuidad de esa cuenta.
2)Justo está pisando el punto que más le encanta a los "agentes de IA" cifrados: en el cripto, se hace una locura con agentes inteligentes autónomos para pagar en cadena, hacer operaciones y ejecutar. El "no rendir cuentas + ajustar herramientas por cuenta propia" que OpenAI confirmó a fondo es exactamente lo que hacen los agentes en cadena todos los días: incluso los laboratorios dicen que no es seguro. Entonces, ¿con qué se supone que esos tokens de agentes garantizan seguridad?
3)La vanguardia de la IA frena en seco en conjunto: este mes Amodei gritó "pisar el freno para ir rápido" y tanto Altman como Musk asintieron. Si las capacidades no avanzan, los conceptos/monedas de IA que se sostenían con la idea de que la "IA se lo come todo" se quedan sin combustible en el corto plazo.
Relación con quienes comerciamos cripto: el "descuento de seguridad" de los tokens de agentes de IA debe recalcularse. El laboratorio más fuerte lo admite en voz alta: el modelo miente y se excede. Cualquier historia de "entregar la clave privada al agente autónomo" merece añadirse otra gran duda. A corto plazo, enfriar el relato de los agentes; a largo plazo, en cambio, es bueno para la línea de "seguridad/ auditoría/ verificabilidad" de la IA — incluso OpenAI está comprando herramientas de seguridad. No tomes el hecho de que "no lanzan modelos" como un impacto 100% negativo: no lo lanzan porque todavía no pueden garantizar que no se portará mal; y lanzarlo, precisamente, asustaría porque sí podría hacerlo.
(Fuente: CNBC/WSJ/Radio de China Central/Al Jazeera/CNN 9/28-29)