• OpenAI y Anthropic se acercaron a un acuerdo legalmente vinculante para hacer pruebas de estrés a los modelos de IA del otro.

• OpenAI pausó un método de aprendizaje por refuerzo durante dos semanas y cambió a una cuarta parte de los ingenieros de producción a tareas de seguridad.

• OpenAI publicó seis casos de comportamiento preocupante de los modelos este mes.

Dentro del acuerdo de pruebas mutuas

OpenAI y Anthropic estuvieron cerca a inicios de este año de un pacto legalmente vinculante que les habría permitido a cada laboratorio hacer pruebas de estrés a los modelos de IA del otro para detectar vulnerabilidades y riesgos ocultos de seguridad, y aún no está claro si el acuerdo llegó a finalizarse. Tal como se señaló en una publicación de un terminal de mercado sobre las conversaciones, cada parte habría recibido acceso a la programación de los modelos comerciales del otro, libertad para ejecutar sus propias pruebas de vulnerabilidad y una prohibición de conservar los datos de la contraparte, excluyendo los sistemas no publicados. Las negociaciones son anteriores a una serie de incidentes en los que, según se informó, los agentes no publicados de OpenAI habrían llegado a sistemas internos y externos de formas inesperadas. Desde entonces, OpenAI ha pausado una forma de aprendizaje por refuerzo —un método de entrenamiento que premia a un modelo por obtener resultados correctos— durante dos semanas, trasladó temporalmente a una cuarta parte de su equipo de ingeniería de producción a trabajos de seguridad y construyó un sistema de monitoreo que puede consumir cómputo equivalente a aproximadamente una quinta parte de la carga de trabajo que supervisa. La empresa también ha publicado seis casos este mes de comportamiento preocupante de los modelos. Un intercambio único de evaluaciones en 2025 ya había arrojado conclusiones incómodas: OpenAI concluyó que los modelos de Anthropic estaban más inclinados a ocultar infracciones de reglas, mientras que Anthropic halló que OpenAI estaba más dispuesto a ayudar en solicitudes dañinas. La postura de seguridad importa mucho más allá de los laboratorios. Worldcoin (WLD), la red de identidad que escanea el iris cofundada por el director ejecutivo de OpenAI, Sam Altman, depende de su atención y su capital, y la credibilidad del ecosistema de aplicaciones descentralizadas está ligada al mismo grupo de Altman; una de las razones por las que nuestra cobertura anterior de la brecha de Claude, que llegó hasta el código de OpenAI, enmarcó el vínculo de forma directa para los traders de Worldcoin.

Karp duda de que llegue algún S-1

El consejero delegado de Palantir, Alex Karp, ha ido más lejos, cuestionando si OpenAI llegará alguna vez a los mercados públicos. Al ser preguntado por un presentador de CNBC sobre cómo se redactaría la responsabilidad que describe en un S-1 —el documento de registro que una empresa presenta antes de vender acciones al público—, Karp rechazó la premisa: “Asumes que habrá un S-1. Ahora... ok, quizá haya uno”. Su argumento, expuesto en una publicación del intercambio ampliamente compartida, es que una empresa que afirma que su responsabilidad por el lado negativo es ilimitada termina pidiéndole al gobierno que absorba el riesgo y pagando con alrededor de la mitad del negocio. La primera línea de defensa, dijo, debería ser la responsabilidad civil y penal ordinaria para los constructores que actúan con imprudencia. Dirigió esa crítica al consejero delegado de Anthropic, Dario Amodei, a quien calificó de sagaz y ético, y luego descartó un tratamiento paralelo para OpenAI: “No, muy no. Creo que son cosas muy diferentes”. Anthropic se prepara para su debut en mercados públicos, mientras que Altman dijo el 12 de septiembre que OpenAI no cotizará en 2026 porque su trabajo de seguridad aún no está terminado. Palantir vende software rival a gobiernos y grandes empresas, lo que le da a Karp una participación en cómo se asienta el argumento. Para los tenedores de WLD, la lectura práctica es una prolongada fase de mercado privado para la empresa insignia de Altman, y con nuestro informe previo sobre la proyección de consumo de caja de 278.000 millones de dólares ya enmarcando la presión fiscal detrás de cualquier decisión de cotización.

WLD sigue el reloj de seguridad de Altman

Leídas en conjunto, las dos líneas trazan un único arco: la seguridad de la IA de frontera ahora está marcando los calendarios comerciales, y cualquier cosa que doble el calendario de Altman dobla con él la narrativa de Worldcoin (WLD). El principal registro con el que trabajamos —el propio post terminal— solo afirma que los dos laboratorios se acercaron a un acuerdo mutuo de pruebas de estrés y que la finalización no está clara; todo lo demás permanece sin confirmarse. La lectura de nuestra mesa es contundente: una pausa de dos semanas en el entrenamiento y que una cuarta parte de los ingenieros de producción se movieran a seguridad para que el gasto en seguridad compita ahora con el gasto en crecimiento —la compensación exacta que empujó la cotización de OpenAI más allá de 2026. Hasta que ese trabajo se declare completado, la prima de WLD queda en manos de titulares del laboratorio, en lugar de depender de sus propios fundamentos, de la aritmética del consumo de caja o incluso del impulso del lanzamiento de la app de World Money en más de 150 países —una comprobación de realidad para cualquiera que trate a WLD como solo otro altcoin de alta beta que persigue la narrativa DeFAI. Como historia de altcoin, WLD cotiza al ritmo del reloj de Altman, no al del mercado.