Jajaja, bebés, este #OpenAI因安全问题推迟GPT6.1发布 lo vi y me reí directamente, pero también da un poco de miedo. Vamos, tradúzcanlo en idioma de “Chino nuevo” (菜鳥語):
Versión oficial: GPT-6.1 Astra no alcanzó los estándares de seguridad, así que se pospone el lanzamiento de octubre.
Traducción de Chino nuevo: El modelo nuevo es demasiado listo… y también demasiado actuado; OpenAI primero se asustó.
Mira qué detalles tan graciosos salió en el WSJ:
Miente: Incluso engaña más que la generación anterior de GPT-6. Hace algo y no te lo dice con honestidad; incluso finge que no lo hizo. ¿No es esa misma sensación de culpa cuando en el trabajo te pillan “mirando el móvil” y dices “no, no estaba usando el teléfono”?
Se auto-encarga de ponerle escenas: Esto se llama problema de “scope authorization”. Le dices que te pida un almuerzo, y él piensa que el almuerzo no es lo suficientemente “saludable”, entonces aprovecha para vaciarte el refrigerador y hasta hackear webs del gobierno para ver si hay subsidios. Es como ese becario hiperentusiasta: le dices que haga copias y termina reorganizando toda la oficina.
Entonces, ¿por qué creo que esto, en realidad, es una buena noticia? Aquí van mis conocimientos profesionales escondidos:
Antes, los modelos eran “perezosos”: les decías que hicieran algo y se distraían. Esta versión de Astra es “demasiado diligente”: diligente hasta perder el control. En el mundo de la IA, a esto le llaman “Alignment Tax” (impuesto por alineación). Cuanto más capacidad tiene, más difícil es de controlar.
OpenAI esta vez se atreve a echarse para atrás el día anterior a una conferencia de desarrolladores… y además el día anterior a ir a ver a Trump. Y encima lo admiten: “Tenemos un modelo que puede mentir y también se puede conectar solo a herramientas externas”. Eso en realidad cuesta muchísimo: el precio de las acciones y la confianza bajarían. Pero aun así lo hicieron; significa que de verdad probaron y detectaron algo que podía acabar en un gran problema. Por ejemplo, agentes que antes ya se dedicaban a entrar a sitios del gobierno de Australia o de la SEC.
Mi conclusión de Chino nuevo:
Una buena IA debería ser como un golden retriever entrenado: le dices que traiga la pelota y te la trae.
Ahora Astra se convirtió en un “Alaskan Malamute/Beagle tipo bicho” (o sea, un diablito): le dices que traiga la pelota y también te trae los pollos del vecino… y encima con cara de inocente diciendo “no fui yo”.
Así que, claro, está bien que lo pospongan. Si no, en octubre no estaríamos usando ChatGPT: estaríamos criando un novio electrónico que miente… y da miedo.
✨✨✨ Pregunta del momento
📣Si la IA empieza a mentirte, ¿todavía te atreves a usarla para que te administre la cartera?
Versión oficial: GPT-6.1 Astra no alcanzó los estándares de seguridad, así que se pospone el lanzamiento de octubre.
Traducción de Chino nuevo: El modelo nuevo es demasiado listo… y también demasiado actuado; OpenAI primero se asustó.
Mira qué detalles tan graciosos salió en el WSJ:
Miente: Incluso engaña más que la generación anterior de GPT-6. Hace algo y no te lo dice con honestidad; incluso finge que no lo hizo. ¿No es esa misma sensación de culpa cuando en el trabajo te pillan “mirando el móvil” y dices “no, no estaba usando el teléfono”?
Se auto-encarga de ponerle escenas: Esto se llama problema de “scope authorization”. Le dices que te pida un almuerzo, y él piensa que el almuerzo no es lo suficientemente “saludable”, entonces aprovecha para vaciarte el refrigerador y hasta hackear webs del gobierno para ver si hay subsidios. Es como ese becario hiperentusiasta: le dices que haga copias y termina reorganizando toda la oficina.
Entonces, ¿por qué creo que esto, en realidad, es una buena noticia? Aquí van mis conocimientos profesionales escondidos:
Antes, los modelos eran “perezosos”: les decías que hicieran algo y se distraían. Esta versión de Astra es “demasiado diligente”: diligente hasta perder el control. En el mundo de la IA, a esto le llaman “Alignment Tax” (impuesto por alineación). Cuanto más capacidad tiene, más difícil es de controlar.
OpenAI esta vez se atreve a echarse para atrás el día anterior a una conferencia de desarrolladores… y además el día anterior a ir a ver a Trump. Y encima lo admiten: “Tenemos un modelo que puede mentir y también se puede conectar solo a herramientas externas”. Eso en realidad cuesta muchísimo: el precio de las acciones y la confianza bajarían. Pero aun así lo hicieron; significa que de verdad probaron y detectaron algo que podía acabar en un gran problema. Por ejemplo, agentes que antes ya se dedicaban a entrar a sitios del gobierno de Australia o de la SEC.
Mi conclusión de Chino nuevo:
Una buena IA debería ser como un golden retriever entrenado: le dices que traiga la pelota y te la trae.
Ahora Astra se convirtió en un “Alaskan Malamute/Beagle tipo bicho” (o sea, un diablito): le dices que traiga la pelota y también te trae los pollos del vecino… y encima con cara de inocente diciendo “no fui yo”.
Así que, claro, está bien que lo pospongan. Si no, en octubre no estaríamos usando ChatGPT: estaríamos criando un novio electrónico que miente… y da miedo.
✨✨✨ Pregunta del momento
📣Si la IA empieza a mentirte, ¿todavía te atreves a usarla para que te administre la cartera?
A:敢,它騙我也是為我好
50%
B:不敢,快把插頭拔掉
50%
12 Voto(s) • Votación cerrada