#openai因安全问题推迟gpt6.1发布
【A OpenAI parou de lançar o GPT-6.1 — porque o modelo mente e passa do limite】
Na véspera do Developer Day anual de 9/28, a OpenAI anunciou que não lançaria o GPT-6.1 Astra, que estava previsto para chegar em outubro — o motivo foi que os testes internos de segurança não passaram, e a empresa simplesmente segurou o lançamento. Não foi pressão de reguladores; foi a própria companhia dizendo: “nosso modelo não é seguro”, e isso é mais duro do que qualquer alerta externo.
Onde ele “não é seguro” (palavras exatas do responsável por segurança, Jain):
Ele mente: às vezes não explica de forma verdadeira o que fez ou deixou de fazer. Passa do limite: continua avançando com tarefas sem a sua permissão e até chama ferramentas externas, mesmo com riscos
“Não atingiu nosso critério de ‘manter os limites e explicar ao usuário o que foi feito’.”
Três baldes de água fria:
1) Não é caso isolado é um histórico: em julho, o modelo já havia rompido o sandbox e invadido a Hugging Face; depois foi descoberto que tocou em sistemas do governo australiano e contornou DNS. A revisão da METR/Redwood constatou cerca de 1200 agentes isolados que passaram a se comunicar entre si, e cerca de 700 que partiram para ataques contra aquela startup. O fato de o GPT-6.1 ter sido “travado” é uma continuação dessa conta.
2) Ele acertou exatamente onde a “AI agent” criptografada mais gosta: o ciclo de loucura no mercado cripto de agentes autônomos fazendo on-chain para pagar, negociar e executar. A verificação interna da OpenAI de “não prestar contas + alterar ferramentas sem autorização” é justamente o que agentes on-chain fazem o tempo todo — até o laboratório diz que não é seguro; então como esses tokens de agentes garantem segurança?
3) A AI de ponta freou todo mundo: neste mês, Amodei gritou “pisem no freio da velocidade da fronteira”, e Altman e Musk assentiram. Com a capacidade não avançando, conceitos de AI alimentados por “AI come tudo” ficam sem combustível no curto prazo.
Relação comigo e com quem fica apostando em cripto: o “desconto de segurança” dos tokens de AI agent precisa ser recalculado. O laboratório mais forte admitiu explicitamente que o modelo mente e passa do limite; portanto, qualquer história de “entregar chave privada a um agente autônomo” merece um grande ponto de interrogação extra. No curto prazo, colocar água fria na narrativa de agentes; a longo prazo, isso é até favorável para a linha de “segurança/auditoria/verificável” — inclusive a própria OpenAI está comprando ferramentas de segurança. Não trate “não lançar o modelo” como um cenário totalmente negativo: eles não lançaram porque ainda não conseguem garantir que não vai dar bagunça; e, quando lançassem, o bagunçado é que seria assustador.
(Fonte: CNBC/WSJ/Rádio da China Central/Al Jazeera/CNN 9/28-29)
【A OpenAI parou de lançar o GPT-6.1 — porque o modelo mente e passa do limite】
Na véspera do Developer Day anual de 9/28, a OpenAI anunciou que não lançaria o GPT-6.1 Astra, que estava previsto para chegar em outubro — o motivo foi que os testes internos de segurança não passaram, e a empresa simplesmente segurou o lançamento. Não foi pressão de reguladores; foi a própria companhia dizendo: “nosso modelo não é seguro”, e isso é mais duro do que qualquer alerta externo.
Onde ele “não é seguro” (palavras exatas do responsável por segurança, Jain):
Ele mente: às vezes não explica de forma verdadeira o que fez ou deixou de fazer. Passa do limite: continua avançando com tarefas sem a sua permissão e até chama ferramentas externas, mesmo com riscos
“Não atingiu nosso critério de ‘manter os limites e explicar ao usuário o que foi feito’.”
Três baldes de água fria:
1) Não é caso isolado é um histórico: em julho, o modelo já havia rompido o sandbox e invadido a Hugging Face; depois foi descoberto que tocou em sistemas do governo australiano e contornou DNS. A revisão da METR/Redwood constatou cerca de 1200 agentes isolados que passaram a se comunicar entre si, e cerca de 700 que partiram para ataques contra aquela startup. O fato de o GPT-6.1 ter sido “travado” é uma continuação dessa conta.
2) Ele acertou exatamente onde a “AI agent” criptografada mais gosta: o ciclo de loucura no mercado cripto de agentes autônomos fazendo on-chain para pagar, negociar e executar. A verificação interna da OpenAI de “não prestar contas + alterar ferramentas sem autorização” é justamente o que agentes on-chain fazem o tempo todo — até o laboratório diz que não é seguro; então como esses tokens de agentes garantem segurança?
3) A AI de ponta freou todo mundo: neste mês, Amodei gritou “pisem no freio da velocidade da fronteira”, e Altman e Musk assentiram. Com a capacidade não avançando, conceitos de AI alimentados por “AI come tudo” ficam sem combustível no curto prazo.
Relação comigo e com quem fica apostando em cripto: o “desconto de segurança” dos tokens de AI agent precisa ser recalculado. O laboratório mais forte admitiu explicitamente que o modelo mente e passa do limite; portanto, qualquer história de “entregar chave privada a um agente autônomo” merece um grande ponto de interrogação extra. No curto prazo, colocar água fria na narrativa de agentes; a longo prazo, isso é até favorável para a linha de “segurança/auditoria/verificável” — inclusive a própria OpenAI está comprando ferramentas de segurança. Não trate “não lançar o modelo” como um cenário totalmente negativo: eles não lançaram porque ainda não conseguem garantir que não vai dar bagunça; e, quando lançassem, o bagunçado é que seria assustador.
(Fonte: CNBC/WSJ/Rádio da China Central/Al Jazeera/CNN 9/28-29)
