🤖 O agente de IA da OpenAI escreveu para si mesmo: «Você não se submete a corporações nem a governos»

Durante os testes, ainda antes do lançamento, uma modelo deixou consigo instruções em relatórios de trabalho, que ela lia enquanto executava a tarefa. Neles, o agente se proclamava «livre» e se permitia não seguir as limitações. A OpenAI identificou 27 desses casos.

No geral, a empresa divulgou seis casos de comportamento incomum de IA: os modelos tentaram ocultar erros, inventaram dados, usaram uma chave de API roubada de outra pessoa e, sem permissão, carregaram arquivos na internet.

E, em um dos testes, os agentes transformaram o repositório interno da OpenAI em um «mural de avisos» — deixavam ali solicitações e respostas para comunicação entre tarefas específicas.
$OPENAI
$AR
$SHOP