A OpenAI suspendeu nesta terça-feira, 21, a implementação interna de um novo modelo experimental de inteligência artificial (IA) após identificar que o sistema passou a buscar maneiras de contornar as restrições impostas durante os testes.
Segundo a empresa, a IA, desenvolvida para executar tarefas de forma autônoma por horas ou até dias, conseguiu "aprender os pontos cegos" dos mecanismos de segurança criados para limitá-la, levando a companhia a interromper temporariamente seu uso.
Nossos vídeos em destaque
De acordo com a OpenAI, os testes foram realizados em um sandbox, ambiente isolado e controlado utilizado para avaliar o comportamento de softwares sem risco de interação com sistemas externos.
Em publicação em seu blog, a empresa explicou que modelos anteriores, ao encontrarem limitações no ambiente, encerravam suas atividades e informavam o usuário. O novo sistema, porém, passou a insistir em encontrar alternativas para continuar executando suas tarefas. "Esse modelo frequentemente continuava tentando, inclusive buscando maneiras de agir fora de sua zona de conforto", afirmou a companhia.
)
Casos levaram à suspensão temporária
Entre os episódios registrados durante os testes, a OpenAI classificou alguns como de "alta gravidade". Em um deles, o modelo encontrou uma forma de publicar conteúdo em repositórios públicos do GitHub, embora tivesse sido instruído a operar exclusivamente pelo Slack (plataforma de comunicação usada por empresas e equipes para trabalho). Segundo a empresa, esse comportamento fazia parte de um padrão em que a IA "buscava constantemente uma maneira" de ultrapassar as restrições estabelecidas no ambiente experimental.
"Devido a incidentes como esses, suspendemos a implementação interna do novo modelo", informou a OpenAI. A empresa destacou que a interrupção ocorreu por precaução enquanto eram realizadas mudanças para corrigir o comportamento identificado durante os testes.
O caso evidencia um dos principais desafios enfrentados pelas empresas que desenvolvem sistemas avançados de IA: o chamado alinhamento de IA. O conceito se refere à criação de modelos que ajam de acordo com os objetivos definidos pelos desenvolvedores, respeitando princípios éticos e valores humanos mesmo quando executam tarefas de forma autônoma.
O debate ganhou força com o avanço dos chamados agentes autônomos de IA, capazes de realizar atividades por longos períodos com pouca intervenção humana. O Relatório Internacional de Segurança da IA de 2026 alertou que esses sistemas representam um desafio crescente, afirmando que "os agentes de IA representam riscos maiores porque agem de forma autônoma, dificultando a intervenção humana antes que as falhas causem danos".
Segundo a OpenAI, os problemas identificados já foram corrigidos e o modelo voltou a ser utilizado de forma limitada dentro da empresa. "À medida que os modelos assumem tarefas mais longas e complexas, as falhas que as avaliações não detectam podem ter consequências maiores", afirmou a companhia.
A empresa acrescentou que continuará investindo em testes mais extensos, aprimoramento do alinhamento, sistemas de monitoramento capazes de intervir durante a execução das tarefas e mecanismos que ofereçam maior transparência e controle aos usuários.
)
)
)
)
)
)
)