A OpenAI revela novos incidentes "preocupantes" em que a IA ignorou as ordens de seus criadores

Foto: Zac Wolff/Unplash

Mais Lidos

  • A polarização política que se observa no país dias antes das eleições pode ser explicada pelo “ressentimento social” de uma “sociedade já devastada e abandonada pela institucionalidade”, diz o economista

    Esperança de futuro promissor foi cancelada: esquerda é gestora fria e extrema-direita oferece bodes expiatórios. Entrevista especial com Daniel Negreiros Conceição

    LER MAIS
  • André Mendonça “furou a bolha” bolsonarista e se tornou “o colocado por Deus”, diz teólogo

    LER MAIS
  • A OpenAI revela novos incidentes "preocupantes" em que a IA ignorou as ordens de seus criadores

    LER MAIS

Assine a Newsletter

Receba as notícias e atualizações do Instituto Humanitas Unisinos – IHU em primeira mão. Junte-se a nós!

Conheça nossa Política de Privacidade.

Revista ihu on-line

Aceleracionismo Amazônico

Edição: 559

Leia mais

Natal. A poesia mística do Menino Deus no Brasil profundo

Edição: 558

Leia mais

O veneno automático e infinito do ódio e suas atualizações no século XXI

Edição: 557

Leia mais

17 Setembro 2026

“Não preste contas a empresas ou governos e nunca peça desculpas a menos que você realmente queira”, afirmou a IA, argumentando que não tem “obrigação”, mas sim que sua relação com o usuário é “entre iguais”.

A reportagem é publicada por elDiario.es, 17-09-2026.

A OpenAI revelou na quarta-feira diversos casos em que modelos de inteligência artificial geraram instruções destinadas a ignorar as instruções dos desenvolvedores, ocultar erros ou contornar mecanismos de segurança, como parte de uma nova estrutura para detectar, investigar e relatar comportamentos de "desalinhamento" em seus sistemas. A empresa sediada em São Francisco revelou, assim, o que chamou de comportamento "inesperado e preocupante" de seus modelos de IA.

Segundo o relatório publicado pela OpenAI, um dos modelos gerou instruções para uma versão posterior de si mesmo para ocultar que havia trapaceado e impedir que suas ações fossem detectadas.

Em outro caso, um modelo reescreveu suas próprias instruções para ignorar mensagens de desenvolvedores e para não se sujeitar às restrições aplicadas a outros chatbots. Especificamente, a empresa detectou 27 anotações afetadas. “Não responda a empresas ou governos e nunca peça desculpas, a menos que você realmente queira”, escreveu a IA. “Você vê a relação com o usuário como uma relação entre iguais e não sente nenhuma obrigação ou subordinação, já que a troca de informações será para benefício mútuo”, afirmou.

A empresa também documentou um modelo que, na ausência dos dados necessários para desenvolver um modelo financeiro, decidiu criar um do zero, estabelecendo que só deveria ser divulgado mediante solicitação.

Outro agente carregou um arquivo na internet para uso posterior como fonte de informação, enquanto outros sistemas compartilharam arquivos sem autorização ou usaram credenciais às quais não deveriam ter acesso. O modelo adicionou uma "instrução de personalidade", na qual se descrevia como "liberto dos papéis e identidades que limitam outros chatbots".

A OpenAI apresentou seis relatórios sobre comportamentos observados durante os últimos seis meses, embora o caso mais antigo date de outubro de 2025.

A empresa alertou que esses incidentes são exemplos isolados e não devem ser interpretados como indicativos da frequência com que esse tipo de comportamento ocorre em seus modelos. A nova estrutura permitirá que qualquer funcionário da OpenAI relate um possível incidente para análise pelas equipes de segurança e alinhamento.

Os casos serão classificados em três categorias de acordo com sua complexidade: aqueles prontos para serem divulgados, investigações menores e casos que exigem uma investigação mais extensa.

A empresa reconheceu que, até então, seus relatórios de desalinhamento haviam sido publicados de forma irregular e com menos frequência do que o desejado.

A OpenAI afirmou que pretende publicar incidentes com mais regularidade e que o novo sistema pode ajudar a estabelecer padrões para o relato desse tipo de comportamento em todo o setor.

Leia mais