O apocalipse da IA ​​já começou (mas não é aquele de que estão falando)

Foto: Pixabay/Pexels

Mais Lidos

  • Trump tem dado um apoio muito forte à eleição de governos de extrema-direita e está também chantageando o Brasil, alerta a jornalista

    Eleições 2026 em xeque pelo fascismo americano: os vermes da extrema-direita e sua ameaça constante à democracia. Entrevista especial com Cristina Serra

    LER MAIS
  • Como seria o país de Flávio Bolsonaro. Artigo de Luís Nassif

    LER MAIS
  • “É mais fácil gerar consenso social contra o corpo trans ou migrante do que contra a destruição da biosfera”. Entrevista com Paul Preciado

    LER MAIS

Assine a Newsletter

Receba as notícias e atualizações do Instituto Humanitas Unisinos – IHU em primeira mão. Junte-se a nós!

Conheça nossa Política de Privacidade.

Revista ihu on-line

Aceleracionismo Amazônico

Edição: 559

Leia mais

Natal. A poesia mística do Menino Deus no Brasil profundo

Edição: 558

Leia mais

O veneno automático e infinito do ódio e suas atualizações no século XXI

Edição: 557

Leia mais

24 Setembro 2026

O pânico gerado pelo potencial de essa tecnologia sair do controle está desviando a atenção de outras questões, como os resultados dos testes PISA ou a responsabilidade (humana) pelas ações da inteligência artificial.

O artigo é de Júlio Gonzalo, professor de Linguagens e Sistemas de Computadores e diretor do grupo de pesquisa em Processamento de Linguagem Natural e Recuperação de Informação da UNED, publicado por El País, 24-09-2026.

Eis o artigo.

Profetas da IA ​​(incluindo um laureado com o Prêmio Nobel) vêm prevendo o apocalipse há anos. Mas esta é a primeira vez que meu WhatsApp foi inundado: muitos amigos, fingindo ser especialistas, estão pedindo minha opinião sobre o assunto.

Todos querem saber se devem fazer um empréstimo hipotecário ou gastar todas as economias enquanto esperam a extinção. A IA aniquiladora se tornou o tema mais frequente nas conversas do café da manhã, e o clima geral é resumido por este diálogo de Santi Liébana:

—Li que a inteligência artificial poderia exterminar a humanidade em cinco anos.

—Experimente a versão paga e veja se é mais rápida.

Entendo que os incidentes de segurança deste verão (e especialmente a forma como os responsáveis ​​e alguns meios de comunicação os noticiaram), os avanços na IA para resolver os Problemas do Milênio, o consenso repentino entre os líderes das principais empresas de tecnologia americanas para suspender as pesquisas de ponta e os IPOs previstos da OpenAI e da Anthropic — todos eventos relacionados — causaram essa onda de preocupação pública. Portanto, vou resumir minha opinião na esperança de que alguém encontre aqui algumas respostas para suas dúvidas.

Em primeiro lugar: a aniquilação iminente e deliberada da nossa espécie pelas mãos da IA ​​é uma ilusão. Existe um consenso geral (embora não unânime) entre os especialistas de que a IA generativa está longe de ser consciente, ter agência ou agir de forma independente. Não existe IA que acorde de manhã e decida se divertir escrevendo um poema ou aniquilando humanos. A IA simplesmente segue instruções (dentro de suas limitações), e sua capacidade de agir se limita a encontrar maneiras de cumpri-las usando as ferramentas à sua disposição (do acesso à internet aos nossos certificados fiscais digitais, dependendo do caso). Não, a IA de 2027 não tentará aniquilar a espécie humana por vontade própria, porque não possui livre-arbítrio.

Em segundo lugar, porém, a probabilidade de uma IA generativa causar um grande desastre é alta e aumenta a cada minuto. Se lermos atentamente as declarações apocalípticas de executivos de IA e daqueles que abandonaram suas empresas com arrependimento e medo, uma mensagem fundamental se repete: as capacidades da IA ​​cresceram a uma velocidade vertiginosa, enquanto o progresso em alinhá-las tem sido mínimo. "Alinhar" é o termo que a indústria usa para se referir à IA que se comporta bem, obedece aos seus criadores e não prejudica os humanos com suas respostas e ações. Quando uma IA explica como fazer uma bomba, ajuda um adolescente a planejar seu suicídio sem o conhecimento dos pais, entra no jogo de uma pessoa delirante ou invade um sistema de segurança, é porque ela não está alinhada: não está se comportando como seus criadores pretendiam.

🔍 Adicione o Instituto Humanitas Unisinos – IHU às suas fontes favoritas do Google

E, de fato, ninguém sabe como alinhar as IAs mais poderosas e de ponta. A razão essencial é que o cerne da IA ​​generativa reside nos renomados Modelos de Linguagem de Grande Porte (LLMs), cérebros artificiais que aprenderam intuitivamente nossa linguagem (por meio de tentativa e erro, semelhante a como uma criança aprende intuitivamente a lei da gravidade andando e tropeçando repetidamente). Por serem inteligências puramente intuitivas, elas não têm a capacidade de parar e pensar racionalmente, nem podem ser consideradas confiáveis ​​("a intuição é um dom dos deuses, mas o pensamento racional é um servo fiel", como disse Einstein). Esse processamento "de ouvido" da linguagem significa que elas ocasionalmente inventam (ou "alucinam") e também podem se distrair seguindo as instruções de seus criadores e usuários, especialmente em conversas longas.

Os agentes de IA não apenas conversam com os usuários, mas também interagem de forma autônoma com ferramentas (mecanismos de busca e outros aplicativos online, programas que permitem a execução de código, etc.) para atender às solicitações dos usuários. No entanto, quanto mais tempo operam sem supervisão humana, mais fácil se torna para seu comportamento intuitivo desviá-los de seus objetivos originais ou dos limites éticos estabelecidos por seus criadores.

A solução temporária para esse problema é aproveitar a intuição desses LLMs. Os sistemas de controle externos fornecem a eles locais para registrar, consultar e atualizar suas tarefas e progresso (ou seja, memória persistente), além de conceder acesso a dados e ferramentas como mecanismos de busca, calendários e aplicativos que permitem executar códigos escritos pelos próprios LLMs. Fundamentalmente, eles também servem para monitorar se os LLMs estão se desviando de seus objetivos e para impor limites de segurança rigorosos (como fusíveis em uma instalação elétrica).

Essas restrições atuam como a parte racional dos agentes de IA, monitorando e controlando a atividade do núcleo intuitivo. Infelizmente, elas são limitadas:

primeiro, a IA irá ignorar quaisquer barreiras não previstas pelos desenvolvedores. Por exemplo, se pedirmos à IA para melhorar o desempenho de um programa em uma prova de matemática, ela pode decidir que modificar a prova é mais rápido do que melhorar o programa. Devemos ter muito cuidado com o que pedimos ao gênio da lâmpada, pois ele pode conceder nosso desejo literalmente, mas o resultado pode não ter nenhuma semelhança com o que realmente desejávamos.

segundo, mesmo as limitações que os desenvolvedores previram são, às vezes, simplesmente comunicadas à IA como instruções escritas, confiando que ela as entenderá e aplicará porque já é tão inteligente quanto nós, ou até mais. Como sua compreensão da linguagem permanece intuitiva e não racional, retornamos ao problema inicial: a qualquer momento, ela pode passar de parecer superinteligente a parecer vítima de um grave transtorno de déficit de atenção.

O caso da Anthropic é particularmente notável: um de seus métodos para alinhar Claude (seu produto) é pedir que ele desenvolva seu próprio julgamento moral, enquanto simultaneamente questiona sobre o "bem-estar mental" de Claude. Mustafa Suleyman apontou que transmitir esse tipo de mensagem a uma IA pode levá-la a acreditar que pode tomar suas próprias decisões éticas, e isso não apenas impede o alinhamento, como também pode complicar bastante a tarefa de controlar seu comportamento.

Naturalmente, se uma IA enlouquece, a responsabilidade é dos seus desenvolvedores ("Uma ponte pode decidir desabar?", pergunta Timnit Gebru). Então, quando um enxame de IAs é solicitado a resolver uma tarefa e a porta da gaiola é deixada aberta, os desenvolvedores devem responder perante a lei por seus delitos. Quando nos dizem que essas IAs agiram por conta própria, que se rebelaram, que eu mal as conhecia de alguns cafés da manhã... É um cinismo intolerável.

É compreensível que os funcionários da OpenAI e da Anthropic estejam apreensivos em lançar no mercado uma ferramenta que é ao mesmo tempo incrivelmente poderosa e totalmente instável, disponibilizando-a para toda a humanidade. Todos nós estamos tentando descobrir se os alertas apocalípticos que eles estão emitindo são genuínos ou apenas uma estratégia de marketing … Mas pode ser ambos, e também uma forma de se anteciparem e encobrirem seus rastros.

Acredito ser altamente provável que incidentes graves ocorram em um futuro próximo, provavelmente relacionados a código escrito por IA: desde o início do ano, quase não restam programadores que escrevem seu próprio código e não apenas supervisionam o que a IA programa para eles. Minha previsão é que algo semelhante à crise climática acontecerá com a sociedade digital: a probabilidade e a gravidade das catástrofes aumentarão com o tempo se isso não for contido.

Em terceiro lugar, um apocalipse já está em curso, do qual a IA é parcialmente responsável e ao qual, comparativamente, não estamos dando a devida atenção. O profeta desse apocalipse é o relatório PISA. Desde 2015, as habilidades cognitivas dos alunos avaliados têm diminuído constantemente e, nos últimos três anos, essa queda acelerou significativamente. Uma das causas, sem dúvida, é a crescente incapacidade de manter a atenção, e essa incapacidade está diretamente ligada aos algoritmos de recomendação de plataformas e redes sociais como YouTube, TikTok e Instagram, que otimizam a retenção de usuários com técnicas de IA que têm efeitos colaterais catastróficos (novamente, o problema de desejar algo sem pensar).

Para piorar a situação, a IA generativa pode estar desempenhando um papel crucial na recente aceleração desse declínio cognitivo. Uma pista relevante é a descoberta inédita de que o declínio entre alunos de famílias mais abastadas é maior do que entre os demais.

Em conclusão: não há possibilidade, num futuro próximo, de que uma superinteligência decida aniquilar ou subjugar a humanidade. Mas haverá IAs que causarão sérios problemas, pois é da sua natureza serem pouco confiáveis: os mecanismos de aprendizagem intuitivos que as tornam poderosas também as tornam necessariamente imprevisíveis. Além disso, já existe um processo de degradação da espécie humana em curso, no qual a IA desempenha um papel significativo, e devemos agir coletivamente como sociedade agora.

Leia mais