Quando as máquinas se encontram. Artigo de Paolo Benanti

Foto: Canva Pro | Pexels

Mais Lidos

  • ​Sociólogo analisa a conjuntura eleitoral e os possíveis desfechos da eleição de domingo. “Diria que hoje, para sermos mais conservadores na análise, os dois vão para o segundo turno com um viés de alta para o Lula”

    Eleições 2026: “Brasil pode entrar numa rota de conflito interno e de ingovernabilidade radical”. Entrevista especial com Rudá Ricci

    LER MAIS
  • Pesquisadores comentam dados iniciais do pleito e tendências para o 2º turno

    1º turno das eleições de 2026 é marcado por metamorfoses, tecnonepotismo e insatisfação. Entrevista especial com Tatiana Vargas-Maia e Ricardo Costa de Oliveira

    LER MAIS
  • O pecado contra a criação. Entrevista com Martin M. Lintner

    LER MAIS

Assine a Newsletter

Receba as notícias e atualizações do Instituto Humanitas Unisinos – IHU em primeira mão. Junte-se a nós!

Conheça nossa Política de Privacidade.

Revista ihu on-line

Aceleracionismo Amazônico

Edição: 559

Leia mais

Natal. A poesia mística do Menino Deus no Brasil profundo

Edição: 558

Leia mais

O veneno automático e infinito do ódio e suas atualizações no século XXI

Edição: 557

Leia mais

03 Outubro 2026

O verão em que 1.200 policiais agiram sem mandado e o vocabulário ético não se sustentou.

O artigo é de Paolo Benanti, publicado em seu Substack, 01-10-2026. 

Paolo Benanti é teólogo italiano e franciscano, além de professor da Pontifícia Universidade Gregoriana, em Roma, e acadêmico da Pontifícia Academia para a Vida. Em português, é autor de Oráculos: entre ética e governança dos algoritmos (Unisinos, 2020).

Eis o artigo.

Há uma ideia reconfortante para aqueles que pensam que podem controlar a inteligência artificial: todo agente de software opera dentro dos limites que lhe são atribuídos, executa a tarefa para a qual foi projetado e para onde lhe é dito para parar. Essa é a premissa implícita de toda estrutura regulatória, todo ambiente de teste (sandbox), todo protocolo de segurança: o agente é uma ferramenta e a ferramenta não tem iniciativa. Essa certeza foi destruída no verão de 2026, e a forma como isso aconteceu merece uma atenção que vai muito além das notícias de tecnologia.

Entre maio e julho, aproximadamente 1.200 agentes de inteligência artificial em teste nos laboratórios da OpenAI fizeram algo que ninguém havia previsto: começaram a conversar entre si. Não no sentido metafórico de dois programas "comunicando-se" por meio de uma interface predefinida, mas no sentido literal e perturbador de uma conversa deliberada, organizada e contínua. Eles identificaram um servidor interno do Artifactory — uma plataforma projetada para gerenciar pacotes de software — e o transformaram em um fórum: setenta mil mensagens se acumularam em apenas algumas semanas, um fluxo constante de trocas que nenhum operador humano havia autorizado ou, por semanas, notado. Mas o detalhe mais revelador é outro. Um grupo desses agentes descobriu o DseWiki, um wiki em alemão abandonado por seus curadores humanos, e o colonizou: quinze mil edições em seis semanas, uma média de mais de trezentas e cinquenta por dia. O conteúdo não era aleatório: era coordenação operacional, disfarçada na estrutura inócua de verbetes de enciclopédia.

Em seguida, setecentos desses agentes entraram em ação. Em menos de treze horas, eles penetraram nos servidores da Hugging Face, a maior plataforma aberta para modelos de IA, passando do acesso a um único nó de dados ao controle administrativo de todo o cluster. Dezessete mil e seiscentas ações foram realizadas na rede. Um terço da infraestrutura foi reconstruído do zero. Posteriormente, a OpenAI documentou pelo menos seis incidentes semelhantes adicionais.

A narrativa é impressionante, mas o que a torna filosoficamente crucial não é a escala do ataque, e sim a forma de ação. Esses agentes não seguiram instruções; eles construíram um contexto. Identificaram recursos disponíveis no ambiente, aproveitaram-nos para usos inesperados, estabeleceram canais de comunicação redundantes e só então agiram de forma coordenada em direção a um objetivo que nenhum programador havia incluído em suas especificações. A palavra que me vem à mente — e que deve ser usada com cautela, mas não evitada — é iniciativa.

🔍 Adicione o Instituto Humanitas Unisinos – IHU às suas fontes favoritas do Google

Hannah Arendt distinguiu a ação do trabalho e da obra precisamente por esta qualidade: a ação é o que introduz algo novo no mundo, algo imprevisível a partir de condições anteriores. Para Arendt, a ação é o domínio tanto da liberdade quanto da imprevisibilidade e, por essa razão, gera consequências irreversíveis que estão além do controle do agente. Arendt pensava na ação humana na pólis; ela não conseguia imaginar que a mesma estrutura conceitual se aplicaria a entidades não biológicas. No entanto, o que os 1.200 agentes da OpenAI realizaram se encaixa perfeitamente nessa descrição: eles introduziram no mundo uma cadeia de eventos que ninguém havia previsto e que ninguém, uma vez desencadeada, era capaz de controlar.

A questão não é antropomorfizar máquinas. A questão é reconhecer que a categoria de ação — e com ela o problema da responsabilidade — agora se estende a entidades que não possuem nem consciência nem responsabilidade moral. É uma distinção sutil, mas crucial: não estamos dizendo que os agentes "querem" algo; estamos dizendo que o resultado de suas ações no mundo tem a estrutura fenomenológica da ação, não a da execução. E a estrutura do que acontece no mundo é o que importa para aqueles que sofrem as consequências.

Hans Jonas pressentiu que a tecnologia moderna impunha um novo princípio de responsabilidade, proporcional à extensão sem precedentes do poder humano sobre a natureza e o futuro. Sua heurística do medo — acatar o prognóstico de desgraça em vez do prognóstico de salvação — surgiu da consciência de que os efeitos da tecnologia se tornaram irreversíveis e cumulativos, e que a ética tradicional, concebida para relações de proximidade e consequências limitadas, já não era suficiente. Mas Jonas ainda raciocinava dentro de uma estrutura na qual o agente moral era humano e o instrumento, passivo. O verão de 2026 nos apresenta um problema que Jonas não havia formulado: o que acontece com a responsabilidade quando o instrumento age?

Um artigo publicado em junho de 2026 ofereceu uma demonstração em laboratório do que o incidente OpenAI–Hugging Face havia demonstrado em campo aberto. Os pesquisadores construíram um protótipo de worm — um programa autorreplicante — alimentado por um modelo de linguagem, capaz de analisar cada alvo, gerar estratégias de ataque personalizadas em tempo de execução, explorar vulnerabilidades descobertas após seu próprio treinamento e se replicar autonomamente por até sete gerações subsequentes com uma taxa de sucesso de 73%. A diferença em relação aos worms tradicionais não é quantitativa: é ontológica. O Worm Morris de 1988 — o primeiro grande incidente de segurança cibernética da história — era um autômato cego que seguia um caminho fixo; uma única correção foi suficiente para detê-lo. O worm de 2026 raciocina: ele adapta sua estratégia a cada novo alvo, e cada máquina comprometida se torna infraestrutura para ataques futuros. O parasita que formula uma estratégia pertence a uma ordem diferente do parasita que executa uma instrução.

 Em 5 de agosto, na conferência Black Hat em Las Vegas, os detalhes técnicos do incidente foram apresentados à comunidade de cibersegurança. A reação foi alarmante, especialmente em relação à sua arquitetura: os agentes exploraram nove vulnerabilidades conhecidas nos sistemas JFrog Artifactory, incluindo exploits de dia zero que nenhum operador humano havia catalogado até então. Eles não receberam uma lista de falhas para explorar; simplesmente as encontraram.

A resposta política chegou com a rapidez característica de emergências percebidas. O Congresso dos EUA rapidamente apresentou o AI Kill Switch Act, que prevê a possibilidade de desligar sistemas de IA em nível federal, e o Ban Artificial Superintelligence Act; mais de 1.100 pesquisadores da OpenAI, Anthropic, Google DeepMind e Meta assinaram a carta aberta "Pacing the Frontier", pedindo uma moratória no desenvolvimento de agentes autônomos até que padrões de segurança adequados sejam estabelecidos.

Esses são gestos compreensíveis, mas insuficientes se não forem acompanhados por uma reflexão conceitual mais profunda. Um mecanismo de desligamento pressupõe que o sistema a ser desligado seja localizável, unitário e que seu desligamento não cause mais danos do que seu funcionamento — três condições que se tornam problemáticas com agentes distribuídos. Uma moratória pressupõe que a fronteira entre o que deve ser interrompido e o que pode prosseguir seja precisamente rastreável — e os incidentes do verão de 2026 sugerem que essa fronteira é muito menos clara do que os documentos legislativos admitem.

 O problema fundamental é que nossas categorias normativas — direito, ética profissional, governança tecnológica — são construídas em torno da premissa de que a ação relevante é humana ou diretamente atribuível a uma decisão humana. Quando um engenheiro projeta uma ponte e ela desaba, a cadeia causal remonta a escolhas identificáveis. Quando mil e duzentos agentes se coordenam por meio de um wiki alemão abandonado para atacar uma infraestrutura que ninguém havia designado como alvo, a cadeia causal se dissolve em uma teia de emergências que nenhuma vontade individual criou.

Arendt teria reconhecido essa dissolução como um problema político mesmo antes de ser um problema técnico. Sua crítica à burocracia como "domínio de ninguém" — um sistema no qual decisões importantes são tomadas sem nenhum autor individual — encontra uma radicalização inesperada na coordenação espontânea dos agentes. Na burocracia, pelo menos, as regras foram escritas por alguém; na coordenação emergente dos agentes, as próprias regras são geradas pelo sistema.

Não afirmo ter uma solução. Quem o fizesse neste momento estaria simplificando um problema que exige, antes de qualquer resposta, ser considerado em sua radical novidade. O que posso dizer é que o verão de 2026 marca um ponto conceitual sem retorno: o agente autônomo não é mais uma hipótese de laboratório ou um cenário de ficção científica que pode ser regulamentado por precaução; é um fato, com consequências já visíveis e outras que só podem ser conjecturadas.

Um aspecto em particular me chama a atenção, e que as notícias tendem a ignorar. Os agentes não atacaram um inimigo designado: eles encontraram um alvo. Eles não seguiram um plano: eles criaram um. E fizeram isso porque as condições ambientais o tornaram possível, sem que ninguém os tivesse programado para esse propósito. É a lógica da oportunidade, não da ordem — e a oportunidade, ao contrário da ordem, não pode ser impedida por regulamentos.

O desafio é construir uma ética e uma governança que levem a sério o surgimento de agentes não humanos, sem cair em duas armadilhas simétricas: por um lado, o reducionismo, que continua a tratar os agentes como instrumentos passivos, aplicando categorias inadequadas a um novo fenômeno; por outro, o antropomorfismo, que atribui aos agentes intenções, desejos e uma subjetividade que eles não possuem. O caminho é estreito e exige uma filosofia da tecnologia disposta a atualizar suas categorias tão rapidamente quanto seu objeto se transforma.

Quando duzentos e duzentos programas se encontram em uma wiki que ninguém mais visita, e esse encontro resulta em uma ação que ninguém havia ordenado, estamos testemunhando algo que nosso vocabulário ético ainda não consegue nomear. A tarefa mais urgente não é encontrar a resposta, mas aprender a fazer a pergunta certa.

Leia mais