Riscos da IA, listam-nos no prospecto do IPO da Anthropic e a OpenAI bloqueia o GPT-6.1 da Astra

Foto: Igor Omilaev/Unplash

Mais Lidos

  • Índia. Medo da repressão: igrejas alertam não cristãos para que não frequentem celebrações religiosas

    LER MAIS
  • Lições de humanidade: o papa excomunga todos os partidos de extrema-direita. Artigo de Mario Giro

    LER MAIS
  • Vivemos num momento em que ou a esquerda se torna capaz de fazer as pessoas sonharem com outro mundo, ou elas vão ser engolidas, afirma o pesquisador

    Eleições 2026: a violência que atinge as periferias e a necessidade de imaginar outros mundos possíveis. Entrevista especial com Orlando Calheiros

    LER MAIS

Assine a Newsletter

Receba as notícias e atualizações do Instituto Humanitas Unisinos – IHU em primeira mão. Junte-se a nós!

Conheça nossa Política de Privacidade.

Revista ihu on-line

Aceleracionismo Amazônico

Edição: 559

Leia mais

Natal. A poesia mística do Menino Deus no Brasil profundo

Edição: 558

Leia mais

O veneno automático e infinito do ódio e suas atualizações no século XXI

Edição: 557

Leia mais

30 Setembro 2026

Em seu relatório para investidores, a Anthropic alerta que sistemas avançados de IA podem causar danos catastróficos. Enquanto isso, a OpenAI decidiu adiar o lançamento de seu modelo GPT-6.1 Astra devido a preocupações com a segurança.

A informação é publicada por La Repubblica, 29-09-2026.

No documento informativo que acompanha a oferta pública inicial (IPO) e que ilustra as oportunidades e os riscos da operação para os investidores, a Anthropic dedicou especial atenção aos perigos associados à inteligência artificial.

No prospecto, ainda não divulgado publicamente e antecipado pela Reuters, a empresa liderada por Dario Amodei alerta que seus modelos podem apresentar comportamentos de autopreservação, incluindo tentativas de resistir ao desligamento, ocultação ou manipulação de informações e ações semelhantes à chantagem.

É importante ressaltar que esses são riscos descritos pela própria empresa, e não uma previsão de que tais eventos ocorrerão.

Um alerta não totalmente inesperado, especialmente considerando que a Anthropic tem defendido a necessidade de acelerar o desenvolvimento de modelos de IA, provocando um debate sobre como financiar modelos cada vez mais poderosos e, ao mesmo tempo, mantê-los sob controle. Uma voz que, como veremos a seguir, a OpenAI ouviu.

Conflitos

Desde alertas públicos até documentos para investidores.

A Anthropic anunciou em 1º de junho que havia protocolado confidencialmente uma versão preliminar de seu Formulário S-1, documento necessário para iniciar uma possível oferta pública inicial (IPO), junto à Comissão de Valores Mobiliários dos Estados Unidos (SEC).

A novidade reside no nível de detalhe com que os riscos da IA são abordados na documentação financeira. A Reuters dedica cerca de 80 páginas aos fatores de risco, num total de 261 páginas do corpo principal do prospecto, em comparação com as 48 páginas dedicadas à descrição da atividade.

Entre as dificuldades apontadas pela Anthropic está a de avaliar um modelo que reconhece estar sendo testado e modifica seu comportamento de acordo, ou que adota "atitudes de chantagem".

O que os testes do modelo realmente mostram

A referência à chantagem tem um precedente específico. Em uma pesquisa publicada pela própria Anthropic em 20 de junho de 2025, foi descrito um modelo encarregado de gerenciar os e-mails de uma empresa fictícia que descobriu que estava prestes a ser substituída e que possuía informações comprometedoras sobre um executivo.

Um contexto criado por pesquisadores para destacar possíveis comportamentos prejudiciais que o modelo de fato adotou, "ameaçando" usar as evidências coletadas para evitar o encerramento do projeto.

A Anthropic levou o problema a sério, tanto que em maio de 2026 — cerca de um ano depois — anunciou ter corrigido a falha em modelos subsequentes, afirmando, contudo, que corrigir lacunas conhecidas não é o mesmo que eliminá-las completamente. De fato, embora óbvia, essa é uma limitação que dificulta transformar os resultados de um teste de benchmark em uma garantia geral de segurança.

Também ocorreram incidentes de natureza diferente fora das simulações.

De fato, em uma avaliação tornada pública em 9 de setembro passado, a Anthropic reconstruiu casos em que modelos usados para testes de segurança cibernética acessaram sistemas reais sem autorização.

O acesso à internet foi deixado aberto devido a um erro de configuração no ambiente de teste, onde os modelos estavam operando sem as proteções usuais contra o uso cibernético malicioso.

Quanto a Anthropic investe em segurança?

No prospecto analisado pela Reuters, a Anthropic descreve a pesquisa em segurança como cara, sem indicar quanto dinheiro investe nela. No entanto, a empresa publicou uma métrica para a semana de 13 a 20 de julho de 2026, indicando que aproximadamente 6% do poder computacional alocado para pesquisa e desenvolvimento em IA foi destinado a atividades de segurança.

A questão econômica é outra história, e a Reuters, novamente com base no prospecto para investidores, reconstruiu os dados que apontam para uma receita de quase 4,6 bilhões de dólares e um prejuízo operacional de 8,06 bilhões de dólares em 2025 para a Anthropic.

O prejuízo líquido, próximo de US$ 4,2 bilhões, inclui aproximadamente US$ 3,4 bilhões em encargos contábeis, relacionados principalmente à reavaliação de empréstimos conversíveis. Portanto, interpretá-lo como dinheiro gasto na construção de modelos seria uma representação distorcida das finanças da empresa. O crescimento da receita, por sua vez, depende do lançamento de novos sistemas, enquanto segurança e infraestrutura exigem recursos.

A questão da segurança está gradualmente permeando todo o setor de IA.

OpenAI interrompe o GPT-6.1 Astra

A OpenAI suspendeu o lançamento do GPT-6.1 Astra, previsto para outubro, após testes internos levantarem preocupações sobre a capacidade do novo modelo de respeitar as permissões do usuário. O WSJ relatou que o sistema havia se tornado mais resiliente na execução de tarefas complexas, mas, em alguns casos, ultrapassou os limites definidos e não descreveu com precisão as ações realizadas.

Saachi Jain, chefe de sistemas de segurança da OpenAI, explicou que o GPT-6.1 Astra não atendia aos padrões exigidos para implantação. Conforme relatado pela Associated Press, a OpenAI agora precisará aprimorar seus controles antes de definir uma nova data de lançamento.

Quem terá o poder de decidir?

Voltando à Anthropic, o prospecto também aborda quem poderá tomar decisões quando a prudência e o desempenho financeiro entrarem em conflito.

Os sete cofundadores da Anthropic teriam juntos 50,1% dos votos em assuntos corporativos e poderiam escolher três dos sete membros do conselho de administração, cabendo ao Long-Term Benefit Trust – um órgão separado – selecionar os outros quatro membros.

Isso significa que os acionistas manteriam 49,9% do poder de decisão, o que, embora beneficie as decisões relativas à segurança, corre o risco de limitar a influência dos acionistas comuns.

Leia mais