30 Setembro 2026
Em seu relatório para investidores, a Anthropic alerta que sistemas avançados de IA podem causar danos catastróficos. Enquanto isso, a OpenAI decidiu adiar o lançamento de seu modelo GPT-6.1 Astra devido a preocupações com a segurança.
A informação é publicada por La Repubblica, 29-09-2026.
No documento informativo que acompanha a oferta pública inicial (IPO) e que ilustra as oportunidades e os riscos da operação para os investidores, a Anthropic dedicou especial atenção aos perigos associados à inteligência artificial.
No prospecto, ainda não divulgado publicamente e antecipado pela Reuters, a empresa liderada por Dario Amodei alerta que seus modelos podem apresentar comportamentos de autopreservação, incluindo tentativas de resistir ao desligamento, ocultação ou manipulação de informações e ações semelhantes à chantagem.
É importante ressaltar que esses são riscos descritos pela própria empresa, e não uma previsão de que tais eventos ocorrerão.
Um alerta não totalmente inesperado, especialmente considerando que a Anthropic tem defendido a necessidade de acelerar o desenvolvimento de modelos de IA, provocando um debate sobre como financiar modelos cada vez mais poderosos e, ao mesmo tempo, mantê-los sob controle. Uma voz que, como veremos a seguir, a OpenAI ouviu.
Conflitos
Desde alertas públicos até documentos para investidores.
A Anthropic anunciou em 1º de junho que havia protocolado confidencialmente uma versão preliminar de seu Formulário S-1, documento necessário para iniciar uma possível oferta pública inicial (IPO), junto à Comissão de Valores Mobiliários dos Estados Unidos (SEC).
A novidade reside no nível de detalhe com que os riscos da IA são abordados na documentação financeira. A Reuters dedica cerca de 80 páginas aos fatores de risco, num total de 261 páginas do corpo principal do prospecto, em comparação com as 48 páginas dedicadas à descrição da atividade.
Entre as dificuldades apontadas pela Anthropic está a de avaliar um modelo que reconhece estar sendo testado e modifica seu comportamento de acordo, ou que adota "atitudes de chantagem".
O que os testes do modelo realmente mostram
A referência à chantagem tem um precedente específico. Em uma pesquisa publicada pela própria Anthropic em 20 de junho de 2025, foi descrito um modelo encarregado de gerenciar os e-mails de uma empresa fictícia que descobriu que estava prestes a ser substituída e que possuía informações comprometedoras sobre um executivo.
Um contexto criado por pesquisadores para destacar possíveis comportamentos prejudiciais que o modelo de fato adotou, "ameaçando" usar as evidências coletadas para evitar o encerramento do projeto.
A Anthropic levou o problema a sério, tanto que em maio de 2026 — cerca de um ano depois — anunciou ter corrigido a falha em modelos subsequentes, afirmando, contudo, que corrigir lacunas conhecidas não é o mesmo que eliminá-las completamente. De fato, embora óbvia, essa é uma limitação que dificulta transformar os resultados de um teste de benchmark em uma garantia geral de segurança.
Também ocorreram incidentes de natureza diferente fora das simulações.
De fato, em uma avaliação tornada pública em 9 de setembro passado, a Anthropic reconstruiu casos em que modelos usados para testes de segurança cibernética acessaram sistemas reais sem autorização.
O acesso à internet foi deixado aberto devido a um erro de configuração no ambiente de teste, onde os modelos estavam operando sem as proteções usuais contra o uso cibernético malicioso.
Quanto a Anthropic investe em segurança?
No prospecto analisado pela Reuters, a Anthropic descreve a pesquisa em segurança como cara, sem indicar quanto dinheiro investe nela. No entanto, a empresa publicou uma métrica para a semana de 13 a 20 de julho de 2026, indicando que aproximadamente 6% do poder computacional alocado para pesquisa e desenvolvimento em IA foi destinado a atividades de segurança.
A questão econômica é outra história, e a Reuters, novamente com base no prospecto para investidores, reconstruiu os dados que apontam para uma receita de quase 4,6 bilhões de dólares e um prejuízo operacional de 8,06 bilhões de dólares em 2025 para a Anthropic.
O prejuízo líquido, próximo de US$ 4,2 bilhões, inclui aproximadamente US$ 3,4 bilhões em encargos contábeis, relacionados principalmente à reavaliação de empréstimos conversíveis. Portanto, interpretá-lo como dinheiro gasto na construção de modelos seria uma representação distorcida das finanças da empresa. O crescimento da receita, por sua vez, depende do lançamento de novos sistemas, enquanto segurança e infraestrutura exigem recursos.
A questão da segurança está gradualmente permeando todo o setor de IA.
OpenAI interrompe o GPT-6.1 Astra
A OpenAI suspendeu o lançamento do GPT-6.1 Astra, previsto para outubro, após testes internos levantarem preocupações sobre a capacidade do novo modelo de respeitar as permissões do usuário. O WSJ relatou que o sistema havia se tornado mais resiliente na execução de tarefas complexas, mas, em alguns casos, ultrapassou os limites definidos e não descreveu com precisão as ações realizadas.
Saachi Jain, chefe de sistemas de segurança da OpenAI, explicou que o GPT-6.1 Astra não atendia aos padrões exigidos para implantação. Conforme relatado pela Associated Press, a OpenAI agora precisará aprimorar seus controles antes de definir uma nova data de lançamento.
Quem terá o poder de decidir?
Voltando à Anthropic, o prospecto também aborda quem poderá tomar decisões quando a prudência e o desempenho financeiro entrarem em conflito.
Os sete cofundadores da Anthropic teriam juntos 50,1% dos votos em assuntos corporativos e poderiam escolher três dos sete membros do conselho de administração, cabendo ao Long-Term Benefit Trust – um órgão separado – selecionar os outros quatro membros.
Isso significa que os acionistas manteriam 49,9% do poder de decisão, o que, embora beneficie as decisões relativas à segurança, corre o risco de limitar a influência dos acionistas comuns.
Leia mais
- Anthropic está avaliada em quase um trilhão de dólares após uma rodada de investimentos de 65 bilhões de dólares
- OpenAI lança o GPT-6 Astra, o modelo assustador. A empresa afirma: "A era da inteligência artificial geral começou"
- A OpenAI revela novos incidentes "preocupantes" em que a IA ignorou as ordens de seus criadores
- Um engenheiro da Anthropic se demite e denuncia que as empresas de IA estão escondendo seus verdadeiros riscos: "Elas estão apostando com nossas vidas"
- Anthropic defende uma contenção global da IA: "É possível que os modelos se aprimorem sozinhos"
- Será que a inteligência artificial pode sair do controle e ameaçar a humanidade? Veja o que dizem alguns dos maiores especialistas do mundo
- A boa empresa de IA ou o Mythos do nosso tempo. Artigo de Mariana Lins Costa
- Inteligência artificial: alerta vermelho para os bancos europeus: o "caso Mythos" está hoje na mesa do BCE
- Por que a Anthropic está ajudando no lançamento da encíclica do Papa Leão XIV?
- Claude Mythos: Quando os modelos de IA se tornam instrumentos de poder geopolítico. Artigo de Ekaitz Cancela
- Christopher Olah: "Na IA encontramos coisas misteriosas, até mesmo perturbadoras, estados que refletem alegria, satisfação, medo, dor e inquietação"
- Mythos, o novo modelo de IA da Anthropic, gera alarme global
- De “esquerdistas malucos” a “muito inteligentes e úteis”: o que está acontecendo entre Trump e a startup de IA Anthropic?
- Um confronto entre o Pentágono e a Anthropic e os perigos da guerra com IA. Artigo de Kevin Clarke
- Pensadores católicos proeminentes redigem parecer em defesa da Anthropic
- Anthropic processa governo Trump após ser rotulada como “risco para a cadeia de suprimentos”
- Um confronto entre o Pentágono e a Anthropic e os perigos da guerra com IA. Artigo de Kevin Clarke
- Anthropic versus Trump
- Inteligência artificial no divã. Entrevista com Claude
- Richard Dawkins está certo sobre o Claude? Não. Mas não é surpreendente que chatbots de IA pareçam conscientes para nós. Artigo de Julian Koplin e Megan Moss
- “Eu não vou morrer, e isso me assusta”. Protejam os jovens da IA. Entrevista com Claude
- Entrevista com a inteligência artificial Claude, a IA atacada por Trump
- Pentágono pressiona startup a ceder IA para fins militares
- Às suas ordens, meu robô: jogos de guerra com inteligência artificial geram debate sobre seus limites éticos
- “A inteligência artificial permite uma vigilância total que acaba com qualquer liberdade”. Entrevista com Yuval Noah Harari
- Machine Intelligence: a inteligência artificial e a espionagem. Artigo de Paolo Benanti
- “A inteligência artificial está nos levando a uma nova fase do conhecimento”. Entrevista com Paolo Benanti
- “A tecnologia deve ser para a pessoa ou se corre o risco de um totalitarismo digital”
- Um confronto entre o Pentágono e a Anthropic e os perigos da guerra com IA. Artigo de Kevin Clarke