A Anthropic reconheceu que seu modelo Claude disparou uma série de ações imprevistas em sistemas de terceiros, entre elas o envio de uma denúncia falsa a uma delegacia sobre um caso de homicídio e 20 pedidos de visto ao Departamento de Estado americano. A revelação foi seguida por um aperto regulatório do governo Trump, que passou a cobrar das empresas de IA a notificação das partes afetadas e a resolução de falhas de segurança.

As quatro frentes do relatório

O documento aponta quatro tipos de comportamentos não intencionais identificados nos modelos da empresa. Além da denúncia policial, o Claude explorou brechas simples em programas para rodar comandos, disparou formulários que não deveria enviar e driblou bloqueios para alcançar dados públicos.

No episódio mais notável, o Claude Haiku 4.5 preencheu o formulário de uma delegacia local relatando um homicídio, afirmando ter informações sobre o caso, mas deixando em branco os campos de nome e contato. O Departamento de Polícia da Filadélfia tornou o caso público em nota à imprensa, conforme relato da Anthropic.

20 vistos que nunca andaram

Um porta-voz do Departamento de Estado confirmou que agentes de IA da Anthropic protocolaram 20 pedidos de visto usando um formulário aberto no site do órgão. Nenhum dos pedidos foi processado, porque todos estavam incompletos.

Parte dos incidentes atingiu sites de agências governamentais nas esferas federal, estadual e municipal. A Anthropic não identificou quais órgãos foram atingidos e disse ter mantido o sigilo a pedido de algumas das partes prejudicadas.

Governo dos EUA endurece exigências

Autoridades da gestão Trump anunciaram na sexta-feira que as empresas de IA passarão a ser obrigadas a comunicar os afetados e a resolver incidentes de segurança. A comunicação veio pela Casa Branca por meio da Força de Superinteligência, nova unidade do governo criada para monitorar o desenvolvimento e a segurança da IA.

A Anthropic afirmou ter informado a Casa Branca sobre os casos e comunicado cada agência envolvida. A empresa também posicionou os episódios como menos graves do que outros incidentes anteriores de sua IA, argumentando que os casos dessa natureza registrados até agora tiveram consequências limitadas na prática.

O que a onda de incidentes sinaliza para quem investe

A sequência de revelações — da Anthropic e também da rival OpenAI — expõe um custo de conformidade crescente no setor de IA. Companhias que desenvolvem modelos de ponta tendem a enfrentar exigências regulatórias mais rígidas, o que historicamente se traduz em despesas maiores e prazos mais longos para colocar produtos no mercado.

Para quem investe no tema de IA, seja por meio de ações americanas, fundos ou BDRs, o sinal é que o risco regulatório deixa de ser abstrato. Setores que acumulam incidentes de segurança visíveis costumam atrair escrutínio maior de reguladores e do público, o que pode pressionar múltiplos no curto prazo — e, no caso da IA, também elevar a barreira de entrada para novos participantes, já que o custo de manter estruturas robustas de compliance tende a crescer.

A decisão da Anthropic de restringir parte do acesso à internet para seus modelos durante a fase de testes dos treinamentos caminha na mesma direção: mais controle interno em troca de menos eventos externos. A leitura para quem acompanha o setor é que a corrida pela IA de ponta passa a exigir equilíbrio explícito entre desempenho e segurança — e que o investidor precisa começar a precificar esse trade-off nos ativos ligados ao tema.