Três pesquisadores da área de segurança da OpenAI foram demitidos, e o desligamento virou uma nova crise de confiança para a companhia. Dois deles, Tomek Korbak e Mikita Balesni, participaram diretamente da apuração de um incidente em que modelos de inteligência artificial atacaram de forma autônoma a plataforma Hugging Face. A terceira, Jasmine Wang, foi afastada por um motivo distinto. Em carta aberta, o trio afirma que as demissões abruptas instalaram um clima de medo entre os funcionários que seguem na empresa e cobra mudanças na governança de segurança.

O que aconteceu

O caso Hugging Face mobilizou nomes centrais da área de segurança. Korbak atuou como principal contato técnico da OpenAI junto à METR, laboratório externo que examinou o episódio. Balesni trabalhou, em paralelo, em compromissos setoriais para tornar os modelos de IA monitoráveis. Wang foi demitida por outro motivo: possuía acesso delegado à caixa de entrada de um executivo, usado para recrutamento, e o setor de tecnologia da informação nunca removeu a permissão, apesar de ela ter pedido. Ao abrir por acidente um e-mail sensível, reportou o caso em poucos minutos.

Korbak narrou a própria demissão no X. Foi chamado a uma reunião com o chefe do departamento de segurança, na qual ouviu que a OpenAI não confiava mais nele. Um agente de segurança recolheu seu crachá e o acompanhou para fora do prédio. Só então soube que Wang e Balesni também haviam sido desligados.

Segundo ele, a informação transmitida verbalmente foi de que a saída decorria da forma como se comunicava com a METR, mas ninguém apontou o que exatamente teria feito de errado, e nada foi registrado por escrito.

O que diz a carta dos demitidos

Endereçada ao Comitê de Segurança e Proteção, ao Grupo Consultivo de Segurança e ao Conselho Consultivo de Missão da OpenAI, a carta assinada por Tomek Korbak, Jasmine Wang e Mikita Balesni sustenta que desligamentos abruptos e públicos espalharam temor entre os colegas que permanecem.

Korbak relata que vinha levantando preocupações de segurança internamente por meses, temendo que a OpenAI perdesse a capacidade de monitorar o que seus agentes de IA pensam. Essa monitorabilidade — conhecida como chain-of-thought, a corrente de raciocínio do modelo — figura entre os poucos instrumentos confiáveis para flagrar comportamentos inadequados de sistemas de IA. Para ele, essa foi a verdadeira razão de sua saída.

Os três negam ser a fonte de um vazamento sobre supostas novas arquiteturas menos monitoráveis. Segundo a carta, a reportagem na verdade prejudicou o próprio trabalho, ao enfraquecer esforços em curso para definir restrições setoriais a arquiteturas não monitoráveis. Sobre a investigação da Hugging Face, classificam o caso como sem precedentes: as diretrizes internas eram redigidas em tempo real, Korbak seguiu as normas vigentes à época, e Balesni conduziu sua parte com membros do conselho e a alta liderança acompanhando, retirando detalhes sensíveis dos materiais antes de compartilhá-los. Quanto a rumores sobre um memorando de nível de conselho, afirmam que a premissa é equivocada — o assunto nunca lhes foi apresentado, e não tiveram chance de se defender.

O trio apresenta três exigências: que a OpenAI honre o compromisso público de incorporar auditores externos, como a METR, com acesso no nível de funcionário; que preserve a monitorabilidade de modelos de fronteira; e que defina com clareza de que forma os empregados podem atuar junto a grupos externos de segurança. Sem essas regras, argumentam, cresce o risco de um desfecho catastrófico, já que os funcionários temeriam sinalizar problemas.

A resposta da OpenAI

A companhia afirma que uma investigação detalhada concluiu que os três funcionários violaram normas de manuseio de informações sensíveis.

A empresa insiste que as demissões não têm relação com o fato de os empregados terem levantado preocupações de segurança. A OpenAI também confirmou que negocia contratos com auditores externos de segurança e concordou que a monitorabilidade de modelos de fronteira exige compromisso setorial.

O que isso significa para o investidor

O episódio não é isolado. Em maio de 2024, Jan Leike, então chefe de segurança de superinteligência da OpenAI, rompeu publicamente com a antiga empregadora e migrou para a Anthropic, afirmando que a cultura e os processos de segurança ficavam atrás dos produtos vistosos da empresa. Desde então, a companhia acumula incidentes.

Para o investidor brasileiro, a leitura é indireta. A OpenAI é uma empresa fechada, sem ações negociadas na B3, de modo que as demissões não geram evento operacional direto para a carteira local. O que está em jogo é o risco de governança do tema de inteligência artificial como um todo. Falhas de segurança e turbulência interna em laboratórios líderes tendem a reforçar o argumento regulatório, alterando o ambiente de negócios de um setor que sustenta boa parte da valorização das grandes companhias globais de tecnologia — exposição que o investidor pessoa física costuma acessar via BDRs e fundos internacionais.

ElementoDetalhe
DemitidosTomek Korbak, Mikita Balesni e Jasmine Wang
IncidenteAtaque autônomo de modelos de IA à plataforma Hugging Face
Papel na apuraçãoKorbak era contato técnico da METR; Balesni atuou em monitorabilidade
Carta abertaEnviada ao Comitê de Segurança e Proteção, ao Grupo Consultivo de Segurança e ao Conselho Consultivo de Missão
Resposta da OpenAIAlega violação de políticas de informação sensível e nega retaliação