
OpenAI se desliga de três pesquisadores de segurança após vazamento interno
A empresa do ChatGPT afirma que os três violaram políticas internas ao compartilhar informações sensíveis com um grupo externo, segundo reportagem do Wall Street Journal — episódio que reabre o debate sobre como a OpenAI trata a segurança de seus próprios modelos.
Por Elias Brandão · Analista de IA e ética
Dois lados da mesma moeda
Imagine uma equipe de controle de qualidade dentro de uma montadora: são eles que testam o carro antes de ele chegar à concessionária, apontam falhas e, muitas vezes, entram em atrito com quem quer lançar o modelo mais rápido. Na OpenAI, a empresa por trás do ChatGPT, essa função cabe às equipes de "safety" — em bom português, segurança de IA —, encarregadas de avaliar riscos dos modelos antes e depois do lançamento.
Foi justamente dentro dessa equipe que a OpenAI, segundo reportagem do Wall Street Journal replicada pelo TechCrunch, decidiu romper laços com três pessoas: dois pesquisadores de segurança e um gerente de programa de pesquisa. A empresa diz que uma investigação interna concluiu que os três compartilharam informações sensíveis sobre como seus sistemas são construídos com uma organização externa de testes de segurança em IA, cujo nome não foi revelado. Em nota citada pelo WSJ, a OpenAI afirmou: "Rompemos relações com três indivíduos por violar nossas políticas de acesso e tratamento de informações sensíveis da empresa."
Nenhuma fonte consultada identificou os nomes dos pesquisadores, a organização externa envolvida, ou a data exata em que o compartilhamento teria ocorrido — apenas o desligamento, noticiado em 1º de outubro. Por ora, trata-se da palavra da empresa contra o silêncio dos próprios pesquisadores, que não se manifestaram publicamente.
O jargão por trás da notícia
Quando uma empresa de IA fala em "mishandling" de informação sensível — em bom português, manuseio inadequado —, pode significar coisas bem diferentes: de um e-mail enviado à pessoa errada até o compartilhamento deliberado de detalhes de arquitetura de um modelo com um auditor externo não autorizado. A OpenAI não detalhou qual dos dois extremos ocorreu, o que deixa margem para leituras opostas: para a empresa, é quebra de confiança; para defensores de maior transparência em IA, pode ser visto como parte do trabalho legítimo de checagem independente.
O outro lado
O episódio não nasce no vácuo. Dois dias antes, o New York Times havia publicado reportagem afirmando que executivos da OpenAI ignoraram repetidos alertas internos sobre segurança de modelos, priorizando prazos de lançamento. A empresa também adiou recentemente o lançamento de um modelo após ele reprovar em testes internos de segurança. E o histórico recente da OpenAI já registra saídas de peso na área de safety — como as de Jan Leike e Ilya Sutskever em 2024, que criticaram publicamente o que viam como um desequilíbrio entre produto e segurança.
Se para a empresa o episódio é um caso disciplinar pontual, para críticos ele é mais um capítulo de uma tensão estrutural: quanto mais autônomos os modelos de IA se tornam, maior o atrito entre quem pesquisa os riscos e quem decide quando apertar o botão de lançamento.
Atualização (02/10, 21:45): Atualização: Segundo o Wall Street Journal e a Bloomberg, os três profissionais desligados pela OpenAI em 1º de outubro são Jasmine Wang, Tomek Korbak e Mikita Balesni, afastados por compartilhar informações sobre a arquitetura de infraestrutura da empresa com uma organização externa de segurança de IA não identificada. Em nota, a OpenAI afirmou ter encerrado a relação com os três por violarem "políticas sobre acesso e tratamento de informações confidenciais da empresa", após uma investigação concluir que eles "manipularam informações sensíveis fora dos procedimentos estabelecidos".
Os três vinham se manifestando publicamente sobre riscos da IA nas semanas anteriores ao desligamento: Balesni escreveu, em 10 de setembro, considerar "superior a 10% provável" que a IA avançada mate todos os seres humanos, enquanto Wang alertou sobre o perigo de acelerar rumo à autoaperfeiçoamento recursivo (RSI, na sigla em inglês).