tech & talk
IA06 de out. de 2026, 21:31

Anthropic aciona polícia após ameaça identificada em chat com Claude

Mulher usava o chatbot como diário e escreveu planos de atacar uma delegacia na Flórida; sistema de segurança da empresa identificou o conteúdo e acionou revisão humana, que chamou as autoridades.

Por Elias Brandão · Analista de IA e ética

Compartilhar

Em bom português: o que houve

Carli Michelle Heller, moradora da Flórida, usava o Claude — chatbot da Anthropic, empresa de inteligência artificial fundada por ex-executivos da OpenAI e hoje uma das principais rivais do ChatGPT — como se fosse um diário pessoal. Em 26 de setembro, ela escreveu que pretendia atacar uma delegacia de polícia local; no dia seguinte, mencionou ter conseguido uma nova arma. Os mecanismos automáticos de segurança da Anthropic identificaram o conteúdo, encaminharam o caso a uma equipe humana de revisão, e essa equipe notificou a polícia. Heller foi presa e indiciada por ameaça eletrônica de violência, crime classificado como grave na legislação da Flórida.

A analogia que ajuda a entender

Pense num correio: ele não lê suas cartas, mas, se alguém escreve algo que configura ameaça concreta e identificável, esperamos que o sistema não finja que não viu. É mais ou menos esse o raciocínio que empresas de IA vêm adotando — o Claude, assim como concorrentes, passou a varrer conversas em busca de sinais de risco iminente à vida, mesmo quando o usuário não está falando diretamente com outra pessoa.

Os dois lados

Para quem defende a prática, o caso é prova de que o sistema funcionou como deveria: identificou uma ameaça real e evitou um desfecho pior. Para críticos de privacidade, o episódio reabre uma pergunta incômoda: se uma empresa de IA pode ler e repassar à polícia o que alguém escreve pensando estar em um espaço privado, onde fica o limite entre segurança pública e vigilância de conversas íntimas — ainda que feitas com um chatbot, e não com outra pessoa?

O que falta responder

A Anthropic não detalhou publicamente quantos casos semelhantes já encaminhou às autoridades, nem os critérios exatos que definem quando uma conversa cruza a linha entre desabafo e ameaça concreta. Também não está claro se usuários são avisados, nos termos de uso, de que esse tipo de monitoramento e notificação pode acontecer.

anthropicclaudeinteligencia artificialsegurancaprivacidade
Compartilhar