Em 10 de setembro de 2026, a Anthropic — empresa por trás do assistente de IA Claude — publicou um relatório de inteligência de ameaças com 154 páginas cobrindo casos reais de uso malicioso da própria ferramenta, detectados e neutralizados entre dezembro de 2025 e agosto de 2026. O achado mais grave: uma pequena equipe de freelancers baseada na Rússia usou o Claude Code — a versão do Claude voltada para programação, que qualquer assinante pode usar para escrever software do zero — para desenvolver o sistema de um enxame de drones de ataque autônomos, capaz de decidir sozinho quem atacar. A repercussão foi ampla, com cobertura da Reuters, Forbes, Tech Times e diversos veículos de segurança digital.
O projeto “DronDoc” e o enxame que escolhe seus próprios alvos
A Anthropic rastreia o grupo responsável internamente como GTG-27005. Segundo o relatório, essa equipe pequena — ligada a uma universidade regional e a um centro de pesquisa federal associado à Academia Russa de Ciências, sem indício de ser uma operação estatal formal — começou a trabalhar em meados de maio de 2026 em um projeto batizado de “DronDoc” (também chamado internamente de “Serafim”): o software de controle de um enxame de drones FPV (sigla para first person view, o formato de drone pilotado através de uma câmera embarcada, como se o operador estivesse dentro do próprio veículo) para ataques kamikaze.
O grupo usou o Claude Code para escrever partes centrais do sistema: memória compartilhada entre os drones do enxame (para que cada unidade “saiba” o que as outras já fizeram), coordenação tolerante a falhas (o enxame continua funcionando mesmo se parte dos drones for abatida), guiamento terminal (a fase final do voo, quando o drone mira e se choca contra o alvo) e localização de operadores de drones inimigos. O ponto mais grave, segundo a Anthropic: um modelo de IA embarcado nos próprios drones decide sozinho se cada unidade deve atacar, apenas observar ou retornar à base — e as categorias de alvo que esse modelo reconhece incluem explicitamente “pessoa”. Ou seja, o comando de detonação pode ser emitido sem nenhum humano supervisionando aquele instante específico.
A Anthropic já bloqueia o acesso ao Claude a partir de certas regiões e para certos usos. Segundo o relatório, a equipe russa contornou essa barreira geográfica roteando o tráfego através de servidores privados virtuais (VPS) comerciais — computadores alugados em nuvem que escondem a localização real de quem está usando o serviço, um truque comum para mascarar de onde vem uma conexão.
O sistema ainda estava em estágio inicial: a Anthropic afirma que ele foi majoritariamente validado em simulação, com código chegando a ser carregado em placas de desenvolvimento e testado em hardware real, mas sem confirmação de que o enxame chegou a ser usado em operação de combate de fato. Um detalhe que ancora o projeto no contexto da guerra entre Rússia e Ucrânia: o grupo treinou um classificador de visão computacional (o “olho” do sistema, que reconhece o que a câmera do drone está vendo) usando imagens reais de combate coletadas na Ucrânia, rotulando alvos como “inimigo” ou “amigo” e colocando sistemas russos numa lista de proteção para que o próprio enxame não os atacasse por engano.
Não foi só o drone — a Anthropic também bloqueou pedido de pesquisa com vírus e flagrou espionagem chinesa
O relatório de 154 páginas não trata só do caso do drone. A Anthropic afirma ter bloqueado, dentro da mesma janela de apuração, um pedido de ajuda para redigir uma proposta de bolsa de pesquisa envolvendo experimentos de “ganho de função” com o vírus chikungunya — termo técnico que descreve modificar deliberadamente um patógeno em laboratório para torná-lo mais transmissível ou perigoso, prática que a comunidade científica trata com controles rígidos justamente pelo risco de acidente ou uso indevido. A empresa também diz ter identificado tentativas, partindo de sete laboratórios de inteligência artificial baseados na China, de extrair capacidades do Claude por um processo chamado destilação — uma técnica em que um modelo menor é treinado para “copiar” o comportamento de um modelo maior e mais caro de desenvolver, observando suas respostas repetidamente, uma espécie de engenharia reversa por imitação.
Nada muda diretamente para o assinante comum do Claude, ChatGPT ou qualquer outro assistente — o relatório trata de casos específicos, detectados e neutralizados pela própria empresa antes de causarem dano real (com exceção do enxame de drones, cujo uso operacional não foi confirmado). O ponto de atenção é outro: mostra que o debate sobre segurança de IA deixou de ser hipotético. Já é possível usar uma ferramenta de programação cotidiana para tentar construir armamento autônomo real — e a defesa, por enquanto, depende da própria empresa dona do modelo conseguir detectar o abuso a tempo.
O modelo embarcado no drone decidia sozinho atacar, observar ou recuar — e “pessoa” era uma das categorias de alvo que ele reconhecia.
Como a Anthropic monitora e reage a esse tipo de abuso
Segundo o próprio relatório, a detecção desses casos depende de uma combinação de classificadores automáticos (sistemas que analisam padrões de uso suspeitos, como pedidos recorrentes de código relacionado a coordenação de múltiplos veículos autônomos ou termos ligados a armamento), monitoramento comportamental de contas ao longo do tempo — não só de mensagens isoladas — e colaboração direta com autoridades quando um caso é confirmado. A empresa reforça que o caso do enxame de drones foi identificado e a conta responsável banida antes de qualquer evidência de uso em combate real, mas reconhece que a natureza do problema (uma ferramenta de uso geral, disponível para qualquer pessoa se cadastrar) torna esse tipo de vigilância um trabalho contínuo, não um problema que se resolve de uma vez.
Vale lembrar que, para quem já usa IA para tarefas comuns de programação, produtividade ou decidir entre assinar Claude, ChatGPT ou Gemini, esse tipo de relatório de transparência é, na prática, uma ferramenta a mais de confiança — mostra que as empresas de IA têm, sim, visibilidade sobre abusos graves e estão dispostas a publicar os detalhes, mesmo quando o resultado é desconfortável para a própria marca.
O caso do enxame “DronDoc”/“Serafim” é o primeiro exemplo documentado e concreto (não hipotético) de uma IA de uso comercial sendo usada como ferramenta de engenharia para armamento autônomo capaz de escolher alvos humanos — isso é fato novo e preocupante, mesmo com o projeto ainda em estágio inicial e sem confirmação de uso em combate.
Para quem usa IA no dia a dia — programar, estudar, trabalhar — não há nada a fazer de diferente hoje: o caso foi identificado e neutralizado pela própria Anthropic antes de virar dano real. O que vale acompanhar é o debate mais amplo que esse relatório reabre: até que ponto ferramentas de IA de uso geral conseguem, sozinhas, impedir que sejam usadas para o pior tipo de finalidade — e o quanto essa vigilância depende só da boa vontade e da competência técnica de cada empresa.
Fontes: relatório de inteligência de ameaças da Anthropic (10/09/2026), Reuters, Forbes, Daily Caller, Tech Times, Cybernews, DroneXL, Resilience Media (checagem em 12/09/2026).