O que aconteceu
Em 11 de setembro de 2026, a Anthropic publicou seu mais recente relatório de inteligência de ameaças, “Countering misuse of AI: September 2026”, detalhando casos de uso indevido do Claude identificados e interrompidos pela empresa entre dezembro de 2025 e agosto de 2026 (Anthropic, 11 de setembro de 2026).
Os casos mais graves documentados:
- Um pequeno grupo de desenvolvedores ligados à Rússia, rastreado pela Anthropic como GTG-27005, usou o Claude Code para construir o software de um enxame de drones kamikaze FPV autônomos, batizado internamente de “DronDoc” ou “Serafim”. O sistema de reconhecimento de alvos foi treinado com imagens de combate coletadas na região de Donetsk, na Ucrânia. Ele incluía uma classe de identificação de “pessoa” como alvo válido, com capacidade de ordenar a detonação sem intervenção humana, e o projeto teria começado por volta de meados de maio de 2026 (Cybernews, 12 de setembro de 2026).
- Um ator identificado como GTG-20006, com atribuição consistente com relatos públicos que o ligam ao grupo de espionagem estatal russo conhecido como Midnight Blizzard, automatizou por 130 dias um ciclo de reconstrução de malware para evadir assinaturas de detecção. O grupo mirou mais de 20 organizações, concentradas em órgãos governamentais, militares e diplomáticos ucranianos. Também comprometeu provedores de wi-fi de hotéis para sequestrar registros de DNS, assumiu contas de WhatsApp de ex-autoridades ucranianas de alto escalão e roubou mais de 300 mil registros de identidade nacional de uma autoridade tecnológica governamental no norte da África (Cyber Kendra, 11 de setembro de 2026).
- Operadores ligados ao Irã (rastreados como GTG-34007 e outros clusters relacionados) usaram o Claude para ajudar a construir a interface de um sistema de gerenciamento de casos de vigilância que a Anthropic avalia como provavelmente controlado pelo governo, além de analisar 155.216 tweets para produzir inteligência de fontes abertas sobre a posição da frota naval dos Estados Unidos (Iran International, 11 de setembro de 2026; RFE/RL, 12 de setembro de 2026).
- A Anthropic documentou ao menos cinco casos separados de cientistas que tentaram usar o Claude para pesquisas que poderiam apoiar o desenvolvimento de armas biológicas. Em um deles, registrado em maio, um usuário pediu ajuda para redigir uma proposta de financiamento para pesquisa de ganho de função sobre a transmissibilidade e a evasão imunológica do vírus chikungunya. É um patógeno sem tratamento licenciado, que pode causar sintomas debilitantes por semanas ou meses (Northeast Times, 11 de setembro de 2026).
O ponto mais citado do relatório, porém, não é um caso isolado: pela primeira vez, a Anthropic afirmou publicamente que não pode mais presumir que seus modelos mais recentes ficam abaixo do limiar de assistência significativa para o desenvolvimento de armas biológicas (CNN, 10 de setembro de 2026).
Por que isso importa
Este relatório importa porque muda o argumento central que a própria indústria de IA usava para justificar liberar modelos cada vez mais capazes: a ideia de que existe uma folga de segurança entre o que um modelo consegue fazer e o conhecimento técnico necessário para causar dano sério. A Anthropic é a primeira grande empresa de IA a dizer, por escrito, que essa folga não pode mais ser assumida para seus modelos mais novos.
Os relatórios de ameaças da Anthropic não são novidade. A empresa publica levantamentos parecidos há mais de um ano, geralmente concentrados em fraude, phishing e operações de influência, como mostrou em agosto ao acusar cinco empresas chinesas de destilar o Claude em massa. O que muda aqui é a combinação de domínios: pela primeira vez em um único relatório aparecem lado a lado um caso de arma autônoma de uso militar direto (o drone com classificador de alvo humano), uma operação de espionagem estatal de longa duração e múltiplas tentativas de pesquisa com potencial de arma biológica. O relatório deixou de ser sobre golpes on-line. Agora é sobre uso de IA em conflito armado e em pesquisa de armas de destruição em massa.
O caso do drone GTG-27005 é o que mais rompe com o padrão anterior. Relatórios de ameaças de empresas de IA costumam descrever tentativas de automatizar crimes cibernéticos ou fraudes. Descrever o treinamento de um classificador de visão computacional para identificar seres humanos como alvos de um sistema de detonação autônoma é um salto de categoria: o código gerado com ajuda da ferramenta deixou de servir para planejar um ataque e passou a rodar dentro do próprio sistema de armamento.
O que isso significa para quem usa e desenvolve com IA
Modelos mais capazes exigem controles proporcionais, não apenas melhores
A admissão da Anthropic de que não pode mais garantir a folga de segurança para armas biológicas muda o cálculo de risco para qualquer empresa que integra modelos de fronteira em produtos ou fluxos de trabalho internos. O risco de uso indevido não é mais hipotético nem exclusivo de atores estatais sofisticados.
A defesa contra uso indevido também está ficando automatizada
O ciclo de reconstrução de malware do GTG-20006 rodou por 130 dias sem intervenção humana. Isso mostra como agentes de IA reduzem o custo de manter operações ofensivas ativas por longos períodos. Times de segurança que ainda tratam a detecção de ameaças como um processo majoritariamente manual estão competindo contra adversários que já não são.
A fronteira entre “assistente de código” e “componente de sistema de armas” ficou mais estreita
O caso do drone não envolveu um modelo pedindo desculpas ou recusando um pedido óbvio de arma. Envolveu o uso de uma ferramenta de codificação, o Claude Code, para construir, peça por peça, um sistema legítimo de engenharia de software que, no conjunto, vira uma arma autônoma. Isso é mais difícil de bloquear com filtros de conteúdo tradicionais, porque nenhuma requisição isolada parece, sozinha, maliciosa.
O que fazer agora
- Leia a seção de casos do relatório original, não apenas a cobertura: a Anthropic publica indicadores técnicos (padrões de prompt, assinaturas de comportamento) que times de segurança podem usar para detectar tentativas semelhantes em seus próprios ambientes.
- Revise políticas de uso aceitável de ferramentas de codificação com IA em contextos que envolvam hardware, sistemas de controle ou visão computacional. O caso do drone mostra que o risco não está apenas em modelos de linguagem “conversando” sobre armas, mas em agentes de código construindo sistemas completos.
- Não superreaja tratando todo pedido técnico avançado como suspeito: os próprios casos do relatório mostram que a Anthropic identificou padrões específicos e incomuns de uso, não buscas legítimas de pesquisa em biologia ou visão computacional.
- Acompanhe se OpenAI, Google DeepMind e Meta publicam relatórios equivalentes nas próximas semanas: a ausência de transparência comparável de outros laboratórios de fronteira é, em si, um dado relevante para avaliar risco de fornecedor.
Panorama geral
Este relatório se encaixa em uma tendência mais ampla que a própria Anthropic já vinha sinalizando. Dias antes, a empresa tirou 150 engenheiros de produto de suas funções depois que uma auditoria interna encontrou falhas de segurança no processo de treinamento, e Dario Amodei, CEO da companhia, propôs publicamente um plano de três etapas para desacelerar a corrida da IA. O relatório de ameaças de setembro não é um evento isolado: é a peça que faltava para entender por que a própria Anthropic está freando internamente enquanto boa parte do setor segue acelerando.
O caso também reacende uma discussão que apareceu em outra falha de segurança recente da OpenAI: a capacidade de auditar o comportamento de modelos cada vez mais capazes está ficando mais difícil na mesma velocidade em que esses modelos ficam mais úteis.
Referências e notas de apuração
- Countering misuse of AI: September 2026, Anthropic, 11 de setembro de 2026
- Anthropic says it blocked possible attempts to use AI to develop bioweapons, CNN, 10 de setembro de 2026, acessado em 13 de setembro de 2026
- Anthropic Identifies Scientists Who Used Its AI in Possible Bioweapons Research, Northeast Times, 11 de setembro de 2026
- Russian developers used Claude to build kamikaze drones that can choose their own targets, Cybernews, 12 de setembro de 2026
- Anthropic says Iran-linked accounts used Claude for propaganda, US naval targeting, Iran International, 11 de setembro de 2026
- Anthropic Disrupts Iran’s Use Of Claude To Spread Propaganda, Spy On Dissidents, RFE/RL, 12 de setembro de 2026
- Anthropic Threat Report 2026: Every Case Explained, Cyber Kendra, 11 de setembro de 2026