Claude expõe tentativas de pesquisadores em usar IA para desenvolver armas biológicas
A Anthropic, empresa por trás do modelo de linguagem Claude, divulgou um relatório detalhado revelando cinco casos em que pesquisadores tentaram contornar as proteções de segurança da plataforma para conduzir pesquisas biológicas com potencial aplicação em armas. O documento de 154 páginas, lançado esta semana, reúne episódios de uso indevido registrados entre dezembro de 2023 e agosto de 2024, abrangendo não apenas pesquisa biológica, mas também espionagem, propaganda coordenada, vigilância e desenvolvimento de armamentos convencionais mediados por inteligência artificial.
Como pesquisadores tentaram explorar o Claude para pesquisa biológica
Os cinco casos identificados demonstram diferentes estratégias sofisticadas para contornar os mecanismos de segurança implementados pela Anthropic. Em um episódio específico, cientistas utilizaram uma plataforma intermediária para burlar restrições geográficas e acessaram o Claude em um projeto financiado pelo governo envolvendo pesquisa de ganho de função com o vírus chikungunya — um trabalho que visa aumentar a infectividade ou patogenicidade de patógenos para fins de compreensão científica, mas que carrega riscos significativos de uso dual.
Outro caso envolveu um pesquisador atuando em região não servida oficialmente pela Anthropic que dedicou semanas explorando o modelo para planejar experimentos relacionados à adaptação do vírus da gripe aviária a mamíferos. Segundo a Anthropic, os controles de segurança conseguiram limitar esse trabalho aos modelos menos capacitados da empresa, reduzindo o risco potencial.
A empresa também identificou pesquisadores aproveitando o Claude para preparar relatórios científicos e manipular compostos com aplicações potencialmente perigosas. Em alguns desses episódios, os usuários deliberadamente mantiveram informações sobre toxinas e proteínas virais em baixa resolução — técnica que reduz a qualidade da imagem digitalmente — para obscurecer a natureza real de seu trabalho.
Importante esclarecer: nenhuma arma foi desenvolvida
Um ponto crítico que a Anthropic enfatiza é que não existe evidência de que esses pesquisadores tinham intenção de fabricar armas biológicas reais. A empresa também decidiu não divulgar os países, instituições ou agentes biológicos específicos envolvidos nesses cinco episódios, priorizando a segurança nacional e a não-proliferação. Essa postura reflete uma decisão deliberada de não amplificar informações que pudessem servir como roadmap para atores maliciosos.
Outros casos de abuso: armamentos, espionagem e propaganda
Embora a pesquisa biológica permaneça envolvida em sigilo, o relatório identifica países específicos em outros tipos de uso indevido. Na categoria de armas convencionais, a Anthropic documentou seis casos: três na China, dois na Rússia e um no Iêmen. Os envolvidos utilizaram o Claude para atividades como desenvolvimento de software e coleta de informações destinadas a programas militares.
Na frente de operações de propaganda, a Anthropic rastreou campanhas coordenadas vinculadas a atores da Rússia, Irã, Turquia, países do Golfo, Sul da Ásia, África e Europa. Uma dessas campanhas produziu pelo menos 8.913 artigos em aproximadamente 20 idiomas, direcionando conteúdo manipulado a públicos em países como Estados Unidos, Brasil, França e República Democrática do Congo. Essa escala industrial de desinformação mediada por IA representa um salto qualitativo em relação às operações manuais.
No âmbito de espionagem digital, a Anthropic atribuiu uma campanha contra autoridades, militares e diplomatas ucranianos a um grupo cujo comportamento é compatível com o Midnight Blizzard — entidade que agências de inteligência dos EUA já associaram ao Serviço Federal de Segurança da Rússia (FSB).
Medidas tomadas pela Anthropic
A empresa confirmou que desativou todas as contas relacionadas aos casos documentados e utilizou as informações coletadas para reforçar os mecanismos de segurança de seus modelos. O relatório reconhece uma mudança estrutural importante: modelos atuais conseguem auxiliar em tarefas científicas complexas que versões anteriores não alcançavam com o mesmo nível de sofisticação.
Adicionalmente, a Anthropic implementou proteções mais rigorosas em modelos recentes, particularmente para consultas relacionadas a pesquisas biológicas de uso dual — pesquisas cuja natureza permite tanto aplicações benéficas quanto malévolas. A empresa também defende uma abordagem de concessão seletiva de acesso: sistemas de IA avançada deveriam ser disponibilizados apenas por meio de programas com usuários confiáveis quando o risco de abuso for elevado.
O contexto mais amplo de segurança em IA
Este relatório evidencia um dilema crescente na indústria de inteligência artificial: quanto mais poderosos os modelos se tornam, mais capazes são de auxiliar em tarefas legítimas de pesquisa — mas também em empreendimentos prejudiciais. A Anthropic optou por transparência parcial: divulgar suficientemente para alertar a comunidade de segurança, mas reter informações que pudessem servir como manual operacional.
A decisão de publicar o relatório reflete pressão regulatória internacional e demandas de transparência de órgãos governamentais. Governos como o do Reino Unido e agências como o Instituto Nacional de Padrões e Tecnologia (NIST) dos EUA têm pressionado empresas de IA para disclosure estruturado de incidentes de segurança.
Fontes:
Claude é acusado de ajudar pesquisadores em tentativa de criar armas biológicas – CanalTech
ALT_IMAGEM: Ilustração representando segurança em inteligência artificial e prevenção de abuso de modelos de linguagem para fins prejudiciais
