Anthropic diz ter bloqueado tentativas de usar Claude para biarmas e outros fins maliciosos
Empresa afirma que modelos mais potentes aumentam riscos de uso dual e pede salvaguardas coordenadas e relato de incidentes na indústria
A Anthropic informou nesta quinta-feira que sua equipe de inteligência sobre ameaças identificou e interrompeu tentativas de uso indevido dos modelos Claude em sete áreas de dano: ciberataques, vigilância, campanhas de influência, golpes, trabalhos relacionados a armas convencionais, destilação de modelos e pesquisa biológica.
O relatório descreve cinco estudos de caso em que usuários buscaram assistência que poderia ter apoiado pesquisas sobre armas biológicas, incluindo uma proposta de bolsa sinalizada para realizar trabalho de ganho de função no vírus chikungunya; as contas envolvidas foram banidas.
A empresa afirma que a maioria dos incidentes envolveu versões mais antigas — Opus e Sonnet — ou caminhos via revendedores terceirizados, e que apenas um caso correspondia a uma destilação ilícita ligada a tentativas de replicar capacidades, não aos modelos mais novos Mythos ou Fable.
Em resposta, a Anthropic diz ter compartilhado inteligência com governos e outros laboratórios e reforçado salvaguardas, em especial restringindo consultas biológicas de uso dual no Claude Fable 5 e atualizando detecção e controles de conta.
As divulgações ocorreram após a renúncia pública do pesquisador Jacob Coxon e comentários alarmados de colegas, que intensificaram pedidos de especialistas e de alguns parlamentares por relato obrigatório de incidentes, testes antes do lançamento e maior coordenação setorial.