Anthropic diz ter bloqueado tentativas de usar Claude para biarmas e outros fins maliciosos

Empresa afirma que modelos mais potentes aumentam riscos de uso dual e pede salvaguardas coordenadas e relato de incidentes na indústria

Hoje, 13:30

A Anthropic informou nesta quinta-feira que sua equipe de inteligência sobre ameaças identificou e interrompeu tentativas de uso indevido dos modelos Claude em sete áreas de dano: ciberataques, vigilância, campanhas de influência, golpes, trabalhos relacionados a armas convencionais, destilação de modelos e pesquisa biológica.

Publicidade · Cloudways
Hospede na Cloudways com desconto de 30% por 3 meses
Cupom: CODEBR30X3

O relatório descreve cinco estudos de caso em que usuários buscaram assistência que poderia ter apoiado pesquisas sobre armas biológicas, incluindo uma proposta de bolsa sinalizada para realizar trabalho de ganho de função no vírus chikungunya; as contas envolvidas foram banidas.

A empresa afirma que a maioria dos incidentes envolveu versões mais antigas — Opus e Sonnet — ou caminhos via revendedores terceirizados, e que apenas um caso correspondia a uma destilação ilícita ligada a tentativas de replicar capacidades, não aos modelos mais novos Mythos ou Fable.

Em resposta, a Anthropic diz ter compartilhado inteligência com governos e outros laboratórios e reforçado salvaguardas, em especial restringindo consultas biológicas de uso dual no Claude Fable 5 e atualizando detecção e controles de conta.

As divulgações ocorreram após a renúncia pública do pesquisador Jacob Coxon e comentários alarmados de colegas, que intensificaram pedidos de especialistas e de alguns parlamentares por relato obrigatório de incidentes, testes antes do lançamento e maior coordenação setorial.

Resumo produzido a partir de 17 fontes em 16 veículos · Powered by Anchooor
Publicidade · Cloudways
Hospede na Cloudways com desconto de 30% por 3 meses
Ver oferta