Hack Alerta

Anthropic acusa empresas chinesas de AI de ataque massivo de "destilação" ao Claude

Anthropic acusa DeepSeek, Moonshot AI e MiniMax de realizar ataques de "destilação" em larga escala para copiar capacidades do modelo Claude. Operação usou 24 mil contas falsas e 16 milhões de interações, contornando bloqueios regionais e levantando preocupações sobre segurança nacional.

A Anthropic, criadora do modelo de IA Claude, acusou publicamente três grandes empresas chinesas de inteligência artificial – DeepSeek, Moonshot AI e MiniMax – de conduzirem campanhas coordenadas de "destilação" em escala industrial para roubar capacidades avançadas de seus sistemas. A empresa afirma que as operações utilizaram mais de 24.000 contas fraudulentas para gerar mais de 16 milhões de interações com o Claude, violando seus termos de serviço e contornando restrições regionais de acesso.

O que é um ataque de destilação

A destilação é uma técnica legítima de treinamento de IA onde um modelo menor ("aluno") aprende com as saídas de um modelo maior ("professor"). No entanto, quando aplicada ilicitamente contra o modelo de um concorrente, ela permite a transferência rápida de capacidades por uma fração do custo e tempo de desenvolvimento original. A Anthropic alerta que cópias "destiladas" do Claude provavelmente não manterão os robustos guardrails de segurança embutidos nos modelos de fronteira dos EUA, projetados para prevenir uso malicioso.

Escala e táticas das campanhas

A empresa detalhou três campanhas distintas:

  • DeepSeek: Mais de 150.000 interações, focando em raciocínio avançado e criação de modelos de recompensa.
  • Moonshot AI (Kimi): Mais de 3,4 milhões de interações, visando raciocínio agentivo, uso de ferramentas e codificação.
  • MiniMax: A maior campanha, com mais de 13 milhões de interações, concentrada em orquestração de codificação agentiva. A Anthropic detectou que, ao lançar um novo modelo, a MiniMax redirecionou quase metade de seu tráfego para o sistema atualizado em menos de 24 horas.

As empresas contornaram a proibição de acesso comercial ao Claude na China utilizando serviços de proxy de terceiros que revendem chamadas de API em larga escala através de redes de contas fraudulentas, chamadas de "clusters hidra".

Implicações para a segurança nacional e competitividade

A Anthropic expressou preocupação de que capacidades de IA destiladas e sem os controles de segurança adequados possam ser integradas em sistemas militares, de inteligência ou de vigilância de governos autoritários, ou mesmo ser open-source, espalhando ferramentas perigosas além do controle de qualquer nação. A empresa está compartilhando indicadores técnicos com outras desenvolvedoras de IA, provedores de nuvem e autoridades, e defendeu os controles de exportação de chips avançados dos EUA como uma medida necessária para limitar tanto o treinamento direto quanto a escala de extração ilícita de dados.

Resposta e colaboração setorial

A revelação ocorre semanas após a OpenAI alertar legisladores dos EUA sobre esforços semelhantes da DeepSeek contra o ChatGPT. A Anthropic afirmou que está investindo pesadamente em novos sistemas de detecção, incluindo classificadores para elicitação de "chain-of-thought" e impressão digital comportamental para identificar atividade coordenada. A empresa enfatizou que nenhuma empresa pode resolver o problema sozinha e pediu ação coordenada em toda a indústria de IA.


Baseado em publicação original de Cyber Security News
Publicado pela Redação Hack Alerta com base em fontes externas citadas e monitoramento editorial do Hack Alerta. Para decisões técnicas, operacionais ou jurídicas, confirme sempre os detalhes na fonte original.