A Anthropic, empresa especializada em inteligência artificial, relatou nesta semana persistentes campanhas de distilação de modelos de IA por parte de empresas chinesas, que têm se intensificado nos últimos meses.

Campanhas de distilação

A Anthropic identificou campanhas que alvoaram algumas das suas capacidades mais valiosas, incluindo habilidades agênticas, uso de ferramentas, codificação e análise de dados, além de raciocínio lógico.

As campanhas observadas pela Anthropic envolveram cerca de 200 milhões de interações relacionadas a ataques de distilação, atribuídas a cinco campanhas separadas. A empresa também descobriu técnicas usadas por atacantes para enganar os modelos de IA e revelar seus processos internos.

Casos específicos

Um caso notável envolveu uma tentativa de distilação que usou uma tradução como fachada para obter informações internas do modelo. Outra campanha, atribuída à Alibaba, foi a maior observada pela Anthropic, com cerca de 151 milhões de interações entre maio e julho de 2026.

A Anthropic também relatou uma campanha da Moonshot AI, fabricante do modelo Kimi, que parece ter sido usada pelo exército chinês. Uma solicitação feita ao Claude, um dos modelos da Anthropic, pediu a avaliação de imagens de vigilância para determinar comportamento anormal.