Anthropic Detecta Uso Indebido de Claude por Laboratorios Chinos para Entrenamiento de IA

Abstract representation of artificial intelligence networks and data flow, with subtle Chinese motifs integrated into the digital structure.

Anthropic ha publicado un informe detallado sobre inteligencia de amenazas que pone de manifiesto prácticas cuestionables por parte de varios laboratorios de inteligencia artificial en China. Entre las revelaciones, destaca una operación significativa donde siete laboratorios chinos habrían logrado recolectar datos sobre el funcionamiento de su modelo Claude a través de un proceso conocido como destilación.

La compañía Alibaba, con su modelo Qwen, se identifica como uno de los principales actores, registrando 151 millones de intercambios de peticiones. Sin embargo, Moonshot (con su modelo Kimi) y DeepSeek habrían adoptado una estrategia aún más llamativa: redirigir las consultas de sus propios usuarios a Claude sin su conocimiento.

El Mecanismo de la Destilación de Modelos

La destilación de modelos de IA es una técnica legítima en la industria, utilizada internamente por las empresas para mejorar y entrenar sus propios sistemas. Consiste en emplear las respuestas de un modelo avanzado para 'enseñar' a otro. El problema surge, según Anthropic, cuando esta práctica se aplica de forma encubierta para extraer información de modelos cerrados, como Claude.

Alibaba, en particular, habría intentado no solo obtener las respuestas sino también el razonamiento subyacente de Claude para enriquecer el entrenamiento de Qwen. Si bien esto no implica que los modelos chinos sean copias directas de Claude, sí plantea interrogantes sobre la rapidez de su avance.

Operaciones Encubiertas y Supervisión de Anthropic

Los datos recopilados por Anthropic sugieren que Moonshot podría haber realizado esta operación encubierta más de 23 millones de veces entre mayo y julio, mientras que DeepSeek habría efectuado 12,1 millones de intentos en solo dos semanas. Los usuarios de Kimi, sin saberlo, interactuaban con Claude.

Para detectar estas anomalías, Anthropic ha desarrollado sistemas de detección avanzados que monitorizan el uso de su plataforma. Estos sistemas identifican patrones anómalos y metadatos que podrían indicar campañas de destilación. La compañía afirma haber bloqueado 11,4 millones de cuentas solo en la primera mitad de 2026, evidenciando una profunda visibilidad sobre la actividad dentro de su ecosistema.

Controversias y el Rol de Control de Claude

Esta no es la primera vez que surgen polémicas. En marzo, Anthropic implementó un mecanismo para detectar indicios de actividad de destilación, como zonas horarias chinas o el uso de proxies, que fue retirado tras ser descubierto. La medida generó críticas por lo que algunos percibieron como una vigilancia excesiva.

La capacidad de Anthropic para monitorizar el uso y establecer políticas —como la prohibición de diseñar armas biológicas— la posiciona no solo como un proveedor de modelos de IA, sino también como un ente que regula la conversación. Este rol de 'juez y jurado' en la interacción con la IA plantea un dilema sobre el control del discurso y la legitimidad de las aplicaciones.

Fuente: Ver artículo original