Destilación de modelos y extracción no autorizada: separar técnica, afirmaciones y juicio legal
Definición
Técnicamente, la destilación consiste en utilizar las salidas de un modelo para entrenar o mejorar otro modelo. Puede ser una colaboración autorizada y contractual.
Este tema trata sobre las afirmaciones del informe de acceso no autorizado, reenvío de solicitudes de usuarios al modelo de otra parte, extracción de cadenas de razonamiento o compra de textos de conversación. Estas son atribuciones del editor, no hallazgos de ilegalidad de este sitio.
No confundir con
No significa que toda la destilación sea ilegal, ni que «robar un modelo» pueda usarse como titular para cada empresa mencionada.
No significa que las acusaciones de cada sección puedan fusionarse: la sección de Xiaomi no concluye explícitamente que las respuestas de Claude se usaran para atender directamente a los usuarios.
No es un lugar donde demostremos cómo extraer trazas de razonamiento.
Ilustración original del informe: el diagrama conceptual al inicio del capítulo de destilación. Las empresas concretas se rigen por cada caso; una sola figura no puede fusionar todas las afirmaciones. El texto de la imagen está en inglés original.
Funciones de la IA
En estas afirmaciones, Claude es principalmente el objeto al que se consulta o del que se extrae. Las disputas se centran en la autorización, la transparencia y el origen de los datos de entrenamiento.
El riesgo para el usuario es: no saber de qué modelo proviene la respuesta ni a dónde va la conversación.
Según el informe de Anthropic, DeepSeek también desplegó una estrategia similar a la de Moonshot: construir un conducto de extracción de CoT, utilizar el mismo ataque de reproducción entre sesiones para extraer los registros de cadena de pensamiento de Claude y reenviar silenciosamente las conversaciones a Claude sin notificar a los clientes. El informe también afirma que DeepSeek enrutó las solicitudes de los usuarios de herramientas de codificación de terceros a Claude Opus, incluidos datos sensibles de empresas tecnológicas chinas, agencias de defensa rusas y sistemas de vigilancia de seguridad pública chinos. Todo lo anterior son acusaciones del editor, no hallazgos independientes de este sitio.
Según el informe de Anthropic, Moonshot (el desarrollador de los modelos Kimi) reenvió silenciosamente las solicitudes de los clientes a Claude y luego mostró las respuestas de Claude a los usuarios, que pensaban que estaban usando Kimi. En un período de diez días, se reenviaron casi 300.000 solicitudes de clientes, la gran mayoría a Opus; la red de proxy tenía 5.380 cuentas falsas. El informe no confirmó si los usuarios lo sabían. Todo lo anterior son acusaciones del editor, no hallazgos independientes de este sitio, ni una conclusión judicial.
Según el informe de Anthropic de septiembre de 2026, se alega que un operador vinculado a Alibaba lanzó el mayor ataque de destilación que el informe ha medido, dirigido a los registros de razonamiento de cadena de pensamiento de Claude Opus 4.6 y 4.7. El informe afirma que los datos se utilizaron para entrenar la serie de modelos Qwen. Toda la atribución y las cifras provienen de las acusaciones unilaterales del informe; las empresas involucradas no las han confirmado en este sitio.
Según el informe de Anthropic, Zhipu (marca extranjera Z.ai) ejecutó una canalización de extracción de cadena de pensamiento contra Claude, reproduciendo las trazas de razonamiento capturadas de Claude de nuevo en Claude para su limpieza, con el fin de entrenar su modelo GLM. El informe afirma que en 10 días Zhipu ejecutó la canalización de extracción contra Opus 4.8 a través de 273 cuentas fraudulentas, registrando 770.000 conversaciones. El informe también afirma que Zhipu se dirigió a las capacidades de ciberseguridad de los principales modelos fronterizos de EE. UU. para su destilación. Todo lo anterior son denuncias del editor, no verificadas de forma independiente por este sitio.
Según un informe de Anthropic, Xiaomi reprodujo conversaciones de usuarios y sesiones de programación de su propio modelo MiMo en Claude, a menudo enrutadas a través de herramientas de programación de terceros. La investigación no mostró que Xiaomi utilizara las respuestas de Claude para atender directamente a sus usuarios; más bien, guardó las conversaciones entre los clientes de Xiaomi y su propio modelo. Muchas sesiones se enrutaron a través de servicios de enrutamiento de terceros comúnmente utilizados por usuarios de EE. UU. y Europa. Este caso difiere del tipo de 'sustitución de respuestas del propio modelo' de los casos de Moonshot / DeepSeek.
Según un informe de Anthropic, la proliferación de servicios proxy ha creado un mercado secundario a través del cual los laboratorios pueden comprar u obtener registros de los intercambios de los usuarios con Claude. El pipeline de destilación de SenseTime incluía registros de intercambios de usuarios con Claude comprados a proveedores de datos de terceros. MiniMax construyó un servicio de red proxy a través de empresas pantalla que solo proporcionaba acceso a los modelos de Anthropic y OpenAI, no a ningún modelo chino, lo que sugiere que su propósito era recopilar los intercambios de los usuarios con los modelos fronterizos de EE. UU. para entrenar su propio modelo. Todo lo anterior son denuncias del editor y no han sido verificadas de forma independiente por este sitio.
Límites de la respuesta
Todas son afirmaciones de un único editor, en un contexto de competencia comercial.
Los juicios de las normas de la plataforma no pueden elevarse automáticamente a conclusiones judiciales.
No. La destilación es una técnica; si está autorizada, de dónde provienen los datos y si los usuarios lo saben son las preguntas que deben juzgarse por separado.
¿Todas las empresas mencionadas hicieron lo mismo?
No. Las afirmaciones concretas del informe difieren para cada empresa y deben leerse caso por caso, no fusionarse en una sola acusación general.