Destilación ilícita de modelos · GTG-16008

Denuncias del informe sobre el uso de datos de entrenamiento por parte de Xiaomi: Caso GTG-16008

Aviso de fuente

Esta página es una traducción del chino al español del contenido de las páginas 151–152 del informe de septiembre de 2026 de Anthropic. Las afirmaciones sobre Xiaomi son denuncias del editor. El informe no concluye que las respuestas de Claude se usaran para atender directamente a los usuarios; esta distinción es clave.

Según un informe de Anthropic, Xiaomi reprodujo conversaciones de usuarios y sesiones de programación de su propio modelo MiMo en Claude, a menudo enrutadas a través de herramientas de programación de terceros. La investigación no mostró que Xiaomi utilizara las respuestas de Claude para atender directamente a sus usuarios; más bien, guardó las conversaciones entre los clientes de Xiaomi y su propio modelo. Muchas sesiones se enrutaron a través de servicios de enrutamiento de terceros comúnmente utilizados por usuarios de EE. UU. y Europa. Este caso difiere del tipo de 'sustitución de respuestas del propio modelo' de los casos de Moonshot / DeepSeek.

Qué sucedió

También descubrimos una actividad de destilación ilícita realizada por Xiaomi. Xiaomi reprodujo conversaciones de usuarios y sesiones de programación de su propio modelo MiMo en Claude, normalmente ejecutándose a través de las herramientas de codificación OpenClaw y OpenCode. Nuestra investigación no mostró que Xiaomi utilizara las respuestas de Claude para atender a sus usuarios; más bien, guardó los intercambios entre los clientes de Xiaomi y su modelo. Muchos de estos intercambios se enrutaron a través de servicios de enrutamiento de modelos de terceros comúnmente utilizados por usuarios de EE. UU. y Europa.

Xiaomi guardó las solicitudes y respuestas completas de sus propios usuarios y reprodujo estas sesiones en Claude para generar datos para el ajuste fino supervisado (SFT) y el aprendizaje por refuerzo (RL). Observamos más de 400.000 solicitudes a Claude enrutadas a través de servicios proxy a más de 1.500 cuentas.

Nuestra investigación sugiere que Xiaomi pudo haber lanzado un período de prueba gratuito —posteriormente extendido— alrededor del lanzamiento de su modelo MiMo-V2-Pro, con la intención de aprovechar el aumento en el uso internacional del modelo por parte de desarrolladores para destilar las capacidades de Claude. La mayoría de los ataques de destilación contra Claude comenzaron justo cuando terminó el período de prueba.

El tráfico reenviado incluía datos sensibles de usuarios que accedían al modelo de Xiaomi a través de plataformas de enrutamiento de modelos de terceros. No tenemos indicios de que se expusieran datos de estadounidenses, pero estas plataformas son comúnmente accedidas por usuarios en EE. UU. y Europa. Estas solicitudes a Claude contenían nombres, información de contacto, datos empresariales y otros datos sensibles de cientos de usuarios de Xiaomi en al menos una docena de idiomas.

La actividad de destilación ilícita de Xiaomi utilizó a Claude para fortalecer los datos de entrenamiento para modelos futuros. Claude se utilizó para reconstruir entornos de desarrollador a partir de registros de intercambios. También convirtió conversaciones de múltiples turnos en intercambios más claros. Claude también se utilizó para generar solicitudes de entrada y respuestas devueltas, imitando conversaciones entre desarrolladores y el modelo. Finalmente, Xiaomi utilizó a Claude para juzgar la calidad de ciertas respuestas.

Escala de los ataques de destilación atribuidos a Xiaomi durante 20 días de marzo a abril de 2026: se observaron más de 400.000 intercambios.

Qué hizo la IA en este caso

Xiaomi reprodujo conversaciones de usuarios en Claude para generar datos de entrenamiento para SFT y RL.

Claude se utilizó para reconstruir entornos de desarrollador, convertir conversaciones de múltiples turnos en intercambios más claros, generar pares solicitud-respuesta y juzgar la calidad de las respuestas.

Qué observó el informe

El informe confirma que Xiaomi reprodujo conversaciones de usuarios en Claude para generar datos de entrenamiento. El informe confirma que no mostró que Xiaomi utilizara las respuestas de Claude para atender directamente a los usuarios.

El informe confirma que muchas sesiones se enrutaron a través de servicios de enrutamiento de terceros comúnmente utilizados por usuarios de EE. UU. y Europa, y que las solicitudes contenían datos sensibles de los usuarios.

El informe confirma más de 400.000 intercambios observados en 20 días de marzo a abril de 2026.

Confirmado y desconocido

Confirmado

  • El informe denuncia que Xiaomi reprodujo conversaciones de usuarios de su propio modelo MiMo en Claude
  • El informe no mostró que Xiaomi utilizara las respuestas de Claude para atender directamente a los usuarios
  • El informe denuncia que muchas sesiones se enrutaron a través de servicios de programación y enrutamiento de modelos de terceros
  • El informe confirma más de 400.000 intercambios observados en 20 días de marzo a abril de 2026

Desconocido

  • El informe no indica si Xiaomi notificó a los usuarios que sus conversaciones se reproducirían en Claude
  • El informe no indica si los datos de entrenamiento generados se utilizaron en el entrenamiento final del modelo MiMo
  • El informe no incluye la respuesta de Xiaomi a estas denuncias

Respuesta de la plataforma

Anthropic afirma que ha prohibido las cuentas relevantes y ha implementado medidas para detectar e interrumpir futuros usos indebidos.

Límites de la respuesta:Prohibir cuentas no puede recuperar las conversaciones de los usuarios que ya han sido guardadas; el informe no indica si Xiaomi ha detenido su comportamiento de reproducción.

Conclusiones

  • Las conversaciones de los usuarios pueden ser reproducidas por los proveedores de modelos a otros modelos para entrenamiento sin que los usuarios lo sepan.
  • Este caso difiere de los casos de reenvío de solicitudes: Xiaomi no utilizó las respuestas de Claude para atender directamente a los usuarios, sino que guardó las conversaciones para entrenamiento.
  • Los servicios de enrutamiento de terceros pueden convertirse en canales de filtración de datos de usuarios.

Fuentes