Anthropic acusó a siete laboratorios chinos de usar millones de respuestas de Claude para entrenar sus modelos

La compañía señaló a empresas como Alibaba, Moonshot y DeepSeek por presuntas prácticas de destilación no autorizada. El informe también reveló el nivel de supervisión que Anthropic mantiene sobre la actividad dentro de su plataforma.

Viernes, 11 de septiembre de 2026 a las 09 25

Por Redacción

Viernes, 11 de septiembre de 2026 a las 09:25


Un informe de seguridad de Anthropic acusó a siete laboratorios chinos de inteligencia artificial de recolectar respuestas de Claude para mejorar sus propios modelos. La actividad más extensa correspondió a Alibaba, desarrolladora de Qwen, con unos 151 millones de intercambios detectados. La empresa estadounidense aseguró que también identificó operaciones atribuidas a Moonshot AI, responsable de Kimi, y a DeepSeek.

Según Anthropic, algunas compañías recurrieron a servicios intermediarios ubicados fuera de China para superar las restricciones geográficas de Claude. Esas plataformas, denominadas transfer stations, recibían las consultas realizadas por los usuarios y las reenviaban al modelo estadounidense. Las respuestas regresaban luego a las aplicaciones chinas, donde aparecían como si hubieran sido elaboradas por sus propios sistemas.

Millones de consultas redirigidas sin aviso

El reporte atribuyó a Moonshot AI más de 23 millones de consultas enviadas a Claude entre mayo y julio. En el caso de DeepSeek, la cifra habría alcanzado los 12,1 millones de intercambios en apenas dos semanas. Los usuarios no recibían información sobre esa intermediación y podían creer que mantenían una conversación directa con Kimi o DeepSeek, cuando parte del contenido procedía del sistema desarrollado por Anthropic.

La maniobra estaría relacionada con la destilación de modelos, una técnica mediante la cual las respuestas de un sistema avanzado se utilizan para enseñar y optimizar otro. Este método forma parte de los procedimientos habituales de entrenamiento, pero genera cuestionamientos cuando se aplica sobre modelos cerrados sin autorización. Anthropic sostuvo que Alibaba incluso buscaba obtener rastros del razonamiento de Claude para incorporarlos a Qwen, aunque los datos no demostraban que los modelos chinos fueran copias directas ni explicaban por sí solos su rápida evolución.

El control de Anthropic sobre el uso de Claude

La detección de estas operaciones dejó expuesta la capacidad de Anthropic para observar metadatos, conductas inusuales y patrones de utilización dentro de su servicio. Su equipo de seguridad desarrolló herramientas para reconocer campañas de destilación y afirmó que bloqueó 11,4 millones de cuentas durante la primera mitad de 2026. Ese alcance no implica necesariamente una lectura individual de todas las conversaciones, pero confirma que la compañía conserva una amplia visibilidad sobre el funcionamiento de la plataforma.

Anthropic ya había recibido críticas por implementar mecanismos que buscaban zonas horarias chinas, servidores proxy y dominios vinculados con empresas tecnológicas de ese país. La compañía retiró esos controles después de que un investigador revelara su existencia. El caso volvió a plantear una tensión central para la industria: las empresas necesitan prevenir usos abusivos de sus modelos, pero esas tareas de vigilancia también abren interrogantes sobre la privacidad de los usuarios y el poder de las plataformas para evaluar sus conversaciones.

 

Últimas noticias