Modelos de IA

EE.UU. acusa a DeepSeek, Alibaba y otras firmas chinas de destilar modelos de OpenAI y Anthropic

NSA, FBI y CISA acusan a seis firmas chinas de usar distillation a gran escala sobre modelos de OpenAI, Anthropic, Google y xAI. China lo rechaza.

Las autoridades de Estados Unidos han acusado a seis empresas chinas de inteligencia artificial, entre ellas DeepSeek y Alibaba, de utilizar a gran escala una técnica conocida como model distillation sobre modelos avanzados desarrollados por OpenAI, Anthropic, Google y xAI. Las acusaciones aparecen en un informe conjunto publicado por la NSA, el FBI y la CISA y han sido rechazadas por el Gobierno chino.

El documento estadounidense identifica a DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun y. Las agencias sostienen que estas compañías habrían obtenido miles de millones de tokens mediante millones de consultas a modelos estadounidenses desde, al menos, finales de 2024. También afirman que las actividades se habrían producido probablemente con conocimiento del Gobierno chino, una afirmación que Pekín rechaza.

Qué es model distillation y por qué está en el centro de la disputa

La distillation o destilación de modelos es una técnica utilizada en inteligencia artificial para transferir parte del conocimiento o las capacidades de un modelo más potente a otro modelo, normalmente más pequeño o más barato de ejecutar.

De forma simplificada, un modelo avanzado puede actuar como profesor: genera respuestas o datos que después se utilizan para entrenar al modelo alumno. Esto puede reducir la cantidad de computación, tiempo y recursos necesarios para desarrollar determinadas capacidades.

La técnica en sí no es necesariamente problemática. Las propias agencias estadounidenses reconocen en su informe que la destilación es una práctica legítima y útil en investigación de inteligencia artificial. La disputa se centra en cómo se habría obtenido y utilizado la información procedente de modelos comerciales propietarios.

Según la versión de las autoridades estadounidenses, las compañías chinas no se limitaron a aplicar una técnica estándar con modelos propios o datos autorizados, sino que realizaron campañas destinadas a extraer capacidades restringidas de modelos estadounidenses y habrían incumplido las condiciones de uso de los proveedores.

DeepSeek habría utilizado respuestas de Claude, GPT, Gemini y Grok

El informe dedica una atención especial a DeepSeek. Las agencias estadounidenses sostienen que la compañía realizó desde finales de 2024 una campaña organizada para generar datos sintéticos destinados al entrenamiento de sus modelos DeepSeek R1 y V3.

Según el documento, entre los modelos consultados se encontrarían distintas versiones de Claude de Anthropic, GPT de OpenAI, Gemini de Google y Grok de xAI. Las autoridades aseguran que DeepSeek habría tratado de trasladar capacidades relacionadas con razonamiento, tareas especializadas, programación, funciones de agentes y generación de respuestas.

Estas afirmaciones proceden del Gobierno estadounidense y no equivalen a una resolución judicial que haya probado que DeepSeek se apropiara ilegalmente de propiedad intelectual.

Alibaba y Qwen también aparecen en el informe

Alibaba es otra de las grandes compañías señaladas. Las agencias estadounidenses sostienen que la empresa utilizó técnicas de distillation a finales de 2025 con modelos de Anthropic y OpenAI para mejorar diferentes capacidades de sus propios sistemas.

El informe relaciona esas actividades con la familia Qwen de Alibaba y menciona áreas como ingeniería de software, conversaciones de atención al cliente, creación de personajes virtuales, entrenamiento de conjuntos de datos y flujos de trabajo con agentes.

Entre los modelos estadounidenses que las agencias vinculan con esas actividades aparecen variantes de Claude y GPT-5. De nuevo, se trata de acusaciones formuladas por las autoridades de Estados Unidos.

Moonshot AI, MiniMax, StepFun y Z.AI completan la lista

La investigación estadounidense señala además a otras cuatro compañías chinas. Moonshot AI, desarrolladora de los modelos Kimi, habría utilizado datos procedentes de distintos modelos de Claude, GPT, Gemini y Grok para mejorar capacidades de programación, matemáticas y entrenamiento de sus sistemas.

Las agencias sostienen específicamente que datos de modelos de Anthropic y OpenAI habrían sido utilizados durante el desarrollo de modelos como Kimi-K2 y Kimi-K3.

MiniMax aparece vinculada a la mejora de su modelo M2 mediante datos generados por sistemas de Anthropic, Google y OpenAI. El informe menciona razonamiento, desarrollo de software y funciones de agentes entre las áreas supuestamente transferidas.

StepFun, por su parte, habría empleado distintas versiones de Claude y GPT para trabajar sobre las capacidades de programación y agentes de su modelo Step 4. Finalmente, las autoridades estadounidenses afirman que Z.AI utilizó grandes cantidades de datos generados por GPT y Claude para desarrollar capacidades de razonamiento.

Estados Unidos habla de una actividad a escala industrial

La NSA, el FBI y la CISA describen las supuestas operaciones como campañas de distillation a escala industrial. De acuerdo con su evaluación, el objetivo sería reducir los costes económicos y computacionales necesarios para acercar el rendimiento de los modelos chinos al de los sistemas estadounidenses más avanzados.

Las agencias también relacionan la cuestión con la seguridad nacional y sostienen que acelerar el desarrollo de modelos avanzados en China podría tener consecuencias en ámbitos militares y de ciberseguridad. Esa valoración forma parte de la posición oficial estadounidense y no demuestra por sí misma que los modelos citados se hayan utilizado con esos fines.

China rechaza las acusaciones y defiende que la distillation es una técnica neutral

El Ministerio de Comercio de China ha rechazado las conclusiones estadounidenses y afirma que carecen de base factual y jurídica. Pekín acusa además a Washington de aplicar un doble rasero y de interferir en actividades comerciales normales para limitar la competencia de las empresas chinas.

El Gobierno chino sostiene que la destilación es una técnica neutral y ampliamente utilizada dentro de la industria de inteligencia artificial. También afirma que compañías estadounidenses han utilizado modelos chinos en procesos similares.

El Ministerio de Exteriores chino pidió asimismo a Estados Unidos que evite realizar acusaciones que Pekín considera falsas y defendió una mayor cooperación entre ambos países en inteligencia artificial.

La técnica de distillation no es lo que está en discusión

El enfrentamiento no consiste en determinar si la destilación de modelos es una práctica válida. Tanto la industria como las propias agencias estadounidenses reconocen que se utiliza habitualmente para crear sistemas más eficientes.

La cuestión es si las seis compañías señaladas utilizaron de forma no autorizada modelos propietarios y capacidades restringidas para entrenar sus propios sistemas. Estados Unidos sostiene que así ocurrió a gran escala desde finales de 2024, mientras China rechaza esa interpretación y considera las acusaciones parte de las restricciones estadounidenses contra su sector tecnológico.

Por ahora, el informe conjunto de la NSA, el FBI y la CISA constituye una acusación de las autoridades estadounidenses, no una sentencia que establezca como hecho probado una apropiación ilegal de tecnología por parte de DeepSeek, Alibaba o las otras empresas mencionadas.