lunes, 3 de agosto de 2026

IA y modelos

Funcionario de EE. UU. dice que Kimi K3 copió a Fable; investigadores lo dudan

Michael Kratsios, asesor científico de la Casa Blanca, acusó a Moonshot de destilar de forma encubierta el modelo Fable de Anthropic para construir Kimi K3 usando chips con restricciones de exportación, pero investigadores de IA consideran esa explicación poco probable.

The word Anthropic in a clean modern black sans-serif font against a light background.
Foto: Anthropic

Kratsios escribió que “la destilación industrial encubierta y a gran escala, orientada a robar tecnología propietaria estadounidense y socavar la investigación estadounidense, es inaceptable”, en medio de conversaciones reportadas sobre prohibir los modelos chinos de peso abierto. No compartió detalles sobre el origen de sus acusaciones, y Moonshot no respondió a preguntas sobre su proceso de entrenamiento. El secretario del Tesoro, Scott Bessent, respaldó la acusación al decir que los reguladores están encontrando marcas de agua de modelos de lenguaje estadounidenses en muchos modelos chinos, aunque no está claro en qué consisten esas marcas de agua, y el Departamento del Tesoro no respondió a una consulta.

Los investigadores de IA dudan que la destilación —el proceso de consultar un modelo para copiar sus capacidades— explique la fortaleza de Kimi K3. Braden Hancock, investigador del Laude Institute y cofundador de Snorkel AI, dijo que un modelo tan potente no podría surgir solo de destilación tan poco tiempo después del lanzamiento de Fable, ya que Fable solo está disponible públicamente desde el 1 de julio y no habría tiempo para destilar suficientes datos, entrenar un modelo y lanzarlo en dos semanas. Nathan Lambert, investigador de IA en el Allen Institute for AI, dijo que la destilación es cada vez menos determinante a medida que los modelos chinos se acercan a la frontera y el entrenamiento se desplaza hacia el aprendizaje por refuerzo, una técnica más costosa: las ejecuciones grandes de aprendizaje por refuerzo pueden requerir decenas de millones de agentes, y correr ese volumen a través de la API de un laboratorio de frontera resultaría prohibitivamente costoso y posiblemente demasiado lento para explicar el rápido desarrollo de Kimi K3.

La acusación se suma a la que hizo Anthropic a principios de este año, cuando afirmó que Moonshot, DeepSeek y MiniMax destilaron sistemáticamente sus modelos, con base en millones de interacciones que rastreó mediante direcciones IP y otros metadatos, lo cual —según dijo— apuntaba a intentos deliberados de extraer las capacidades de sus modelos en lugar de un uso normal. La destilación es común en toda la industria: Elon Musk testificó que su empresa SpaceXAI destiló modelos de OpenAI para construir Grok, y calificó la práctica de común, y la línea entre destilación y la creación de conjuntos de datos sintéticos puede resultar difusa.

Kratsios también acusó a Moonshot de haber obtenido chips Nvidia Grace Blackwell 300, restringidos para exportación, y de haber accedido a servidores equipados con GB300 en Tailandia. Sam Bresnick, investigador del Centro de Seguridad y Tecnología Emergente de Georgetown, dijo que existe un mercado negro para esos chips y pidió reglas de “conozca a su cliente” para los centros de datos, señalando que los exportadores ya deben asegurarse de que los chips que envían al extranjero se destinen únicamente a usos aprobados. En mayo, el fundador de Supermicro, una empresa estadounidense de servidores, fue acusado de contrabandear chips avanzados hacia China. El Departamento de Comercio de la administración Biden propuso reglas federales de “conozca a su cliente” para centros de datos en 2024, pero no parece haberse avanzado más desde entonces.

Por qué importa

La disputa muestra lo difícil que es probar cómo se construyó realmente un modelo de frontera, y cómo las acusaciones de robo de propiedad intelectual se están entrelazando con la aplicación de controles de exportación de chips dentro de la competencia más amplia entre EE. UU. y China en IA.