top of page
FMPT_CDMW_FIRST_TRAVEL_WEB_BILLBOARD_1.jpg

Guerra en la inteligencia artificial: Gigantes tech acusan a DeepSeek de "destilar" y robar sus modelos

  • hace 13 minutos
  • 3 min de lectura
Open AI y referentes de la industria señalan a la firma china por extraer masivamente capacidades de razonamiento mediante millones de consultas automatizadas para abaratar sus costos de desarrollo.

Por Pablo Gabriel Santillán Torres Torija / Imagen IA


SILICON VALLEY / SAN FRANCISCO — La irrupción de la empresa china DeepSeek en el panorama internacional de la inteligencia artificial no solo provocó sacudidas en los mercados bursátiles, sino que desencadenó un conflicto de propiedad intelectual de escala global. OpenAI (creadora de ChatGPT), respaldada por gigantes como Microsoft y secundada por las preocupaciones del sector, ha presentado acusaciones formales e informes técnicos sosteniendo que el modelo chino se construyó "destilando" indebidamente las capacidades de sus sistemas propietarios.


El centro de la polémica: La "destilación" de datos

La acusación principal no gira en torno al filtrado de código fuente, sino a una técnica de aprendizaje automático conocida como destilación de modelos (model distillation).

En el entrenamiento tradicional, un modelo de frontera (como GPT-4 u o1) requiere miles de millones de dólares en infraestructura y computación. Sin embargo, mediante la destilación, un modelo "estudiante" (DeepSeek) realiza millones de preguntas automatizadas a un modelo "maestro" (ChatGPT) y utiliza esas respuestas de alto nivel —especialmente las secuencias de razonamiento paso a paso (chain-of-thought)— para entrenarse a una fracción del costo original.

"DeepSeek redujo drásticamente sus costos de desarrollo no solo por eficiencia técnica, sino aprovechando el trabajo pesado de investigación y desarrollo financiado por empresas estadounidenses", argumentan analistas del sector citados en reportes hacia el Congreso de EE. UU.


Redes fantasma y elusión de restricciones

Según las investigaciones internas expuestas por OpenAI y firmas de ciberseguridad asociadas:

  • Ecosistema de cuentas falsas: Se habrían detectado miles de cuentas intermediarias y accesos masivos a través de API diseñados para cosechar datos de manera sistemática.

  • Uso de routers de terceros: Para esquivar los bloqueos geográficos y los límites de consumo impuestos a usuarios en China, se emplearon redes privadas e intermediarios no autorizados, disfrazando el tráfico de extracción masiva.

  • Coincidencia sintáctica: Informes técnicos señalan que el estilo de respuesta, patrones de razonamiento y estructura léxica de los modelos de DeepSeek muestran coincidencias de más del 70% con las salidas de ChatGPT.


Meta y otros actores del ecosistema de código abierto (open source) también han mostrado cautela frente a estas prácticas, advirtiendo que el uso no autorizado de outputs sintéticos para crear competidores comerciales directos quiebra los Términos de Servicio de las plataformas occidentales.



La paradoja del derecho de autor y la respuesta de DeepSeek

El conflicto ha abierto un acalorado debate ético y legal en Silicon Valley:

  1. La paradoja del Fair Use: Críticos y analistas legales recuerdan que empresas como OpenAI construyeron sus propios modelos recopilando masivamente información con derechos de autor de todo Internet (libros, artículos periodísticos y sitios web) bajo la doctrina del "uso justo" (fair use). Que ahora acusen a un tercero de "copiar sus respuestas" genera acusaciones de doble moral en la comunidad desarrolladora.

  2. El vacío legal de las IAs: Bajo la legislación internacional actual, los textos y respuestas generados de forma autómata por una IA no gozan de protección estricta por derechos de autor, lo que complica sostener una demanda tradicional por "robo de propiedad intelectual".

  3. La postura de DeepSeek: La compañía asiática defiende que sus avances se deben a innovaciones genuinas en arquitectura de modelos (como el uso eficiente de Mixture-of-Experts y optimización de memoria en GPUs) y sostiene que la destilación es una práctica de investigación estándar y legítima en las ciencias de la computación.


Un impacto geopolítico y regulatorio

El diferendo trascendió lo empresarial para convertirse en un expediente de seguridad nacional en Estados Unidos. Comités legislativos y reguladores evalúan restringir aún más el acceso a las API occidentales desde territorio chino y endurecer las licencias comerciales para el uso de datos sintéticos, fijando un precedente crucial sobre quién es el dueño real del conocimiento generado por los algoritmos.


Comentarios


Disfruta

Descubre

Ecard cuadrada.jpg
Carencias de las cuatro transformaciones / Y tú, ¿cómo lo dirías?
01:41
Trump, el buleador del barrio / Tan Lejos, Tan Cerca
07:20
2025, año de amplias expectativas/ Tan Lejos, Tan Cerca
03:32
Se engancha Sheinbaum con Trump / Para la historia inmediata
06:19
América dividida y organismos internacionales en crisis
05:51
G20, espacio multilateral / Tan Lejos, Tan Cerca
06:50
Toda crisis es una oportunidad / Tan Lejos, Tan Cerca
06:24
Entre los zurdos de mierda y la derecha asesina / Tan Lejos, Tan Cerca
06:50
bottom of page