Con todos los avances que se estaban produciendo en el sector de la inteligencia artificial en los Estados Unidos, parecía que este país no tenía rival, pero recientemente ha llegado DeepSeek para dar un vuelco a este mercado y para despertar las alarmas de los inversores.
Hace poco estábamos hablando del modelo o3 de OpenAI y de cómo tenía a todo el sector tecnológico pendiente de esta nueva IA y de las cosas increíbles que era capaz de hacer.
Sin embargo, en poco tiempo hemos visto como otro modelo de inteligencia artificial generativa de fuera de Estados Unidos ha llegado para hacer competencia a los gigantes norteamericanos y se ha hecho rápidamente un hueco en el mercado.
Por supuesto, estamos hablando de DeepSeek, que ya ha pasado a la historia porque ha superado en descargas a ChatGPT, quizás por la novedad, pero seguramente porque todo el mundo está recomendándolo, por todas sus características que vamos a analizar en este artículo.
¿Qué es DeepSeek?
El lanzamiento de DeepSeek ha irrumpido con tanta fuerza que ha capturado la atención de la comunidad tecnológica global, ya que este modelo de IA, desarrollado por una startup china del mismo nombre, logró en muy poco tiempo posicionarse como una alternativa de alto rendimiento frente a gigantes como OpenAI, Google y Meta.
De hecho, como también vamos a analizar, su aparición no solo ha generado un impacto técnico, sino también económico y geopolítico, cuestionando la hegemonía estadounidense en este sector.
DeepSeek es un modelo de lenguaje de gran escala para tareas de razonamiento complejo, resolución de problemas matemáticos, programación y procesamiento de lenguaje natural.
Lo que lo hace particularmente interesante es su arquitectura Mixture of Experts (MoE), que permite activar solo una fracción de sus parámetros para cada tarea, una técnica que reduce los costes computacionales y que optimiza el rendimiento.
De esta forma, este acontecimiento es ya un hito en la competencia tecnológica entre China y Estados Unidos, ya que incluso a pesar de las restricciones que ha puesto Estados Unidos a la exportación de chips avanzados a China, DeepSeek ha desarrollado un modelo competitivo utilizando hardware de menor capacidad.
¿DeepSeek es de código abierto?
La cuestión de si DeepSeek es de código abierto es muy interesante con respecto a cómo se utilizará en el sector tecnológico, pero también está dando mucho de que hablar por la IA ética y con respecto a la filosofía del desarrollo de la inteligencia artificial y la democratización de la tecnología.
A pesar de que China es la sede principal del desarrollo de DeepSeek como modelo de inteligencia artificial, lo más sorprendente quizás es su naturaleza abierta, una característica que desde luego lo distingue frente a otros modelos como los de OpenAI o Google, que son cerrados.
De hecho, la realidad es que DeepSeek es una herramienta de código abierto bajo la licencia MIT, lo que significa que cualquier persona puede descargar, modificar y distribuir su código sin grandes restricciones.
Incluso, se puede utilizar de forma local si se tiene una computadora lo suficientemente potente para ello, algo que por supuesto, es tremendamente útil para automatizar tareas empresariales con IA.
Este aspecto es fundamental, ya que rompe con el paradigma tradicional de los modelos de inteligencia artificial, que suelen estar protegidos por licencias cerradas y tener bastantes restricciones de uso.
Por eso, el carácter abierto de DeepSeek ha generado una verdadera revolución en la comunidad de desarrolladores, puesto que al compartir abiertamente los detalles técnicos de su entrenamiento y su arquitectura, ha reducido las barreras de entrada para aquellos que desean innovar en el campo de la inteligencia artificial.
No obstante, no es oro todo lo que reluce, y aunque DeepSeek ofrece un acceso sin restricciones a su tecnología, también está sujeto a las regulaciones del gobierno chino, lo que limita su capacidad para abordar ciertos temas sensibles, como cuestiones políticas o históricas controvertidas.
¿Cuánto ha costado el desarrollo de este modelo de inteligencia artificial chino?
El desarrollo de modelos de inteligencia artificial a gran escala, como los que ha producido DeepSeek, representa uno de los esfuerzos tecnológicos más complejos y costosos de la actualidad.
Sin embargo, lo que distingue a DeepSeek de otros proyectos similares es su capacidad para alcanzar resultados comparables a los de gigantes como OpenAI o Meta, pero con un presupuesto notablemente inferior.
De hecho, es precisamente este fenómeno el que ha generado un intenso debate en la comunidad tecnológica, especialmente en torno a cómo una startup china ha logrado optimizar sus recursos para competir en un campo dominado por empresas con presupuestos astronómicos.
DeepSeek, ha demostrado que el costo no siempre es proporcional al rendimiento, ya que según informes recientes, el desarrollo de su modelo más avanzado, DeepSeek-V3, requirió una inversión de aproximadamente 5,58 millones de dólares, una cifra que por supuesto contrasta drásticamente con los 100 millones de dólares que OpenAI invirtió en GPT-4.
Pero eso no es todo, la diferencia es aún más notable si se considera que DeepSeek-V3, con sus 671 mil millones de parámetros, ha igualado e incluso superado en ciertos ‘benchmarks’ a modelos como GPT-4o y Claude 3.5 Sonnet.
Además, mientras que OpenAI cobra 15 dólares por millón de tokens de entrada y 60 dólares por millón de tokens de salida para su modelo o1, DeepSeek ofrece su API por 0,55 dólares y 2,19 dólares, respectivamente.
Por supuesto, el bajo coste de DeepSeek no se debe únicamente a la optimización técnica, o más bien se ha conseguido gracias a la adopción de un modelo de negocio basado en el código abierto, lo que ha hecho que los desarrolladores y los investigadores de todo el mundo quieran contribuir a la mejora de sus modelos.
¿Qué potencia tiene esta IA de código abierto hecha en China? ¿Puede competir con los modelos más avanzados de OpenAI?
Para poder competir con los grandes del sector, DeepSeek ha implementado técnicas innovadoras como la ‘atención multicabezal latente’ y la ‘predicción multitoken’, que refuerzan su capacidad para manejar tareas complejas con mayor precisión.
En cuanto a su rendimiento, DeepSeek-V3 ha demostrado resultados comparables a los de GPT-4o en las pruebas de ‘Massive Multitask Language Understanding’, donde alcanzó un 88,5% de precisión, y ‘HumanEval’, con un 82,6% en tareas de generación de código.
Además, aunque está ligeramente por debajo de GPT-4o en algunas métricas, DeepSeek supera a modelos como Claude 3.5 Sonnet en tareas de razonamiento matemático y lógico, como lo demuestra su puntuación del 61,6% en ‘MATH’.
El método de entrenamiento de un modelo de inteligencia artificial también está actualmente en debate, puesto que DeepSeek-R1, a diferencia de los métodos tradicionales que dependen de datos etiquetados y de supervisión humana, se entrenó exclusivamente mediante ‘RL’, lo que le permitió desarrollar capacidades de razonamiento avanzadas sin necesidad de intervención humana directa.
De hecho, aunque parezca increíble, este modelo genera cadenas de pensamiento estructuradas y es capaz de autocorregirse y validar sus propias respuestas, un comportamiento que surgió de manera natural durante su propio entrenamiento y es una completa revolución para el futuro de la IA.
¿Por qué ha producido DeepSeek un caída de la bolsa en Estados Unidos?
El lanzamiento de DeepSeek y su rápida adopción ha creado un lunes negro en las bolsas tecnológicas de los Estados unidos, donde uno de los sectores más afectados ha sido el de los fabricantes de chips, liderado por ‘Nvidia’.
Las acciones de ‘Nvidia’ cayeron un 17% en un solo día, la cual es la mayor caída intradía en la historia de la compañía, un desplome que se debe a la preocupación de los inversores sobre la posible disminución de la demanda de chips de alta gama, ya que DeepSeek ha demostrado que es posible lograr un rendimiento competitivo con hardware menos costoso.
Pero el efecto dominó también afectó a otras empresas tecnológicas como ‘Meta’, ‘Alphabet’ y ‘Broadcom’ que también han tenido fuertes caídas en el valor de sus acciones, reflejando el temor de los inversores a que el modelo de negocio de estas compañías pueda verse cuestionado por la eficiencia y el bajo coste de DeepSeek.
Por eso, la pregunta que ahora mismo todo el mundo se está haciendo en este mercado es: ¿Está sobrevalorado el mercado estadounidense de la IA? Algo que si llega a ser cierto, supondrá grandes pérdidas para muchos inversores y también reducirá la confianza en la capacidad de estas empresas tecnológicas para ser las pioneras en el desarrollo futuro de la IA.
En cualquier caso, lo que si está claro es que la inteligencia artificial ha llegado para quedarse, y que los profesionales y las empresas que se formen para ser los futuros directores de IA serán las que tendrán más oportunidades en el mercado.
