Startup china DeepSeek revoluciona la IA: compite con OpenAI y Meta con inversión de $6M
Startup china DeepSeek revoluciona la IA: compite con OpenAI y Meta con inversión de $6M

DeepSeek, la startup china de IA que compite con OpenAI y Meta invirtiendo solo $6M

La carrera por dominar la inteligencia artificial (IA) se ha intensificado, convirtiéndose en campo de batalla donde gigantes tecnológicos estadounidenses y emergentes empresas chinas se enfrentan en una lucha por la supremacía. Este pulso no se define únicamente por el volumen de inversión, sino también, y quizás de manera más crucial, por la eficiencia y la innovación. Mientras compañías como OpenAI y Meta invierten miles de millones de dólares, nuevas empresas, como DeepSeek, demuestran que la innovación disruptiva puede lograrse con recursos significativamente menores, desafiando los modelos tradicionales de desarrollo de IA y planteando interrogantes sobre la verdadera eficiencia de las estrategias de inversión masivas.

Esto queda claro en el actual panorama del sector, que revela una competencia feroz. En Estados Unidos, grandes jugadores como Google, Microsoft, xAI (la empresa de Elon Musk), Meta, OpenAI y Anthropic lideran el desarrollo de modelos de lenguaje grande (LLM) y otras tecnologías de IA. Estas compañías compiten agresivamente por talento, datos y recursos para mantener su posición de vanguardia. Sin embargo, del otro lado del Pacífico, China se presenta como un competidor cada vez más formidable. Empresas como Baidu, con su modelo Ernie, Alibaba, y la relativamente nueva, pero ya impactante DeepSeek, están demostrando una capacidad notable para desarrollar modelos de IA de alto rendimiento con estrategias radicalmente distintas.

La irrupción de DeepSeek: un terremoto para el sector

La irrupción de DeepSeek ha sacudido los cimientos de la industria. Esta startup china ha logrado desarrollar modelos de IA, como el DeepSeek V3 y el DeepSeek-R1, que superan en rendimiento a modelos de empresas con presupuestos mucho más abultados, como Meta y OpenAI, con una inversión significativamente menor. Mientras que OpenAI y Meta han invertido miles de millones de dólares en el entrenamiento de sus modelos, DeepSeek ha demostrado que es posible lograr resultados comparables, o incluso superiores, con tan solo 6 millones de dólares.

LOS USOS DE LOS NFTS PARA DEMOCRATIZAR Y DESCENTRALIZAR LA IA

Este hecho ha generado un impacto considerable en la percepción del coste del desarrollo de la IA, mostrando que la mera inversión masiva no garantiza el éxito. DeepSeek V3, por ejemplo, superó a Llama 3.1 de Meta y a GPT-4o de OpenAI en pruebas de rendimiento. DeepSeek-R1 ha alcanzado un nivel de desempeño comparable al de o1 de OpenAI en la resolución de problemas matemáticos, químicos y de codificación. De hecho, en la imagen abajo podemos ver el rendimiento en pruebas de DeepSeek V3 y DeepSeek R1, comparado con OpenAI-01 y OpenAI-01-mini, donde puede apreciarse claramente el nivel de rendimiento que ofrece DeepSeek.

Reacción de los gigantes

De hecho, el mayor logro de DeepSeek es probar ante el mundo que su modelo estrella, R1, puede ser usado para destilar (Distilled) y mejorar otros modelos. ¿Resultado? Superar nuevamente a modelos como ChatGPT-4o o ChatGPT-4o-mini, con modelos mucho más pequeños, portables y de tipo open-source (que recordemos, ChatGPT es totalmente privativo).

En este sentido, las pruebas de DeepSeek muestran claramente como el uso de DeepSeek R1 puede mejorar modelos más pequeños para dar un salto cualitativo a modelos de IA más pequeños que antes ni se acercaban a sus competidores. La gran sorpresa es que DeepSeek ha podido lograr todo esto teniendo en cuenta que su trabajo es un «side-project» de High-Flyer Quant, en la que trabaja un equipo limitado. Un equipo con pocos recursos y ocupando espacio de computación de un proyecto mucho más grande del que no se sabe nada más. Algo que envía un mensaje claro: en este momento nadie tiene la superioridad en los modelos: OpenAI ya no es el campeón del sector. 

Marcando el ritmo

De hecho, si vemos el LMSYS Leaderboard, hace rato que OpenAI está mandando el mensaje de que es incapaz de mantener el ritmo con la competencia. Por ejemplo, Gemini 2.0 de Google, desde hace ya bastante tiempo sostiene el primer lugar como la IA más potente que existe. DeepSeek R1, fue integrada al leaderboard el 24 de enero y ya ocupa el 4 lugar y DeepSeek V3 ocupa el octavo puesto. Entre ellos, una mezcla de OpenAI y Google, quienes llevan años desarrollando IA y tienen enormes complejos computacionales para mejorar esa competencia.

Sin embargo, hay un competidor del que pocos hablan y que está muy cerca, teniendo menos recursos que OpenAI (junto a Microsoft) y Google: xAI de Elon Musk y su modelo Grok2 que en este leaderboard ocupa la doceava posición. Para algunos esto puede ser un motivo de burla, pero considerando que Grok2 fue entrenado con recursos financieros y computacionales mucho menores que sus contrapartes y que el nuevo supercomputador de xAI ya está en funcionamiento y posiblemente iterando la nueva versión de Grok, podemos llevarnos una sorpresa este 2025 con su nuevo modelo.

Lo mismo pasa con Meta, que ya está trabajando con Llama 4, aunque el proyecto parece que va a retrasarse debido al lanzamiento de DeepSeek V3 y R1, con el fin de aprender del mismo y buscar mejorar la estructura actual que tienen. Después de todo, DeepSeek es open-source y lo mismo pasa con Llama, así que no habrá roces legales en este sentido.

¿POR QUÉ ALIA, LA IA MULTILINGÜE DEL GOBIERNO DE ESPAÑA, ESTÁ SIENDO CRITICADA?

La respuesta de Estados Unidos: Stargate Project

Lo cierto es que esta diferencia radical en la relación inversión-rendimiento tiene implicaciones profundas para el futuro del desarrollo de la IA. Y es aquí donde nace el proyecto Stargate, una iniciativa conjunta de OpenAI, Softbank, Oracle y MGX que pretende invertir 500 mil millones de dólares en infraestructura de IA en Estados Unidos y que se presenta bajo una nueva luz a la vista de los logros de DeepSeek. Si una pequeña empresa puede igualar o superar los resultados de gigantes tecnológicos con una fracción del presupuesto, la escala de Stargate se cuestiona. ¿Será realmente necesario invertir una suma tan astronómica para lograr avances significativos en IA o se trata de una estrategia que pudiera estar sobredimensionada?

Elon Musk ha cuestionado el lanzamiento de Stargate. No solo porque 500 mil millones de dólares es un exabrupto presupuestario para desarrollar una IA, más considerando el logro de DeepSeek, sino porque tal como ha demostrado NVIDIA, la innovación del sector viene al revisar las forma de trabajo de los modelos que ya tenemos. NVIDIA demostró claramente esto con el lanzamiento de sus nuevas tarjeta RTX5000, donde el rendimiento en IA para juegos (DLSS) se dispara de forma considerable gracias a cambiar la infraestructura del modelo IA usado, en lugar de añadir más potencia a la gráfica y encarecerla. La clave está en innovar y optimizar, no en gastar auténticas mil millonadas que al final no logran nada.

¿Un mal gasto de dinero?

Es precisamente el éxito de DeepSeek el que sugiere la necesidad de una reorientación en las estrategias de desarrollo de IA. La innovación, la eficiencia en el uso de recursos y la optimización de algoritmos emergen como factores más determinantes que la simple capacidad de gastar grandes sumas de dinero. La empresa china ha demostrado la importancia de una planificación estratégica cuidadosa, la selección precisa de las herramientas y técnicas de entrenamiento y, sobre todo, la creatividad en la búsqueda de soluciones innovadoras.

Su enfoque en el entrenamiento de precisión mixta FP8, por ejemplo, les permitió reducir significativamente los requisitos de memoria y cómputo sin sacrificar la precisión. Este enfoque, que se aleja de los modelos tradicionales que se basan en el poderío computacional bruto, promete abrir nuevas posibilidades para un desarrollo más accesible y democrático de la IA, especialmente para países y empresas con recursos limitados.

USA vs China: la competencia por la IA

La situación también destaca la creciente competencia entre Estados Unidos y China en el ámbito de la IA. La lucha no se limita solo al desarrollo de algoritmos, sino que se extiende a la competencia por el acceso a recursos vitales como chips y semiconductores de alta gama. Las restricciones impuestas a las exportaciones de tecnología estadounidense a China están teniendo un impacto en el desarrollo de IA chino, lo que obliga a las compañías a buscar soluciones alternativas y a impulsar la innovación. Sin embargo, el éxito de DeepSeek muestra la capacidad de China para desarrollar tecnologías de vanguardia a pesar de estos desafíos, lo cual subraya la necesidad de una respuesta estratégica por parte de los actores estadounidenses.

Además de DeepSeek, otras compañías chinas están logrando avances significativos en el campo de la IA. El avance de modelos como Ernie de Baidu y Qwen de Alibaba demuestra la creciente capacidad de innovación de China y el potencial para que este país se convierta en un jugador dominante en el mercado global de IA. La competencia en este campo no se limita a la superioridad tecnológica, sino que también abarca factores políticos y económicos fundamentales, que tienen un impacto profundo en la dirección del desarrollo de la IA a nivel mundial.

Código abierto ¿La mejor vía?

Por otro lado, el desarrollo de la IA de código abierto también está desempeñando un papel importante en la creciente competencia. DeepSeek ha sido desarrollado bajo una licencia de código abierto (MIT License), lo que permite a otros investigadores y desarrolladores colaborar en su mejora y aplicación. Ese acceso abierto a herramientas y datos puede acelerar el ritmo del progreso en IA, y crea un campo de juego más equilibrado donde compañías más pequeñas pueden competir con gigantes tecnológicos con recursos incomparablemente superiores. El futuro dependerá de la capacidad de los diferentes actores para adaptarse a este nuevo escenario, que ya presenta las características de una revolución a nivel cualitativo. El software y desarrollo en IA está entrando en un nuevo paradigma.

VITALIK BUTERIN ALERTA SOBRE LOS RIESGOS DE LAS MONEDAS DE POLÍTICOS

Además, la creciente competencia entre empresas de IA tiene grandes implicaciones para la innovación. La presión para desarrollar continuamente modelos de IA más eficientes y asequibles podría llevar a avances tecnológicos más rápidos. Los modelos de IA más accesibles también aumentan el acceso a la tecnología para investigadores y desarrolladores con recursos limitados, lo cual potencia la innovación a nivel global.

Avanzando a grandes pasos

En conclusión, la competencia en el sector de la IA está alcanzando niveles sin precedentes. Mientras las grandes compañías tecnológicas estadounidenses continúan invirtiendo masivamente en investigación y desarrollo, la emergencia de empresas chinas como DeepSeek desafía la idea de que la superioridad tecnológica se compra únicamente con billones de dólares. La eficiencia, la innovación y la capacidad de adaptarse a un entorno cambiante se han convertido en los nuevos factores diferenciadores.

Esta dinámica reconfigura profundamente el panorama de la IA y promete acelerar el ritmo de innovación, al tiempo que plantea profundas interrogantes sobre la mejor manera de gestionar, tanto el vertiginoso avance tecnológico como sus implicaciones éticas y socioeconómicas. El futuro de la IA dependerá del equilibrio entre el potencial disruptivo de la innovación y los mecanismos de control necesarios para dirigirla de manera beneficiosa para la humanidad. La carrera apenas comienza y los próximos años serán cruciales para determinar el líder en este nuevo y cambiante mundo de la IA.

Comparte esto: