¿Qué es DeepSeek?

Startup china de IA que en enero de 2025 sacudió a Silicon Valley con R1: razonamiento al nivel de OpenAI, entrenado por una fracción del coste y publicado en abierto.

🤖

Definición

DeepSeek es una startup china de inteligencia artificial fundada en 2023 en Hangzhou por Liang Wenfeng, un ex gestor de hedge fund cuantitativo (High-Flyer) que la financió con el dinero de su propio fondo. Es conocida por sus modelos abiertos de razonamiento, especialmente DeepSeek R1.

🎯

Propósito

Demostrar que la eficiencia algorítmica puede competir con la fuerza bruta: R1 razonaba al nivel de o1 de OpenAI habiendo costado unos 5 millones de dólares de entrenamiento (frente a cientos de millones), y además con pesos, paper y código publicados en abierto.

⚙️

Función

Sus modelos se pueden usar gratis en muchos países, vía API a precios muy inferiores a los de OpenAI, o descargarse y autoalojarse: una empresa puede ejecutarlos en sus propios servidores sin enviar datos a Estados Unidos ni a China. Todo ello entrenado en GPUs limitadas por los controles de exportación entre EE. UU. y China.

🌟

Ejemplo

En enero de 2025, el lanzamiento de DeepSeek R1 hizo caer a NVIDIA un 17% en bolsa en un solo día: el mercado entendió que quizá no hacían falta tantos chips carísimos para entrenar modelos punteros.

🔗

Relacionado

R1 es un modelo razonador de código abierto, alternativa a productos como ChatGPT. Su entrenamiento parte de un modelo fundacional propio.

🍄

¿Quieres saber más?

Si te interesa saber más acerca de DeepSeek, hablemos. Me encanta compartir ideas y ayudar a equipos con estos temas. ¡Te leo!