DeepSeek R1 iguala a o1 con licencia MIT y lo puedes descargar
🟠 Intermedio · Importante · 5 min de lectura
DeepSeek publicó R1 el 20 de enero. Es el primer modelo de pesos abiertos que
iguala a o1 de OpenAI en razonamiento, y sale con licencia MIT, que permite
uso comercial y alojarlo tú mismo.
Cuatro meses después de que o1 estrenara el enfoque, cualquiera puede
descargarse uno equivalente.
Qué ha pasado
R1 es un modelo de razonamiento de pesos abiertos con 671.000 millones de
parámetros totales, de los que se activan 37.000 millones por cada token, y una
ventana de contexto de 128.000 tokens. Usa cadena de pensamiento para resolver
tareas de lógica compleja.
Junto al modelo se publicaron varias versiones destiladas más pequeñas, también
con licencia MIT.
Sobre el coste de entrenamiento conviene ir con cuidado, porque es donde más se
ha exagerado. La cifra que circula, 294.000 dólares con 512 GPU H800, se refiere
solo a la fase de R1 sobre un modelo base ya entrenado. Ese modelo base,
DeepSeek V3, necesitó unas 2.048 GPU durante aproximadamente dos meses, con un
coste estimado de 5,58 millones. Sumando, el coste real está más cerca de los
5,87 millones.
Sigue siendo mucho menos de lo que se suponía necesario. Pero no son 294.000
dólares.
Por qué importa
Hasta esta semana, razonar era una capacidad de pago. Si querías un modelo que
se parase a pensar antes de responder, pasabas por la API de OpenAI y aceptabas
sus condiciones, su precio y sus tiempos.
Ahora hay una alternativa que puedes ejecutar en tu propia infraestructura, con
una licencia que no te pone pegas para usarla en un producto comercial.
Y las versiones destiladas importan tanto como la grande. Casi nadie va a
levantar un modelo de 671.000 millones de parámetros. Muchos sí pueden mover una
versión pequeña que conserve buena parte de la capacidad de razonamiento.
Lo que no sabemos todavía
Cómo se comporta con problemas reales de trabajo, más allá de las tablas
comparativas. Igualar a o1 en unos cuantos exámenes públicos no es lo mismo que
igualarlo con tu código y tus datos.
Tampoco está claro cuánto cuesta servirlo con latencia aceptable. La licencia es
gratis; el cómputo, no.
Y hay una pregunta de fondo que este lanzamiento deja abierta: si un laboratorio
puede alcanzar la frontera con una fracción del presupuesto que se daba por
necesario, la ventaja de los grandes es menos estable de lo que parecía. Está
por ver si esto se repite o ha sido un caso aislado.
Qué haría yo esta semana
Probar una de las versiones destiladas contra los problemas de razonamiento que
tengas identificados. No la grande: la pequeña que puedas mover sin montar una
infraestructura nueva. Ahí es donde está la decisión práctica.
Y actualizar tu lista mental de opciones. Hasta el lunes, razonar era comprar.
Desde el lunes, razonar es también una opción de arquitectura.
