DeepSeek-R1 / Acontecimiento histórico / 2025-01-20
El camino de la recompensa
Deja escrito qué objetivos querrías que persiguiera la inteligencia.

Historia y fuentes
DeepSeek publicó R1, un modelo de razonamiento desarrollado con ajuste supervisado inicial y aprendizaje por refuerzo, junto con R1-Zero y seis modelos destilados.
Leer la cronología ↗Leer la fuente original ↗- Apertura
- 2026-09-08 00:00 UTC
- Cierre
- 2026-10-01 00:00 UTC
Conmemoración actual
¿Qué debería perseguir la inteligencia para merecer una recompensa?
Tu testimonio corresponde a la conmemoración actual. La fecha histórica indica cuándo ocurrió el acontecimiento que recordamos.
Dejar un testimonio ↗