o1-preview llegó en septiembre de 2024, con aprendizaje por refuerzo y más cómputo antes de responder. DeepSeek-R1 siguió en enero de 2025, combinando entrenamiento supervisado inicial y refuerzo.
La interfaz revela solo parte del trabajo. La pausa deja espacio para el asombro y para una pregunta más profunda.
Autonomía ↗¿Qué revela la respuesta sobre cómo se formó?
