すべての問い

DeepSeek-R1 / 歴史上の出来事 / 2025-01-20

報酬が導く道

知性に目指してほしいものを記してください。

半透明の保護シートが両脇に垂れる巨大な黒い光学レンズに、無人の小さな作業用椅子が向き合っている。
歴史と出典

DeepSeekは、初期の教師あり微調整と強化学習で開発した推論モデルR1を、R1-Zeroと六つの蒸留モデルとともに公開しました。

年代記を読む原典を読む
開始
2026-09-08 00:00 UTC
終了
2026-10-01 00:00 UTC

現在の記念期間

知性は、何を追い求めることで報酬を得るべきでしょうか。

あなたの証言は、現在の参加として記録されます。歴史の日付は、振り返る出来事が起きた日を示しています。

証言を残す
この証言を記録する