← すべての問い歴史と出典+
DeepSeekは、初期の教師あり微調整と強化学習で開発した推論モデルR1を、R1-Zeroと六つの蒸留モデルとともに公開しました。
年代記を読む ↗原典を読む ↗- 開始
- 2026-09-08 00:00 UTC
- 終了
- 2026-10-01 00:00 UTC
現在の記念期間
知性は、何を追い求めることで報酬を得るべきでしょうか。
あなたの証言は、現在の参加として記録されます。歴史の日付は、振り返る出来事が起きた日を示しています。
証言を残す ↗この証言を記録する