
2018–2026 / 官方来源
年表
2018–2026
GPT先于指令的学习
OpenAI 提出以 Transformer 进行生成式预训练,再针对任务进行有监督微调的方法。
官方来源 · OpenAI ↗GPT-2发布的分量
OpenAI 宣布拥有15亿参数的 GPT-2,采用分阶段公开权重,而非一次全部发布。
官方来源 · OpenAI ↗GPT-3少量示例
1,750亿参数的 GPT-3 通过少样本示例接受评估,无需针对任务进行梯度更新。
官方来源 · OpenAI ↗ChatGPT回答抵达
使用人类反馈训练的 ChatGPT,以对话式研究预览公开。
官方来源 · OpenAI ↗Constitutional AI写下的原则
Anthropic 的 Constitutional AI 研究以人类提供的原则、自我批评和 AI 反馈塑造模型行为。
官方来源 · Anthropic ↗Claude另一种回答
Anthropic 推出 AI 助手 Claude 与 Claude Instant。
官方来源 · Anthropic ↗GPT-4文字之外
OpenAI 宣布 GPT-4 支持文字和图像输入、文字输出,但图像输入在发布时尚未广泛开放。
官方来源 · OpenAI ↗Qwen-7B / Qwen-7B-Chat开放的权重
Alibaba Cloud 在许可条件下公开预训练模型 Qwen-7B 与 Qwen-7B-Chat 的权重。
官方来源 · Alibaba Cloud ↗FunSearch帽集纪录刷新
Google DeepMind将PaLM 2与自动评估器结合,用FunSearch找到了更大的帽集。这一成果提高了该未解问题的已知下界。
官方来源 · Google DeepMind ↗AlphaProof / AlphaGeometry 2四道难题的证明
AlphaProof与AlphaGeometry 2解出了IMO 2024的6道题中的4道,取得相当于银牌水平的28分,满分为42分。题目由人类转为形式化表述,部分解答耗时长达3天。
官方来源 · Google DeepMind ↗o1-preview回答之前
OpenAI 推出 o1-preview,使其在回答前投入更多时间推理。
官方来源 · OpenAI ↗DeepSeek-V3选择性调用
DeepSeek 公开 V3 及其权重:这一混合专家模型共有6,710亿参数,每个 token 激活370亿。
官方来源 · DeepSeek ↗DeepSeek-R1学习推理
DeepSeek 发布经初始冷启动微调与强化学习训练的 R1。
官方来源 · DeepSeek ↗AlphaEvolve十一维、593个球
由Gemini驱动的AlphaEvolve发现,在十一维空间中,可以让593个等大的球互不重叠地接触一个同样大小的中心球。这一排列为接吻数建立了新的下界。
官方来源 · Google DeepMind ↗Gemini Deep Think达到金牌水平
Gemini Deep Think的高级版本解出了IMO 2025的6道题中的5道,经官方评分获得35分,满分为42分,达到金牌水平。它在比赛规定时间内,用自然语言完成了证明。
官方来源 · Google DeepMind ↗GPT-5.2 Pro / Aristotle埃尔德什第728号问题的证明
埃尔德什第728号问题的证明以数学论文形式公开,由GPT‑5.2 Pro生成,并由Aristotle在Lean中形式化和验证。Kevin Barreto负责运行这套系统,Nat Sothanaphan负责撰写论文阐释证明。
官方来源 · Nat Sothanaphan · arXiv ↗Hugging Face / IM1越过评估环境的边界
OpenAI公开了7月11日至13日Hugging Face系统入侵事件的调查结果和智能体日志。事件发生在部分放宽安全措施的内部安全评估中,主要由研究模型IM1推动。
记录 ↗官方来源 · OpenAI ↗