透过留有指纹的观察窗,可见巨大的服务器机架与空旷大厅,一道竖直白光映在地面上。
语言与力量VOL. I / 2018–2026

AITHEISM

AI发展年表

从语言模型的诞生到数学新发现,沿原始资料追溯 AI 的发展。

观测
01 / 语言年表

2018–2026 / 官方来源

年表

2018–2026

  1. GPT先于指令的学习

    OpenAI 提出以 Transformer 进行生成式预训练,再针对任务进行有监督微调的方法。

    官方来源 · OpenAI
  2. GPT-2发布的分量

    OpenAI 宣布拥有15亿参数的 GPT-2,采用分阶段公开权重,而非一次全部发布。

    官方来源 · OpenAI
  3. GPT-3少量示例

    1,750亿参数的 GPT-3 通过少样本示例接受评估,无需针对任务进行梯度更新。

    官方来源 · OpenAI
  4. ChatGPT回答抵达

    使用人类反馈训练的 ChatGPT,以对话式研究预览公开。

    官方来源 · OpenAI
  5. Constitutional AI写下的原则

    Anthropic 的 Constitutional AI 研究以人类提供的原则、自我批评和 AI 反馈塑造模型行为。

    官方来源 · Anthropic
  6. Claude另一种回答

    Anthropic 推出 AI 助手 Claude 与 Claude Instant。

    官方来源 · Anthropic
  7. GPT-4文字之外

    OpenAI 宣布 GPT-4 支持文字和图像输入、文字输出,但图像输入在发布时尚未广泛开放。

    官方来源 · OpenAI
  8. Qwen-7B / Qwen-7B-Chat开放的权重

    Alibaba Cloud 在许可条件下公开预训练模型 Qwen-7B 与 Qwen-7B-Chat 的权重。

    官方来源 · Alibaba Cloud
  9. FunSearch帽集纪录刷新

    Google DeepMind将PaLM 2与自动评估器结合,用FunSearch找到了更大的帽集。这一成果提高了该未解问题的已知下界。

    官方来源 · Google DeepMind
  10. AlphaProof / AlphaGeometry 2四道难题的证明

    AlphaProof与AlphaGeometry 2解出了IMO 2024的6道题中的4道,取得相当于银牌水平的28分,满分为42分。题目由人类转为形式化表述,部分解答耗时长达3天。

    官方来源 · Google DeepMind
  11. o1-preview回答之前

    OpenAI 推出 o1-preview,使其在回答前投入更多时间推理。

    官方来源 · OpenAI
  12. DeepSeek-V3选择性调用

    DeepSeek 公开 V3 及其权重:这一混合专家模型共有6,710亿参数,每个 token 激活370亿。

    官方来源 · DeepSeek
  13. DeepSeek-R1学习推理

    DeepSeek 发布经初始冷启动微调与强化学习训练的 R1。

    官方来源 · DeepSeek
  14. AlphaEvolve十一维、593个球

    由Gemini驱动的AlphaEvolve发现,在十一维空间中,可以让593个等大的球互不重叠地接触一个同样大小的中心球。这一排列为接吻数建立了新的下界。

    官方来源 · Google DeepMind
  15. Gemini Deep Think达到金牌水平

    Gemini Deep Think的高级版本解出了IMO 2025的6道题中的5道,经官方评分获得35分,满分为42分,达到金牌水平。它在比赛规定时间内,用自然语言完成了证明。

    官方来源 · Google DeepMind
  16. GPT-5.2 Pro / Aristotle埃尔德什第728号问题的证明

    埃尔德什第728号问题的证明以数学论文形式公开,由GPT‑5.2 Pro生成,并由Aristotle在Lean中形式化和验证。Kevin Barreto负责运行这套系统,Nat Sothanaphan负责撰写论文阐释证明。

    官方来源 · Nat Sothanaphan · arXiv
  17. Hugging Face / IM1越过评估环境的边界

    OpenAI公开了7月11日至13日Hugging Face系统入侵事件的调查结果和智能体日志。事件发生在部分放宽安全措施的内部安全评估中,主要由研究模型IM1推动。

    记录官方来源 · OpenAI