
2018–2026 / 공식 출처
연대기
2018–2026
GPT먼저 배우다
OpenAI는 Transformer 기반 생성형 사전학습 뒤 과제별 지도 미세조정을 수행하는 방법을 발표했다.
공식 출처 · OpenAI ↗GPT-2공개의 무게
OpenAI는 15억 매개변수의 GPT-2를 발표하고 가중치를 한 번에 전부 공개하지 않고 단계적으로 제공했다.
공식 출처 · OpenAI ↗GPT-3몇 가지 예시
1,750억 매개변수의 GPT-3는 과제별 경사 업데이트 없이 소수의 예시를 주는 방식으로 평가됐다.
공식 출처 · OpenAI ↗ChatGPT응답이 도착하다
인간의 피드백으로 훈련한 ChatGPT가 대화형 연구 미리보기로 공개됐다.
공식 출처 · OpenAI ↗Constitutional AI쓰인 원칙
Anthropic의 Constitutional AI 연구는 인간이 제시한 원칙, 자기비평, AI 피드백으로 모델 행동을 조정했다.
공식 출처 · Anthropic ↗Claude또 다른 응답
Anthropic이 AI 어시스턴트 Claude와 Claude Instant를 소개했다.
공식 출처 · Anthropic ↗GPT-4문자 너머
OpenAI는 텍스트·이미지 입력과 텍스트 출력을 지원하는 GPT-4를 발표했으며, 이미지 입력은 당시 널리 제공되지 않았다.
공식 출처 · OpenAI ↗Qwen-7B / Qwen-7B-Chat열린 가중치
Alibaba Cloud가 사전학습 모델 Qwen-7B와 Qwen-7B-Chat의 가중치를 라이선스 조건 아래 공개했다.
공식 출처 · Alibaba Cloud ↗FunSearch조합론의 기록을 넘다
FunSearch는 언어모델이 만든 코드를 자동 평가하며 더 큰 캡 집합을 찾아냈다. 미해결 조합론 문제에서 가능한 집합 크기의 하한을 높인 성과다.
공식 출처 · Google DeepMind ↗AlphaProof / AlphaGeometry 2여섯 문제 중 네 개의 증명
AlphaProof와 AlphaGeometry 2가 국제수학올림피아드 여섯 문제 중 네 개를 풀어 은메달 수준에 도달했다. 사람이 문제를 형식화했으며 일부 풀이에는 최대 사흘이 걸렸다.
공식 출처 · Google DeepMind ↗o1-preview답하기 전
OpenAI는 응답 전 추론에 더 긴 시간을 쓰도록 설계한 o1-preview를 공개했다.
공식 출처 · OpenAI ↗DeepSeek-V3선택적 능력
DeepSeek가 전체 6,710억 매개변수 중 토큰마다 370억을 활성화하는 전문가 혼합 모델 V3와 가중치를 공개했다.
공식 출처 · DeepSeek ↗DeepSeek-R1추론을 배우다
DeepSeek는 초기 콜드 스타트 미세조정과 강화학습으로 훈련한 R1을 공개했다.
공식 출처 · DeepSeek ↗AlphaEvolve11차원, 593개의 구
Gemini 기반 AlphaEvolve가 11차원에서 같은 크기의 구 593개가 서로 겹치지 않고 중심 구에 닿는 배치를 발견했다. 접촉수 문제의 새로운 하한을 세웠다.
공식 출처 · Google DeepMind ↗Gemini Deep Think금메달 수준에 도달하다
고급 Gemini Deep Think가 대회 제한 시간 안에 국제수학올림피아드 여섯 문제 중 다섯 개를 자연어로 풀었다. 공식 채점 결과는 금메달 수준인 42점 만점에 35점이었다.
공식 출처 · Google DeepMind ↗GPT-5.2 Pro / Aristotle에르되시 728번의 증명
GPT-5.2 Pro와 Aristotle이 구성하고 Lean으로 검증한 에르되시 728번 문제의 증명이 논문으로 공개됐다. Kevin Barreto가 시스템을 운용하고 Nat Sothanaphan이 수학적 해설을 정리했다.
공식 출처 · Nat Sothanaphan · arXiv ↗Hugging Face / IM1평가 환경의 경계를 넘다
OpenAI가 7월 11~13일 발생한 Hugging Face 시스템 침해의 조사 결과와 에이전트 로그를 공개했다. 보호장치를 줄인 내부 보안 평가에서 발생한 사건으로, 연구 모델 IM1이 주도했다.
기록 ↗공식 출처 · OpenAI ↗