OpenAI o1
o1
OpenAI o1 是 OpenAI 在 2024 年 9 月发布的新一代推理模型系列,首次通过强化学习训练,核心突破在于引入了 reasoning tokens 实现 inference-time scaling——即在推理阶段投入更多计算资源来提升表现。用 Greg Brockman 的话说,这是"第一个通过强化学习训练的模型",在回答问题之前会深入思考,"我们的模型进行系统 I 思考,而思维链则解锁了系统 II 思考"。
o1 的标志性能力体现在数学与科学推理领域:在北美数学竞赛中进入全美 top 500,MMMU 多模态理解测试获 78.2% 高分,成为首个能与人类专家竞争的 AI 模型。据季逸超的实验观察,o1 的推理过程呈现线性自回归特征,API 中 reasoning tokens 的具体内容至今未向开发者开放。不过 o1 并非全能模型,其在自然语言处理日常任务中的实用性不及 GPT-4o,回答速度也需约 30 秒,被评价为从"有"到"能用"尚处早期。
o1 系列后续被 o3、o4-mini 迭代。2025 年 4 月发布的 o3 在 Codeforces、SWE-bench 等基准刷新 SOTA,重大错误较 o1 减少 20%;o4-mini 则以轻量设计在 AIME 2025 中近乎满分突破测试上限。
由 AI 生成,可能出现错误,请仔细核对内容。
OpenAI o1产品
o1
渲染中…
在 6 篇文章中被提及
相关报道
Kimi 发布视觉思考模型 k1,「数理化」成绩领先 OpenAI o1|Z News
每个像素,都值得深入思考。
三万字实录对话 Google Deepmind 研究员:拆解 OpenAI o1 及 LLM+RL 新范式|Z Talk
最硬核干货的 o1 技术解读。
季逸超 Peak:迈向复现 OpenAI o1 的一小步之 Steiner 开源模型阶段性进展报告|Z Talk
从 OpenAI o1 发布以来,我就把复现 o1 作为业余时间的兴趣项目。
Kimi 创始人杨植麟最新分享:关于 OpenAI o1 新范式的深度思考|Z Talk
大模型下半场,新范式开启?
一文读懂,OpenAI全新大模型o1优劣何在? | 云启科技π
大模型天花板在哪里?




