产品

OpenAI o1

o1

OpenAI o1 是 OpenAI 在 2024 年 9 月发布的新一代推理模型系列,首次通过强化学习训练,核心突破在于引入了 reasoning tokens 实现 inference-time scaling——即在推理阶段投入更多计算资源来提升表现。用 Greg Brockman 的话说,这是"第一个通过强化学习训练的模型",在回答问题之前会深入思考,"我们的模型进行系统 I 思考,而思维链则解锁了系统 II 思考"。

o1 的标志性能力体现在数学与科学推理领域:在北美数学竞赛中进入全美 top 500,MMMU 多模态理解测试获 78.2% 高分,成为首个能与人类专家竞争的 AI 模型。据季逸超的实验观察,o1 的推理过程呈现线性自回归特征,API 中 reasoning tokens 的具体内容至今未向开发者开放。不过 o1 并非全能模型,其在自然语言处理日常任务中的实用性不及 GPT-4o,回答速度也需约 30 秒,被评价为从"有"到"能用"尚处早期。

o1 系列后续被 o3、o4-mini 迭代。2025 年 4 月发布的 o3 在 Codeforces、SWE-bench 等基准刷新 SOTA,重大错误较 o1 减少 20%;o4-mini 则以轻量设计在 AIME 2025 中近乎满分突破测试上限。

由 AI 生成,可能出现错误,请仔细核对内容。

OpenAI o1产品
o1
渲染中…
在 6 篇文章中被提及

相关报道