首页 > 教程攻略 > ai资讯 >跳过GPT-5,OpenAI 推出全新 AI模型 o1

跳过GPT-5,OpenAI 推出全新 AI模型 o1

来源:互联网 时间:2026-08-27 14:31:07

AI圈最近最大的新闻,莫过于OpenAI终于拿出了那款传闻已久的“草莓”模型——正式名称叫o1。这是一系列“推理”模型的开篇之作,目标很明确:专门应对那些更复杂、更需要动脑筋的问题。同时亮相的还有它的轻量版o1-mini,一个更经济实惠的选择。

简单来说,如果你一直在关注AI界的动态,这个所谓的Strawberry模型,就是它了。

跳过GPT-5,OpenAI 推出全新 AI模型 o1

迈向AGI的一大步

从去年3月GPT-4横空出世到现在,已经过去一年半了。这期间,大家一直在猜:GPT-5什么时候来?结果呢?OpenAI绕过了GPT-5,直接推出了一套全新的模型家族——o1系列。

事实证明,GPT系列的迭代节奏被打破了。就在传闻和猜测达到顶峰的时候,OpenAI正式发布了其“o1”AI模型家族,包含两个版本:o1-preview和o1-mini。按照官方的说法,这套模型的设计初衷就是“通过复杂任务进行推理并解决比GPT系列模型更难的问题”。

目前,这两个模型已经向ChatGPT Plus用户开放,不过初期有使用限制:o1-preview每周30条消息,o1-mini每周50条。必须提醒的是,这毕竟是个早期模型,很多我们熟悉的ChatGPT功能它还不具备,比如联网查找信息、上传文件和图像。所以对于日常的很多场景,GPT-4o近期内依然是那个更全能的选手。第一次尝试用它生成图片的测试也印证了这一点——它做不到。在OpenAI的API平台上,官方也明确表示,现阶段模型家族仅支持文本,不支持图像。

o1比GPT做得更好的方面

OpenAI认为,o1系列特别擅长解决科学、医疗、技术等领域的复杂问题。其应用场景被设想得非常广泛:从帮物理学家为量子光学推导数学公式,到协助医疗研究人员注释细胞测序数据,都能派上用场。

对于开发者来说,o1-mini在处理多步骤工作流、调试代码和解决编程难题时会是个得力助手。

OpenAI o1破解逻辑谜题:

o1-preview达到博士级表现

o1-preview的思路是投入更多时间去“思考”和完善输出,就像人处理复杂问题时那样。在测试中,这种方法的效果相当惊艳:它在物理、化学、生物等领域的表现,已经接近博士生的水平。

OpenAI o1与量子物理:

在编程方面,o1-preview同样实力不俗。它在Codeforces竞赛中排名第89百分位,这意味着它在处理多步骤工作流、调试复杂代码和生成准确解决方案上,已经超越了绝大多数人类程序员。

再看数学竞赛——在国际数学奥林匹克(IMO)资格赛中,o1-preview的正确率达到了83%,而GPT-4o只有13%。这个提升幅度,足足翻了六倍多。

OpenAI o1与代码:

目前,ChatGPT的Plus和Team用户已经可以用上它了,企业版和教育版用户将于下周获得访问权限。同时,这些模型也已通过OpenAI API向有资格的使用层5的开发者开放,不过初期会有速率限制。

o1-mini功能较弱但便宜80%

与o1-preview同步推出的,还有o1-mini。它相当于一个精简版,目标是提供更快、更便宜的推理能力。

虽然主要针对代码和STEM任务优化,但o1-mini的表现依然亮眼,特别是在数学和编程方面。在IMO数学基准测试中,它得分70%,与o1-preview的74%相差无几,但推理成本却显著降低。在Codeforces上,它拿到了1650的Elo分,排在前86%的程序员之列。

相比o1-preview,价格便宜了80%。这个性价比很高的方案,非常适合那些需要推理能力、但用不上更广泛知识的开发者和研究人员。它同样面向ChatGPT Plus、Team、Enterprise和Edu用户开放,未来还计划扩展到Free用户。

安全和安全增强

在安全性方面,这两个模型都采用了新的训练方法,在遵循安全和对齐指南上表现更好。值得关注的是,o1-preview在最苛刻的“越狱”测试中得分84,而GPT-4o只有22。这个巨大的提升,意味着它能在推理阶段更好地识别并处理不安全的提示,避免生成不当内容。

作为更广泛安全工作的一部分,OpenAI已经与美国和英国的人工智能安全研究所达成了协议,包括提前提供研究版本的o1模型,以帮助评估和测试未来的AI系统。安全工作还涵盖了内部治理和与联邦政府的合作,由公司安全与安全委员会进行定期测试、红队和董事会层面的监督。

OpenAI的o1系列下一步是什么

尽管o1-preview和o1-mini已经是推理和解决问题的强大工具,但OpenAI自己也承认,这只是个开始。

公司计划定期更新和改进这些模型,未来将逐步添加目前API版本中尚不具备的功能,比如浏览网页、上传文件和图像,以及函数调用。

展望未来,OpenAI将继续推进GPT和o1两个系列的发展,进一步扩展AI在各领域的应用能力。可以预见,随着这些模型在不同场景中的实用性和可访问性不断提升,我们能期待的进步还有很多。