首页 > 教程攻略 > ai资讯 >OpenAI 绝密项目「草莓」曝光,前身为Q*,能实现高级推理

OpenAI 绝密项目「草莓」曝光,前身为Q*,能实现高级推理

来源:互联网 时间:2026-08-16 20:19:21

还记得 OpenAI 的 Q* 吗?它现在有了新代号:“草莓”

最近路透社独家爆料了一个消息——OpenAI 正在秘密推进一个名为

“草莓”(Strawberry)

的新人工智能模型项目。这个项目的细节此前从未公开,但它的目标非常明确:让 AI 具备真正的

高级推理能力

根据路透社看到的一份 OpenAI 内部文件(日期不详),内部团队正在围绕“草莓”展开研究。消息人士透露,该项目仍在进行中,且距离公开发布还有多远,目前没人能给出明确答案。更关键的是,就连 OpenAI 内部,

“草莓”的工作原理也被列为高度机密

文件描述了一个使用“草莓”模型的计划:让 AI 不仅能生成答案,还能提前规划,自主、可靠地浏览互联网,完成所谓

“深度研究”

。这种能力,正是目前市面上所有模型都未曾实现的。

“草莓”的前世:从 Q* 到推理突破

其实“草莓”并非凭空出现,它的前身是那个曾让 OpenAI 内部视为重大突破的

Q*

项目。今年早些时候,有两位消息人士亲眼目睹了 Q* 的演示——它能回答棘手的科学和数学问题,而这些题目是当时其他模型完全无法应对的。

而在本周二的内部全员会议上,OpenAI 又展示了一个研究项目的 demo,并声称它拥有类似人类的

新推理能力

。虽然发言人拒绝透露演示是否就是“草莓”,但种种迹象表明,两者很可能就是同一件事。

五个等级:OpenAI 给自己定的“成长路线图”

在这次会议上,OpenAI 还提出了一套

五个等级

的评估体系,用来追踪自身在超越人类智能方面的进展。从目前可用的第 1 级(对话式 AI)到第 5 级(能完成整个组织工作的 AI),跨度相当大。

OpenAI 高管告诉员工,当前公司处于第 1 级,但很快就要迈入第 2 级——也就是“推理者”。这一级的系统可以像拥有博士学历但不会使用任何工具的人类一样,解决基本的逻辑问题。再往后:
第 3 级是“智能体”,能花几天时间代用户执行一系列任务;
第 4 级是“创新者”,能自主提出新发明;
第 5 级则是“组织”——完全能够管理一家公司的人工智能。

推理能力:AI 从“聪明”到“碘伏”的关键

接受采访的研究人员一致认为,

推理是 AI 实现人类级乃至超人级智能的核心门槛

。虽然大语言模型已经能比人类更快地概括文本、写出优美的文章,但它们在常识性问题面前经常翻车——比如识别逻辑谬误,或者玩井字棋。一旦遇到这类问题,模型就容易“幻觉”频出。

那么,到底什么是推理?在 AI 语境下,推理意味着模型能提前规划、反映物理世界的运行规律、并可靠地解决需要多步骤思考的复杂问题。而一旦攻克了推理,AI 就能从重大科学发现一直干到自动构建软件应用。

OpenAI CEO Sam Altman 今年早些时候就直言:“在人工智能领域,

最重要的进步将围绕推理能力展开

。” 谷歌、Meta、微软以及众多学术实验室,也都在用不同技术试图突破这一瓶颈。但分歧同样存在——比如 Meta 的 Yann LeCun 就经常强调,大语言模型根本无法具备人类那样的推理能力。

“草莓”如何破局?后训练与自我进化

知情人士透露,“草莓”正是 OpenAI 用来解决这些挑战的核心技术。路透社看到的文件描述了它想实现的目标,但并未说明具体实现方式。不过,多位消息人士给出了关键线索:

“草莓”采用了后训练(post-training)方法

——也就是在模型完成海量数据预训练之后,再通过特定的方式微调它的性能。

后训练中最常见的做法是微调,比如让人类针对模型的输出进行反馈,或者给模型提供好答案和坏答案的样例。而“草莓”则与斯坦福大学 2022 年开发的

STaR(Self-Taught Reasoner)

方法有相似之处。STaR 的创建者之一、斯坦福教授 Noah Goodman 解释:这种方法能让 AI 模型通过迭代生成自己的训练数据,从而“自我引导”到更高的智能水平,理论上甚至能突破人类能力的天花板。

Goodman 教授谈及“草莓”时感慨:“这让我既兴奋又恐惧……如果事情继续朝这个方向发展,人类恐怕得认真思考一些问题了。”

目标:长期任务与自主研究

“草莓”瞄准的一个重要功能是

执行长期任务(long-horizon tasks)

。这类任务要求模型提前规划,并在较长时间内完成一系列复杂操作。根据 OpenAI 内部文件,该公司正利用一个名为

“deep-research”的数据集

来创建、训练和评估模型。虽然路透社无法确定这个数据集包含什么内容,但 OpenAI 的野心很明确——让模型在

CUA(computer-using agent)

的帮助下,自主浏览网页,根据发现采取行动,并最终完成类似软件工程师或机器学习工程师的工作。

这一切听起来像科幻小说,但别忘了,OpenAI 已经在私下向部分开发者暗示:具备更强推理能力的技术即将面世。无人知晓“草莓”究竟会在什么时候正式亮相,但可以确定的是,这场关于

推理

的竞赛,正在以前所未有的速度推进。

参考链接:
https://www.reuters.com/technology/artificial-intelligence/openai-working-new-reasoning-technology-under-code-name-strawberry-2024-07-12/
https://www.bloomberg.com/news/articles/2024-07-11/openai-sets-levels-to-track-progress-toward-superintelligent-ai