OpenAI 绝密项目「草莓」曝光,前身为Q*,能实现高级推理
还记得 OpenAI 的 Q* 吗?它现在有了新代号:“草莓”
最近路透社独家爆料了一个消息——OpenAI 正在秘密推进一个名为
“草莓”(Strawberry)
高级推理能力
根据路透社看到的一份 OpenAI 内部文件(日期不详),内部团队正在围绕“草莓”展开研究。消息人士透露,该项目仍在进行中,且距离公开发布还有多远,目前没人能给出明确答案。更关键的是,就连 OpenAI 内部,
“草莓”的工作原理也被列为高度机密
文件描述了一个使用“草莓”模型的计划:让 AI 不仅能生成答案,还能提前规划,自主、可靠地浏览互联网,完成所谓
“深度研究”
“草莓”的前世:从 Q* 到推理突破
其实“草莓”并非凭空出现,它的前身是那个曾让 OpenAI 内部视为重大突破的
Q*
而在本周二的内部全员会议上,OpenAI 又展示了一个研究项目的 demo,并声称它拥有类似人类的
新推理能力
五个等级:OpenAI 给自己定的“成长路线图”
在这次会议上,OpenAI 还提出了一套
五个等级
OpenAI 高管告诉员工,当前公司处于第 1 级,但很快就要迈入第 2 级——也就是“推理者”。这一级的系统可以像拥有博士学历但不会使用任何工具的人类一样,解决基本的逻辑问题。再往后:
第 3 级是“智能体”,能花几天时间代用户执行一系列任务;
第 4 级是“创新者”,能自主提出新发明;
第 5 级则是“组织”——完全能够管理一家公司的人工智能。

推理能力:AI 从“聪明”到“碘伏”的关键
接受采访的研究人员一致认为,
推理是 AI 实现人类级乃至超人级智能的核心门槛
那么,到底什么是推理?在 AI 语境下,推理意味着模型能提前规划、反映物理世界的运行规律、并可靠地解决需要多步骤思考的复杂问题。而一旦攻克了推理,AI 就能从重大科学发现一直干到自动构建软件应用。
OpenAI CEO Sam Altman 今年早些时候就直言:“在人工智能领域,
最重要的进步将围绕推理能力展开
“草莓”如何破局?后训练与自我进化
知情人士透露,“草莓”正是 OpenAI 用来解决这些挑战的核心技术。路透社看到的文件描述了它想实现的目标,但并未说明具体实现方式。不过,多位消息人士给出了关键线索:
“草莓”采用了后训练(post-training)方法
后训练中最常见的做法是微调,比如让人类针对模型的输出进行反馈,或者给模型提供好答案和坏答案的样例。而“草莓”则与斯坦福大学 2022 年开发的
STaR(Self-Taught Reasoner)
Goodman 教授谈及“草莓”时感慨:“这让我既兴奋又恐惧……如果事情继续朝这个方向发展,人类恐怕得认真思考一些问题了。”
目标:长期任务与自主研究
“草莓”瞄准的一个重要功能是
执行长期任务(long-horizon tasks)
“deep-research”的数据集
CUA(computer-using agent)
这一切听起来像科幻小说,但别忘了,OpenAI 已经在私下向部分开发者暗示:具备更强推理能力的技术即将面世。无人知晓“草莓”究竟会在什么时候正式亮相,但可以确定的是,这场关于
推理
参考链接:
https://www.reuters.com/technology/artificial-intelligence/openai-working-new-reasoning-technology-under-code-name-strawberry-2024-07-12/
https://www.bloomberg.com/news/articles/2024-07-11/openai-sets-levels-to-track-progress-toward-superintelligent-ai
-
- 关于宇宙的好的网名有哪些
- 角色扮演 | 1
- 网名