2024-09-13 OpenAI新模型逼近博士水平
梦晨 衡宇 发自 凹非寺
量子位 | 公众号 QbitAI
来了来了!刚刚,OpenAI新模型无预警上新:
o1系列
在解决 博士水平的物理问题 92.8分
没错,传说中的「草莓」,终于来与大家见面了!
CEO奥特曼称它是一种 新范式的开始
具体来说,o1系列是OpenAI首个经过强化学习训练的模型, 在输出回答之前,会在产生一个很长的思维链
换句话说,内部思维链越长,o1思考得越久,模型在推理任务上的表现就越好。
o1有多强呢?CEO奥特曼直给了答案:
在刚刚结束的 2024 IOI信息学奥赛
如果允许它每道题尝试10000次,就能获得362.14分, 高于金牌选手门槛,可获得金牌
另外它还在 竞争性编程问题 美国数学奥林匹克
与GPT-4o相比,o1在 数理化生、英语法律经济
汇总官方发布的各种消息来看,这次突然发布的o1系列又分为三个型号:
o1
o1-preiview 可以立即提供给ChatGPT付费用户和API用户
o1-mini
不少OpenAI员工都分别用“系统1”和“系统2”思考来科普o1系列与之前模型的区别。
连长期休假中的总裁白熊资讯网Brockman都“诈尸”回归了。
思维链提示方法的原作者Jason Wei表示,这一次不是纯粹通过提示来完成思维链,而是使用强化学习训练模型以更好地执行链式思考。
在深度学习的历史中,人们一直试图扩展训练阶段的计算,但思维链是自适应计算的一种形式,现在也可以在推理时扩展。
新模型做了很多类似人类的事情,比如将棘手的步骤分解为更简单的步骤、识别和纠正错误以及尝试不同的方法。
游戏已被完全重新定义。
o1:AI能力新天花板
通过训练,o1模型学会完善自己的思维过程,尝试不同的策略,并认识到自己的错误。
不过作为早期模型,它尚不具备ChatGPT的许多有用功能,例如联网搜索以及上传文件和图像www.czybx.com。
但对于复杂的推理任务来说,这是一个重大进步,OpenAI称代表了人工智能的最高水平。
鉴于此,他们决定 将计数器重置,并将该系列模型命名为OpenAI o1
随着更多的强化学习(训练时计算)和更多的思考时间(测试时计算),o1 的性能持续提高, 新的Scaling Law诞生了
不过这种方法的Scaling受到的限制与普通预训练有很大不同,OpenAI正在继续研究它们。
o1思考起来是什么样子?可以从官网示例中的编写Bash脚本的编程任务一窥究竟。
首先作为对比, GPT-4o会直接就开始写代码,遗憾得到错误结果
而o1-preiview会先用自己的理解 复述一遍要求 拆解要求 明确最终目标
接下来它会给自己 定义任务 分析限制条件 列出需要用到的方法
进一步把 任务拆解
最后才动手编写代码,并保证一次性得到正确结果。
OpenAI表示,o1系列可以帮医疗保健研究人员来注释细胞测序数据,帮助物理学家可以生成量子光学所白熊资讯网需的复杂数学公式,所有领域的开发人员可以使用o1来构建和执行多步骤工作流程。
而且不是说说而已,OpenAI已经邀请相关的人类专家学者试用了一波。
马克思普朗克研究所的量子物理学者 Mario Krenn
除了考试和学术基准之外,团队还评估了人们对o1-preview与GPT-4o在开放问题上的偏好。
在数据分析、编码和数白熊资讯网学等推理密集型类别中,o1-preview明显优于gpt-4o。
然而o1-preview在某些自然语言任务上并不是首选,这表明它并不适合所有场景。
OpenAI科学家Noam Brown分享了更详细的个人测试结果。
在上个月的ACL会议上有一个所有当时大模型都无法解决的逻辑难题。o1-preview能够做对,o1满血版几乎每次尝试都能做对。
目前o1花费在思考上的时间是几秒到十几秒,但OpenAI未来的改进方向不是缩短,反而是努力增加这个时间,
目标是让未来的版本思考几个小时、几天甚至几周。
推理成本会更高,但你会为一种新的抗癌药物付多少钱?为了电池的突破、黎曼猜想的证明又付多少?
人工智能可以不仅仅是聊天机器人
谁可以访问o1?
根据OpenAI官方说法,ChatGPT Plus和Team用户最早可在几个小时内可以体验到o1系列模型。
在发布时,o1-preview限制为每周30条消息,o1-mini每周50条。
API访问权限将首先给Tier 5级用户,也就是已经在OpenAI API上花费超过1000美元的人。
OpenAI正在努力提高这些速率,并使ChatGPT能够针对给定的提示自动选择合适的模型。
快打开ChatGPT看看你是不是第一波吃草莓的人吧。
参考链接:
httpswww.czybx.com://openai.com/o1/
https://x.com/polynoamial/status/1834280155730043108
— 完 —
量子位 QbitAI 头条号签约
关注我们,第一时间获知前沿科技动态
内容版权声明:除非注明原创否则皆为转载,再次转载请注明出处。