白熊资讯网 - 娱乐资讯_女性资讯_母婴健康_情感文章_百科知识_星座运势

手机版

二维码访问手机版

2024-09-13 OpenAI新模型逼近博士水平

日期：2024-09-13 03:33:04 来源：量子位浏览：331次栏目：热点

梦晨衡宇发自凹非寺
量子位 | 公众号 QbitAI

来了来了！刚刚，OpenAI新模型无预警上新：

o1系列

，可以进行通用复杂推理，每次回答要花费更长时间思考。

在解决

博士水平的物理问题

时，GPT-4o还是“不及格”59.5分，o1一跃来到“优秀档”，直接干到92.8分
！

没错，传说中的「草莓」，终于来与大家见面了！

OpenAI新模型逼近博士水平

CEO奥特曼称它是一种

新范式的开始

：可以进行通用复杂推理的人工智能。

OpenAI新模型逼近博士水平

具体来说，o1系列是OpenAI首个经过强化学习训练的模型，

在输出回答之前，会在产生一个很长的思维链

，以此增强模型的能力。

换句话说，内部思维链越长，o1思考得越久，模型在推理任务上的表现就越好。

o1有多强呢？CEO奥特曼直给了答案：

在刚刚结束的

2024 IOI信息学奥赛

题目中，o1的微调版本在每题尝试50次条件下取得了213分，属于人类选手中前49%的成绩。

如果允许它每道题尝试10000次，就能获得362.14分，

高于金牌选手门槛，可获得金牌

。

OpenAI新模型逼近博士水平

另外它还在

竞争性编程问题

(Codeforces) 中排名前89%，在美国数学奥林匹克
(AIME) 预选赛题目中跻身美国前500名学生之列。

OpenAI新模型逼近博士水平

与GPT-4o相比，o1在

数理化生、英语法律经济

等各种科目都有不同成绩改进。

OpenAI新模型逼近博士水平

汇总官方发布的各种消息来看，这次突然发布的o1系列又分为三个型号：

o1

，新的大模型天花板，过于强大目前不方便对外公开。

o1-preiview

，o1的早期版本，可以立即提供给ChatGPT付费用户和API用户
。

o1-mini

，速度更快、性价比更高，适用于需要推理和无需广泛世界知识的任务。

不少OpenAI员工都分别用“系统1”和“系统2”思考来科普o1系列与之前模型的区别。

连长期休假中的总裁白熊资讯网Brockman都“诈尸”回归了。

OpenAI新模型逼近博士水平

思维链提示方法的原作者Jason Wei表示，这一次不是纯粹通过提示来完成思维链，而是使用强化学习训练模型以更好地执行链式思考。

在深度学习的历史中，人们一直试图扩展训练阶段的计算，但思维链是自适应计算的一种形式，现在也可以在推理时扩展。

新模型做了很多类似人类的事情，比如将棘手的步骤分解为更简单的步骤、识别和纠正错误以及尝试不同的方法。
游戏已被完全重新定义。

OpenAI新模型逼近博士水平

o1：AI能力新天花板

通过训练，o1模型学会完善自己的思维过程，尝试不同的策略，并认识到自己的错误。

不过作为早期模型，它尚不具备ChatGPT的许多有用功能，例如联网搜索以及上传文件和图像www.czybx.com。

但对于复杂的推理任务来说，这是一个重大进步，OpenAI称代表了人工智能的最高水平。

鉴于此，他们决定

将计数器重置，并将该系列模型命名为OpenAI o1

。

随着更多的强化学习（训练时计算）和更多的思考时间（测试时计算），o1 的性能持续提高，

新的Scaling Law诞生了

。

不过这种方法的Scaling受到的限制与普通预训练有很大不同，OpenAI正在继续研究它们。

OpenAI新模型逼近博士水平

o1思考起来是什么样子？可以从官网示例中的编写Bash脚本的编程任务一窥究竟。

首先作为对比，

GPT-4o会直接就开始写代码，遗憾得到错误结果

。

OpenAI新模型逼近博士水平

而o1-preiview会先用自己的理解

复述一遍要求

，然后开始拆解要求
，明确最终目标
。

OpenAI新模型逼近博士水平

接下来它会给自己

定义任务

、分析限制条件
、列出需要用到的方法
。

OpenAI新模型逼近博士水平

进一步把

任务拆解

成明确的数个小步骤。

OpenAI新模型逼近博士水平

最后才动手编写代码，并保证一次性得到正确结果。

OpenAI新模型逼近博士水平

OpenAI表示，o1系列可以帮医疗保健研究人员来注释细胞测序数据，帮助物理学家可以生成量子光学所白熊资讯网需的复杂数学公式，所有领域的开发人员可以使用o1来构建和执行多步骤工作流程。

而且不是说说而已，OpenAI已经邀请相关的人类专家学者试用了一波。

马克思普朗克研究所的量子物理学者

Mario Krenn

，展示了GPT-4o不能回答但o1-preview正确完成计算的复杂量子物理问题。

OpenAI新模型逼近博士水平

除了考试和学术基准之外，团队还评估了人们对o1-preview与GPT-4o在开放问题上的偏好。

在数据分析、编码和数白熊资讯网学等推理密集型类别中，o1-preview明显优于gpt-4o。

然而o1-preview在某些自然语言任务上并不是首选，这表明它并不适合所有场景。

OpenAI新模型逼近博士水平

OpenAI科学家Noam Brown分享了更详细的个人测试结果。

在上个月的ACL会议上有一个所有当时大模型都无法解决的逻辑难题。o1-preview能够做对，o1满血版几乎每次尝试都能做对。

OpenAI新模型逼近博士水平

目前o1花费在思考上的时间是几秒到十几秒，但OpenAI未来的改进方向不是缩短，反而是努力增加这个时间，

目标是让未来的版本思考几个小时、几天甚至几周。
推理成本会更高，但你会为一种新的抗癌药物付多少钱？为了电池的突破、黎曼猜想的证明又付多少？
人工智能可以不仅仅是聊天机器人

OpenAI新模型逼近博士水平

谁可以访问o1？

根据OpenAI官方说法，ChatGPT Plus和Team用户最早可在几个小时内可以体验到o1系列模型。

在发布时，o1-preview限制为每周30条消息，o1-mini每周50条。

API访问权限将首先给Tier 5级用户，也就是已经在OpenAI API上花费超过1000美元的人。

OpenAI新模型逼近博士水平

OpenAI正在努力提高这些速率，并使ChatGPT能够针对给定的提示自动选择合适的模型。

快打开ChatGPT看看你是不是第一波吃草莓的人吧。

参考链接：

httpswww.czybx.com://openai.com/o1/

https://x.com/polynoamial/status/1834280155730043108

— 完 —

量子位 QbitAI 头条号签约

关注我们，第一时间获知前沿科技动态

内容版权声明：除非注明原创否则皆为转载，再次转载请注明出处。

文章标题: 2024-09-13 OpenAI新模型逼近博士水平

文章地址: www.czybx.com/redian/473882.html

标签OpenAI新模型逼近博士水平

上一篇：2024-09-13 杨文吉：为何欠薪的球队不受罚下一篇：2024-09-13 丽江机场通报“工作人员辱骂旅客”

相关文章

2024-09-14 父亲为35岁女儿捐肾

父亲为35岁女儿捐肾...
2024-09-14 11:56:33父亲为35岁女儿捐肾
2024-09-09 曝台风过后海南大学强行复课

曝台风过后海南大学强行复课...
2024-09-09 12:08:17曝台风过后海南大学强行复课
2024-09-14 男子照顾脑梗好友近10个月一起过中秋

男子照顾脑梗好友近10个月一起过中秋...
2024-09-14 22:01:15男子照顾脑梗好友近10个月一起过中秋
2024-09-14 阿里云盘惊现bug：可看他人照片

微信公众号“非法加冯”报道，据网络消息，阿里云盘曝出史诗级BUG，可以看到其他用户云盘图片。。目前流传的聊天记录显示：在阿里云盘相册中新建个文件夹，分类选择图片，就可以看到其他用户云盘图片。复现视...
2024-09-14 21:36:37阿里云盘惊现bug：可看他人照片
2024-09-14 我国半导体核心技术又获新进展

我国半导体核心技术又获新进展...
2024-09-14 15:07:34我国半导体核心技术又获新进展
2024-09-14 我国卫生健康事业发展取得积极成效

国务院新闻办12日举行“推动高质量发展”系列主题新闻发布会，介绍推动卫生健康事业高质量发展有关情况。国家卫生健康委相关负责人介绍，我国人均基本公共卫生服务经费从2009年的15元提升至今年的94元。近...
2024-09-14 19:59:10我国卫生健康事业发展取得积极成效
2024-09-12 直击SpaceX首次商业太空行走

美国太空探索技术公司11日表示，该公司“龙”飞船携“北极星黎明”任务团队当日到达了距离地球超过1400公里的远地点，这是自50多年前阿波罗计划结束以来，人类太空旅行到达的最远位置。当地时间9月10日，...
2024-09-12 16:20:49直击SpaceX首次商业太空行走
2024-09-10 任骏威新赛季加入深圳男篮教练组

直播吧9月10日讯近日，CBA官网更新部分球队教练名单。其中，深圳男篮新赛季主教练为周鹏，任骏威加入教练组，他将和于淑龙共同担任助教。任骏威上赛季代表上海男篮出战42场比赛，场均23.8分钟，得到5...
2024-09-10 09:18:22任骏威新赛季加入深圳男篮教练组
2024-09-11 海口市民为席地而睡的救援官兵送水

海口市民为席地而睡的救援官兵送水...
2024-09-11 10:11:15海口市民为席地而睡的救援官兵送水
2024-09-10 漠河开始供暖了

近期，黑龙江漠河市气温日渐走低，最低气温降至0℃以下。今天，当地供热部门正式对全市居民开栓供暖，比计划开栓时间提前15天。漠河地处我国最北部，冬季漫长寒冷，最低气温曾达到-50℃左右。当地供暖时间将持...
2024-09-10 16:33:10漠河开始供暖了