2024ITValue-文章详情顶部

OpenAI发布最强推理模型o1,公司计划以1.07万亿估值进行新一轮融资|钛媒体AGI

“这是我们迄今为止功能最强大、最一致的模型系列 o1,也是迄今为止我们最好的推理模型。虽然o1仍然存在缺陷并有限,但使用时的感觉依然更加令人印象深刻。”OpenAI CEO表示。

北京时间9月13日凌晨,美国OpenAI公司发布全新模型技术产品o1,包括两种版本o1-preview 和 o1-mini,前者具有高级推理功能,在推理数学、编程、科学等问题的能力上有显著提高,性能接近理化生博士水平;后者则是一款更小巧、专为代码生成优化的模型。

这就是此前传言中高级推理能力强大模型的“Strawberry”项目。也有人分析称,o1是Orion大模型简称。

OpenAI表示,对于复杂推理任务而言,新模型代表着 AI 能力的崭新水平,因此值得将计数重置为1,给它一个有别于“GPT-4”系列的全新名号。同时,这也预示着,AI时代迎来崭新的起点——能够进行通用复杂推理的大模型重要到来。

需要注意的是,o1 目前的聊天体验还比较基础。不同于其前身 GPT-4o,o1 目前无法浏览网页或处理文件分析功能。尽管它具备图像分析功能,但该功能暂时关闭,等待进一步测试。此外,o1 还有消息量限制——目前 o1-preview 每周限额30条、o1-mini每周50条。

即日起,o1-preview 和 o1-mini两个版本已经在ChatGPT Plus/Team和API接口渠道上线,企业和教育用户将于下周初获得优先访问权限。

OpenAI CEO奥尔特曼(Sam Altman)表示,“这是我们迄今为止功能最强大、最一致的模型系列 o1,也是迄今为止我们最好的推理模型。虽然o1仍然存在缺陷并有限,但使用时的感觉依然更加令人印象深刻。”

具体来看,OpenAI o1可以解决比以前GPT时期的科学、编码和数学模型更难的问题。

OpenAI的研究负责人Jerry Tworek透露,o1模型背后的训练与之前的产品有着根本性的区别。之前的GPT模型旨在模仿其训练数据中的模式,而o1的训练旨在让其独立解决问题。在强化学习的过程中,使用奖励和惩罚机制来“教育”AI使用“思维链”来处理问题,就像人类习得拆解、分析问题的方式一样。

o1上线之后,现在ChatGPT可以在回答问题前先仔细思考,而不是立即脱口而出答案。就像人类大脑的系统 1 和系统 2,ChatGPT 已经从仅使用系统 1(快速、自动、直观、易出错)进化到了可使用系统 2 思维(缓慢、深思熟虑、有意识、可靠)。这让它能够解决以前无法解决的问题。

所谓推理大模型,就是AI会在回答之前花更多时间进行思考,就像人类思考解决问题的过程一样,而非预测单词生成的序列。比如通过文字点开AI思考的过程,还会出现AI表示“我在思考这个事情这么做行不行”、“啊时间不够了得尽快给出答案”等。OpenAI确认,这里展示的并不是原始的思维链,而是“模型生成的摘要”,公司也坦率承认这里有保持“竞争优势”的因素。

根据测试,在国际数学奥林匹克(IMO)资格考试中,GPT-4o 仅正确解答了 13% 的问题,而 o1 模型正确解答了 83% 的问题。而在编程能力比赛Codeforces中,o1模型拿到89%百分位的成绩,而GPT-4o只有11%。

OpenAI 发现,随着更多的强化学习(训练时计算)和更多的思考时间(测试时计算),o1 的性能持续提高。而且扩展这种方法的限制与大模型预训练的限制有很大不同,OpenAI 也还在继续研究。

OpenAI技术文件称,实验结果表明:o1 超越了人类专家的表现,性能接近理科博士水平,成为第一个在该基准测试中做到这一点的模型。而在下一个更新的版本中,AI在物理、化学和生物学的挑战性基准测试中,表现能够与博士生水平类似。

除了OpenAI o1-preview外,OpenAI今晨也同步推出了o1-mini模型,更快、更便宜,定价也比preview版本降低了80%,适用于需要推理但不需要广泛世界知识的场景。

很显然,尽管新的OpenAI o1还不具备更全面问题解决能力,但显著提升的推理能力使其在科学、编程、数学等专业领域具备了更大的用途,以及 AI Agent 相关技术的下限和上限被整体拉高,大幅提升科学研究和生产端的能力,对于消费端来说意义不算太大。

英伟达首席科学家Jim Fan表示,新的o1需要消耗更大的算力和数据,并且能够形成数据飞轮效应,正确的答案及其思考过程可以成为很好的训练数据。从而不断改进推理核心,类似AlphaGo的价值网络随着MCTS生成更多精炼数据而改进。

天风国际称,OpenAI o1系列模型大幅增强推理能力,并宣布新的Scaling范式:通过RL解锁Test time compute(推理时间)。

此外,9月11日彭博社报道称,OpenAI正在商谈以1500亿美元(约合10675.35亿元,1.07万亿元)的估值进行新一轮融资,有望从投资者那里筹集65亿美元,投资方包括苹果、英伟达、微软等。同时,OpenAI还在谈判以循环信贷安排的形式从银行借款50亿美元。

成立于2015年的OpenAI,一直处于科技行业向 AI 快速转变的中心,其发布的聊天机器人产品ChatGPT于2022年首次亮相,引发全球 AI 投资热潮。OpenAI首席财务官Sarah Friar近日在内部备忘录中表示,新一轮融资将支持公司对计算能力和其他运营费用的需求。她强调,该公司的目标是允许员工在今年晚些时候的收购要约中出售部分股份。

(本文首发于钛媒体App,作者|林志佳,编辑|胡润峰)

转载请注明出处、作者和本文链接
声明:文章内容仅供参考、交流、学习、不构成投资建议。
想和千万钛媒体用户分享你的新奇观点和发现,点击这里投稿 。创业或融资寻求报道,点击这里

敬原创,有钛度,得赞赏

赞赏支持
发表评论
0 / 300

根据《网络安全法》实名制要求,请绑定手机号后发表评论

登录后输入评论内容

快报

更多

15:51

人社部:领取养老金的最低缴费年限从15年逐步提高至20年,突出两方面政策

15:47

人社部:可弹性提前或者延后退休,最长不超过3年

15:46

人社部:调整法定退休年龄是一个渐进的过程

15:43

国家主席习近平签署主席令,在中华人民共和国成立七十五周年之际授予15人国家勋章和国家荣誉称号

15:41

上交所发布《ETF投资交易白皮书(2024年上半年)》

15:40

春秋航空:8月旅客周转量同比增长9.80%

15:39

人社部:渐进式延迟法定退休年龄主要任务有三个方面

15:38

中国社会保障学会副会长金维刚:延迟退休改革不强制要求每个人必须达到新的法定退休年龄才能退休

15:35

国家药监局:将创新药临床试验审评审批时限由60个工作日缩短至30个工作日

15:29

上海市政府近日发布一组人事任免信息:黄斌兵任市国资委副主任

15:23

长三角铁路中秋小长假运输方案出台,5天预计发送旅客逾1500万人次

15:22

2024年人均基本公共卫生服务经费补助标准增至94元

15:21

欧洲央行管委维勒鲁瓦:欧洲央行应继续酌情逐步降息

15:20

怎么查自己的法定退休年龄?“法定退休年龄计算器”上线

15:19

2023年末我国A股市场高端制造业上市公司共计2445家

15:19

人社部:延迟退休方案设计有四个特点

15:18

预告:全国人大常委会办公厅就延迟法定退休年龄改革有关情况举行新闻发布会

15:17

国债期货收盘集体上涨,30年期主力合约涨0.7%

15:13

国防教育法完成修订,将于9月21日起施行

15:12

沪深两市今日成交额合计5248亿元,贵州茅台成交额居首

扫描下载App

Baidu
map