当前位置:首页 > 科技  > 网络

OpenAI并未让DeepSeek惊出一身冷汗

来源: 责编: 时间:2025-04-18 06:48:34 238观看
导读 “OpenAI的创新好像到瓶颈期了。”一位业界人士这样说道。今日凌晨,预热了很久的OpenAI o3模型完整版终于面世,且与以往直播“挤牙膏”式的依次、慢吞发布方式不同的是,这次o3和o4-mini是

“OpenAI的创新好像到瓶颈期了。”一位业界人士这样说道。av828资讯网——每日最新资讯28at.com

今日凌晨,预热了很久的OpenAI o3模型完整版终于面世,且与以往直播“挤牙膏”式的依次、慢吞发布方式不同的是,这次o3和o4-mini是同时发布。av828资讯网——每日最新资讯28at.com

在OpenAI官方的陈述中,o3和o4-mini的亮点主要在于可以组合调用ChatGPT中的各个工具,像是网络搜索、Python、图像分析、文件解释和图像生成等。这可以看作是OpenAI开始后发补足自身在Agent能力上的探索。av828资讯网——每日最新资讯28at.com

其中,o3作为推理模型,在编程、数学、科学、视觉感知等多个维度的基准测试中都刷新了纪录。比如在Codeforces、SWE-bench、MMMU基准测试中,视觉任务准确率高达87.5%,而MathVista达到75.4%。av828资讯网——每日最新资讯28at.com

其实分数、榜单,这些都是常规操作。相较于以往,这次的大不同在于,o3和o4-mini将上传的图像直接集中到思维链中,这就意味着,图像不仅仅是被看到,还能被用来作为思考过程中的一部分。av828资讯网——每日最新资讯28at.com

从OpenAI团队成员、中科大校友Jiahui Yu发布的帖文来看,“用图像思考”应该是OpenAI去年9月发布o系列模型以来,就在研发计划中,之前还悄悄推出了o1 Vision并进行了初步预览,但并没有取得很好的效果,也没有引起关注,直到这次在o3和o4-mini上实现了这一能力。av828资讯网——每日最新资讯28at.com

根据外部专家评估,o3作为o1系列模型的继任者,其在复杂问题上的错误率要比后者低20%,适合在生物学、数学和工程领域的复杂问题查询。av828资讯网——每日最新资讯28at.com

针对这一点,国外一位医学博士在测评后发帖表示,这一点确实有很大进步,当他向o3来提问一些颇具挑战性的临床或医学问题时,回答精准、全面,符合对一位该领域真正专家的期望。av828资讯网——每日最新资讯28at.com

对于那些想亲自测评、体验的用户来说,OpenAI官方已经表示,目前ChatGPT的Plus、Pro会员以及Team用户,即日起就可以直接体验o3、o4-mini,以及o4-mini-high,而之前的o1、o3-mini和o3-mini-high已默默退出舞台。这一操作也被有些网友戏称为“内部赛马”,新的产品出来后,之前的通通让路。av828资讯网——每日最新资讯28at.com

到目前为止,之前预告要发布的GPT?4.1全家桶系列、o3、o4-mini模型就已经全部亮相展示了。据Sam Altman表示,o3和o4-mini可能是ChatGPT在GPT-5发布之前的后独立AI推理模型了,期间大概率是不会再有其他新款模型出来了,另外他也说了,预计将在几周内将o3-pro升级到专业版。av828资讯网——每日最新资讯28at.com

在OpenAI官方的宣传口径中,o3和o4-mini是OpenAI所有模型中为强大、智能的模型,一些开发者、用户在使用时,也感受到了进步。但是,创新能力似乎并没有达到预期。av828资讯网——每日最新资讯28at.com

“OpenAI的步调已经不再挺胸阔步了,更不知所措。”在看完OpenAI这次发布的新品后,一位业内人士这样感叹道。av828资讯网——每日最新资讯28at.com

虽然o3、o4-mini模型作为新产品,效果不错,但相较于OpenAI以往的激进和高举旗帜式前进,如今在创新上面呈现出明显的心有余而力不足。av828资讯网——每日最新资讯28at.com

其实前两天在GPT4.1系列套餐发布后,不少业内人士就向虎嗅表示,“暂时还没看到有什么特别亮眼的突破。”“对o3期待值没有那么高。”av828资讯网——每日最新资讯28at.com

或者这种“失望”要来得更早一点。av828资讯网——每日最新资讯28at.com

去年12月,o3在OpenAI的系列直播尾声亮相,Sam Altman称其为“一个非常、非常聪明的模型”,完全将O1甩在身后,更是在ARC-AGI测试这一旨在评估AI系统适应新任务和展示流动智力能力的测试中,获得87.5%的成绩,也是首次超越人类平均水平(85%),令业界感到震惊,被认为是在通往AGI的道路上迎来了新突破。但在业界开发者看来,似乎并不是这样。av828资讯网——每日最新资讯28at.com

“这就好比高考成绩不能代表工作业务能力。”一位开源领域人士锐评道。而且,如今的行业趋势已经进入到对数据高要求、对Agent全适配方向中,这就意味着私有化和混合模型推理为主的时代到来了。但是OpenAI对于开源的态度,众所周知。av828资讯网——每日最新资讯28at.com

尤其是在年初,当DeepSeek-R1凭借着超低的训练成本和性能媲美o1精彩亮相时,无疑是给了OpenAI一记响亮的耳光,而DeepSeek的全方位、无死角开源,像是又给了OpenAI再一记更响亮的耳光。av828资讯网——每日最新资讯28at.com

之后,这两记耳光不仅打得OpenAI黯然失色,还乱了它的阵脚和节奏,模型命名混乱、功能创新不足、尝试开源但态度暧昧不明,再加上内部人员高频流失,等等,无疑正在让它慢慢失去竞争优势,再不复一年之前被视为通往AGI的正确的、领先的道路引领者角色……av828资讯网——每日最新资讯28at.com

而官方也说了,此次发布的GPT4.1系列、o3,以及o4-mini是GPT-5正式发布前的后一次模型发布了,也被视为GPT-5时刻的关键一步,可以理解为是GPT-5的前菜,主打“量大管饱”。但是,在技术的攀登道路上,量变能够引起质变并非唯一真理,更何况,这个量还远远不足。av828资讯网——每日最新资讯28at.com

“GPT-5应该是多个GPT4.1组成的吧。”一位业内人士这样戏谑道,一直传GPT-5或将在5月发布,到底OpenAI还能不能重回巅峰,只有到时候揭晓了。av828资讯网——每日最新资讯28at.com

OpenAI并未让DeepSeek惊出一身冷汗av828资讯网——每日最新资讯28at.com


文章出处:虎嗅网

本文链接:http://www.28at.com/showinfo-17-145040-0.htmlOpenAI并未让DeepSeek惊出一身冷汗

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: “反马斯克”情绪高涨 特斯拉失守加州

下一篇: 贾跃亭:再次被恶意做空者盯上 将打赢梦想实现战

标签:
  • 热门焦点
  • 一加首款折叠屏!一加Open渲染图出炉:罕见单手可握小尺寸

    8月5日消息,此前就有爆料称,一加首款折叠屏手机将会在第三季度上市,如今随着时间临近,新机的各种消息也开始浮出水面。据悉,这款新机将会被命名为“On
  • JavaScript 混淆及反混淆代码工具

    介绍在我们开始学习反混淆之前,我们首先要了解一下代码混淆。如果不了解代码是如何混淆的,我们可能无法成功对代码进行反混淆,尤其是使用自定义混淆器对其进行混淆时。什么是混
  • 十个可以手动编写的 JavaScript 数组 API

    JavaScript 中有很多API,使用得当,会很方便,省力不少。 你知道它的原理吗? 今天这篇文章,我们将对它们进行一次小总结。现在开始吧。1.forEach()forEach()用于遍历数组接收一参
  • Golang 中的 io 包详解:组合接口

    io.ReadWriter// ReadWriter is the interface that groups the basic Read and Write methods.type ReadWriter interface { Reader Writer}是对Reader和Writer接口的组合,
  • 三言两语说透设计模式的艺术-单例模式

    写在前面单例模式是一种常用的软件设计模式,它所创建的对象只有一个实例,且该实例易于被外界访问。单例对象由于只有一个实例,所以它可以方便地被系统中的其他对象共享,从而减少
  • 如何使用JavaScript创建一只图像放大镜?

    译者 | 布加迪审校 | 重楼如果您曾经浏览过购物网站,可能遇到过图像放大功能。它可以让您放大图像的特定区域,以便浏览。结合这个小小的重要功能可以大大改善您网站的用户体验
  • 一条抖音4亿人围观 ! 这家MCN比无忧传媒还野

    作者:Hiu 来源:互联网品牌官01 擦边少女空降热搜,幕后推手曝光被网友誉为“纯欲天花板”的女网红井川里予,近期因为一组哥特风照片登上热搜,引发了一场互联网世界关于
  • 阿里大调整

    来源:产品刘有媒体报道称,近期淘宝天猫集团启动了近年来最大的人力制度改革,涉及员工绩效、层级体系等多个核心事项,目前已形成一个初步的“征求意见版”:1、取消P序列
  • 微博大门常打开,迎接海外画师漂洋东渡

    作者:互联网那些事“起猛了,我能看得懂日语了”。“为什么日本人说话我能听懂?”“中文不像中文,日语不像日语,但是我竟然看懂了”…&hell
Top