当前位置:首页 > 科技  > 网络

全靠用户投票!GPT-4o、讯飞星火分列CompassArena大模型前二

来源: 责编: 时间:2024-08-02 15:52:30 502观看
导读 快科技8月2日消息,根据国内权威大模型评估平台OpenCompass(司南)近日公布的CompassArena周榜,GPT-4o和科大讯飞的星火大模型分别占据了排行榜的前两位。榜单采用专业用户投票方式,结合了用户对各款大模型的真实

快科技8月2日消息,根据国内权威大模型评估平台OpenCompass(司南)近日公布的CompassArena周榜,GPT-4o和科大讯飞的星火大模型分别占据了排行榜的前两位。7Ex28资讯网——每日最新资讯28at.com

榜单采用专业用户投票方式,结合了用户对各款大模型的真实体验,更具客观性和说服力,可谓是含金量十足。7Ex28资讯网——每日最新资讯28at.com

全靠用户投票!GPT-4o、讯飞星火分列CompassArena大模型前二7Ex28资讯网——每日最新资讯28at.com

OpenCompass的评测体系涵盖了学科、语言、知识、理解、推理等多个维度,能够全面评估大模型的综合能力。7Ex28资讯网——每日最新资讯28at.com

在新三期的评选中,讯飞星火以Elo-1078和Elo-1081的高分连续三周位列前三,并两次获得第二,显示出其在大模型领域的强劲竞争力。7Ex28资讯网——每日最新资讯28at.com

全靠用户投票!GPT-4o、讯飞星火分列CompassArena大模型前二7Ex28资讯网——每日最新资讯28at.com

值得注意的是,科大讯飞在今年6月27日发布的星火V4.0版本上,已完成了对GPT-4 Turbo的整体超越。7Ex28资讯网——每日最新资讯28at.com

根据八个国际主流测试集的横向评测,讯飞星火V4.0排名第一,在文本生成、语言理解、知识问答、逻辑推理、数学能力等方面完成了整体超越。7Ex28资讯网——每日最新资讯28at.com

此前,讯飞星火在《麻省理工科技评论》的横评中也获得了高分,凭借领先的语言能力、数学、理综等多项核心能力,斩获国产主流大模型榜首席位。7Ex28资讯网——每日最新资讯28at.com

目前,讯飞星火的安卓端APP累计下载量已超过1.31亿次,位列国内工具类通用大模型APP第一,持续领跑国内大模型第一梯队。7Ex28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-17-105358-0.html全靠用户投票!GPT-4o、讯飞星火分列CompassArena大模型前二

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 华为等国产品牌竞争力强!苹果市场下滑程度超预期

下一篇: 超大遥控车到手变迷你!微信严打视频号带货虚假宣传:严重者永封

标签:
  • 热门焦点
  • Mate60手机壳曝光 致敬自己的经典设计

    8月3日消息,今天下午博主数码闲聊站带来了华为Mate60的第三方手机壳图,可以让我们在真机发布之前看看这款华为全新旗舰的大致轮廓。从曝光的图片看,Mate 60背后摄像头面积依然
  • 对标苹果的灵动岛 华为带来实况窗功能

    继苹果的灵动岛之后,华为也在今天正式推出了“实况窗”功能。据今天鸿蒙OS 4.0的现场演示显示,华为的实况窗可以更高效的展现出实时通知,比如锁屏上就能看到外卖、打车、银行
  • 6月安卓手机性能榜:vivo/iQOO霸占旗舰排行榜前三

    2023年上半年已经正式过去了,我们也迎来了安兔兔V10版本,在新的骁龙8Gen3和天玑9300发布之前,性能榜的榜单大体会以骁龙8Gen2和天玑9200+为主,至于那颗3.36GHz的骁龙8Gen2领先
  • Automa-通过连接块来自动化你的浏览器

    1、前言通过浏览器插件可实现自动化脚本的录制与编写,具有代表性的工具就是:Selenium IDE、Katalon Recorder,对于简单的业务来说可快速实现自动化的上手工作。Selenium IDEKat
  • 自动化在DevOps中的力量:简化软件开发和交付

    自动化在DevOps中扮演着重要角色,它提升了DevOps的效能。通过自动化工具和方法,DevOps团队可以实现以下目标:消除手动和重复性任务。简化流程。在整个软件开发生命周期中实现更
  • Python异步IO编程的进程/线程通信实现

    这篇文章再讲3种方式,同时讲4中进程间通信的方式一、 Python 中线程间通信的实现方式共享变量共享变量是多个线程可以共同访问的变量。在Python中,可以使用threading模块中的L
  • Temu起诉SHEIN,跨境电商战事升级

    来源 | 伯虎财经(bohuFN)作者 | 陈平安日前据外媒报道,拼多多旗下跨境电商平台Temu正对竞争对手SHEIN提起新诉讼,诉状称Shein“利用市场支配力量强迫服装厂商与之签订独家
  • 造车两年股价跌六成,小米的估值逻辑变了吗?

    如果从小米官宣造车后的首个交易日起持有小米集团的股票,那么截至2023年上半年最后一个交易日,投资者将浮亏59.16%,同区间的恒生科技指数跌幅为52.78%
  • 外交部:美方应停止在网络安全问题上不负责任地指责他国

      中国外交部今天(16日)举行例行记者会。会上,有记者问,美国情报官员称,他们正在阻拦来自中国以及其他国家的黑客获取相关科研成果。 中方对此有何评论?对此
Top