最新全球模型榜单:阿里Qwen2.5-Max超DeepSeek V3!又一国产大模型海外出圈!
2025年02月04日 19:11
来源: 财联社
6人评论
24
34
东方财富APP
Scan me!

方便,快捷

手机查看财经快讯

专业,丰富

一手掌握市场脉搏

手机上阅读文章
Scan me!

提示:

微信扫一扫

分享到您的

朋友圈

  在东方财富看资讯行情,选东方财富证券一站式开户交易>>

  今日(2月4日)凌晨,Chatbot Arena LLM Leaderboard更新了最新一期的榜单,不久前发布的Qwen2.5-Max直接冲进前十,超越DeepSeek V3, o1-mini和Claude-3.5-Sonnet等模型,以1332分位列全球第七名!同时,Qwen2.5-Max在数学和编程上排名第一,在Hard prompts方面排名第二。

image
image

  Qwen-Max是阿里云通义团队对MoE模型的最新探索成果,新模型展现出极强劲的综合性能。在Arena-Hard、LiveBench、LiveCodeBench、GPQA-Diamond及MMLU-Pro等主流基准测试中,Qwen2.5-Max比肩Claude-3.5-Sonnet,并几乎全面超越了GPT-4o、DeepSeek-V3及Llama-3.1-405B。

  ChatBot Arena官方账号 lmarena.ai 对其评价称,阿里巴巴的Qwen2.5-Max在多个领域表现强劲,特别是在专业技术向的(编程、数学、有难度的提示词等)方面。

  据了解,Chatbot Arena是由LMSYS Org推出的大模型性能测试平台,目前集成了190多种模型。该榜单采用匿名方式将大模型两两组队,交给用户进行盲测,用户根据真实对话体验对模型能力进行投票。因此Chatbot Arena LLM Leaderboard成为全球顶级大模型的最重要竞技场。

  此前,Qwen2.5-72B-Instruct发布后也曾闯入Chatbot Arena榜单全球前十,是得分较高的中国大模型;Qwen2-VL-72B-Instruct闯入Vision榜单第九,是成绩优异的开源模型。

  目前,企业可在阿里云百炼调用Qwen2.5-Max模型的API,开发者也可在Qwen Chat平台中免费体验Qwen2.5-Max。

  Qwen2.5-Max发布后,在海外开发者中引发了大量关注。有网友在对比DeepSeek-V3 和 Qwen 2.5后,高度赞扬了Qwen2.5-Max的出色表现。

image

  还有网友打趣地为OpenAI的首席执行官Sam Altman担忧:又一个中国模型来了

image

  不少海外网友表示,中国新模型的迭代速度和质量令人惊艳。

image
image

  作为国内较早开源自研大模型的科技大厂,阿里云旗下的通义千问已实现全尺寸、全模态的开源,推出了包括语言大模型、多模态大模型等多种类型的开源模型。

  在全球范围内,Qwen的衍生模型数量超9万个,已超越Llama成为全球更大的开源模型群。此次Qwen2.5-max的发布,亦备受全球各种语言的开发者的欢迎。

  “有了Qwen2.5-max,我们能对ChatGPT说再见了?!”有使用阿拉伯语的网友如是说。

image

  多名海外网友用英文表达了对Qwen2.5-max极致性能的惊叹。

image
image
image

  通义团队方面表示,持续提升数据规模和模型参数规模能够有效提升模型的智能水平。通义团队对下一个版本的Qwen2.5-Max充满信心,也将持续探索,除了在预训练的scaling 上继续探索外,还将大力投入强化学习的scaling,希望能实现超越人类的智能,驱动AI探索未知之境。

  全新妙想投研助理,立即体验

(文章来源:财联社)

文章来源:财联社 责任编辑:65
原标题:最新全球模型榜单:阿里Qwen2.5-Max超DeepSeek V3!又一国产大模型海外出圈!
郑重声明:东方财富发布此内容旨在传播更多信息,与本站立场无关,不构成投资建议。据此操作,风险自担。
举报
分享到微信朋友圈
Scan me!

打开微信,

点击底部的“发现”

使用“扫一扫”

即可将网页分享至朋友圈

扫描二维码关注

东方财富官网微信

还可输入
清除
提交评论
郑重声明: 1.根据《证券法》规定,禁止编造、传播虚假信息或者误导性信息,扰乱证券市场;2.用户在本社区发表的所有资料、言论等仅代表个人观点,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决定证券投资并承担相应风险。 《东方财富社区管理规定》
热门评论 查看全部评论
全部评论
最新 最热 最早
2025-02-04 22:52:12 来自 广东
[赞]
置顶 删除 举报 评论 点赞
2025-02-04 19:57:19 来自 湖南
早干嘛去了?这回一个比一个厉害了么?
置顶 删除 举报 评论 4
基民ozOQms : 阿里的开源大模型国内第一,之前就是,只是你不了解罢了
2025-02-05 08:47:10 来自 北京
删除 举报 评论 点赞
DP532PU : 傻了?
2025-02-04 20:02:53 来自 山东
删除 举报 评论 点赞
2025-02-04 19:36:15 来自 北京
华为咋落后人工智能???
置顶 删除 举报 评论 点赞

扫一扫下载APP

扫一扫下载APP
信息网络传播视听节目许可证:0908328号 经营证券期货业务许可证编号:913101046312860336 违法和不良信息举报:021-61278686 举报邮箱:jubao@eastmoney.com
沪ICP证:沪B2-20070217 网站备案号:沪ICP备05006054号-11 沪公网安备 31010402000120号 版权所有:东方财富网 意见与建议:4000300059/952500
搜索
复制