文章来源:放心AI网发布时间:2025-04-18 12:17:07
2025年3月3日,通义灵码宣布上线其最新推理模型Qwen2.5-Max,为开发者带来强大的编程和数学能力支持。Qwen2.5-Max使用了超过20万亿token的预训练数据,并结合精心设计的后训练方案,展现出卓越的性能。
在多项基准测试中,Qwen2.5-Max表现突出。例如,在Arena-Hard、LiveBench、LiveCodeBench和GPQA-Diamond等测试中,Qwen2.5-Max的成绩领先于业界其他领先模型,包括DeepSeek V3、GPT-4o和Claude-3.5-Sonnet。此外,在MMLU-Pro等评估中,Qwen2.5-Max也展现了极具竞争力的成绩。
在基座模型的对比中,Qwen2.5-Max与DeepSeek V3、Llama-3.1-405B以及Qwen2.5-72B等模型进行了全面比较。结果显示,通义千问的基座模型在多数基准测试中都展现出显著优势。
值得注意的是,三方基准测试平台Chatbot Arena公布的最新大模型盲测榜单中,Qwen2.5-Max超越了DeepSeek-V3、Open AI o1-mini和Claude-3.5-Sonnet等模型,以1332分位列全球第七名,成为中国非推理类大模型的冠军。在数学和编程等单项能力上,Qwen2.5-Max排名第一,硬提示(Hard prompts)能力排名第二。Chatbot Arena官方评价称,阿里巴巴的Qwen2.5-Max在多个领域表现强劲,尤其是在编程、数学和硬提示等专业技术领域。
目前,Qwen2.5-Max已经集成到通义灵码中,用户可以通过下载通义灵码插件来体验其强大的编程能力。
相关攻略 更多
最新资讯 更多
OpenAI几周内发布o3-mini,性能略逊于o1-pro
更新时间:2025-05-06
Runway推全新AI图像生成器Frames,打造电影级视觉表现
更新时间:2025-05-06
微软推出WindowsAI搜索功能测试,提升文件查找体验
更新时间:2025-05-06
OpenAI专家:社交媒体上的AI炒作远比你想象的复杂!
更新时间:2025-05-06
AI始祖重生:世界首个聊天机器人ELIZA在60年后重获新生
更新时间:2025-05-06
大型出版公司Dotdash与OpenAI达成合作,裁员百余人
更新时间:2025-05-06
阶跃星辰上线Step-2mini、Step-2文学大师版语言模型
更新时间:2025-05-06
MiniMax海螺语音全球同步上线包含T2A-01-Turbo等模型
更新时间:2025-05-06
MIT、DeepMind研究揭示视觉语言模型无法理解否定表达的原因
更新时间:2025-05-06
商汤日日新融合大模型交互版开放商用实时音视频对话限时免费
更新时间:2025-05-06