Code Arena:阿里千问3.7编程能力表现优异,仅次于Claude系列

3个月前更新 projext
7 0 0

于5月26日凌晨发布全球三方编程榜单Code Arena,阿里最新旗舰模型Qwen3.7-Max以1541分的成绩超越了诸如GPT-5.5和Gemini-3.5-Flash等多个模型,位列Claude系列之后,成为全球第二大模型。

Code Arena:阿里千问3.7编程能力表现优异,仅次于Claude系列的封面图

相关快讯

智谱正式发布GLM-5.3

智谱正式发布GLM-5.3。相比GLM-5.2,它基座不变,但通过更强的后训练Scaling显著提升智能上限,编程能力尤为突出。内部体感评测较GLM-5.2提升50%,并在Terminal Bench 3.0、Agents' Last Exam(CLI)等公开基准中取得开源第一。

阿里千问办公官网亮相,鸿蒙电脑 Beta 版同步上架 AppGallery 应用尝鲜

千问办公官网今日上线,提供 Windows 10+ 和 macOS 14+ 的 Beta 版下载。官方主打企业 IM 写作、Office 文档一站式生成编辑、多模态理解、全栈网页生成、数据源接入及自定义技能等六大能力,并推出免费版、个人标准版等订阅套餐。

阿里千问发布 Qwen-Image-3.0,图像生成再升级

阿里千问正式推出第三代图像生成基础模型Qwen-Image-3.0。新模型支持最高4.5k token输入,能够精准渲染10px小字,并原生支持12国语言的图像文字生成,进一步提升了多语言与细节表现能力。

阿里千问将接入苹果智能,成为AI能力集成方案

阿里千问将接入Apple智能,为中国地区的iOS、iPadOS、macOS和visionOS用户提供AI体验。用户无需切换应用,即可在Apple设备上直接使用千问的文本与图像理解、内容生成等能力,提升使用便捷性与智能化体验。

阿里推出全新千问旗舰模型Qwen3.7-Max

阿里巴巴推出了全新千问旗舰模型Qwen3.7-Max,该模型在Arena全球大模型盲测中表现优异,超越了多款竞争对手,成为国产模型中的佼佼者。Qwen3.7-Max专为智能体设计,具备编程和推理等核心能力的显著提升,能够全自主完成复杂任务,最长可达35小时。该模型在新芯片平台上实现了自我进化,推理速度较前版本提升了10倍,标志着技术的重大进步。

阿里发布全新千问模型Qwen3.7-MaX!

在阿里云峰会上,阿里发布了千问模型Qwen3.7-MaX。该模型在语言理解与生成、逻辑推理、知识储备与常识、以及指令遵循与对齐等基础性能上得到了显著提升。此外,Qwen3.7-MaX还支持多种Harness框架,以增强其应用灵活性和扩展性。

暂无评论

暂无评论...