阿里Qwen3.7登顶国产AI!实测揭示其轻松破解奥赛难题的实力

2个月前更新 7g5rstyn
6 0 0

阿里加速Qwen主模型迭代。智东西5月19日报道,阿里发布了Qwen3.7系列的预览版模型,包括Max和Plus两个版本。同时,大模型竞技场公布了Qwen3.7-Max-Preview的评测结果。在涵盖主流大模型的总榜中,Qwen3.7-Max-Preview位列第13,介于GPT 5.5和Grok 4.2之间,成为该榜单中排名最高的国产模型。体验链接:chat.qwen.ai/。在多领域排名中,Qwen3.7-Max-Preview在数学方面表现尤为突出,能够在4分钟内解决IMO难题,并生成可运行的EXE文件。

阿里Qwen3.7登顶国产AI!实测揭示其轻松破解奥赛难题的实力的封面图

相关快讯

京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型

7月18日,京东以“AI进入物理世界”为主题亮相上海世博展览馆,首次系统展示面向物理世界的JoyAI模型矩阵,并推出JoyAI-Talker实时语音交互模型和JoyAI-Video-Edit实时视频编辑模型。官方称,JoyAI-Talker具备低延迟对话、情绪理解、工具调用和记忆等能力,推动AI从执行指令走向理解人类意图与状态。

突发叫停:Gemini 3.5 Pro难产,谷歌陷入失望风波

昨日韩国外界盛传谷歌即将上线 Gemini 3.5 Pro“Cappuccino”,主打200万上下文窗口和“深度思考”模式,甚至被认为会改写AI格局。但随后消息反转,发布计划并未如期推进,而是被谷歌大幅延期数月,令原本高涨的期待迅速降温。

消息称谷歌旗舰AI模型Gemini 3.5 Pro延期数月,技术表现未达预期

据消息,谷歌旗舰模型 Gemini 3.5 Pro 已延期数月,主要因公司希望继续提升能力,尤其是编程表现。延期已引发工程师、研究人员和管理层不满,也让部分员工担心谷歌在 Anthropic、OpenAI 竞争下失去优势。与此同时,谷歌内部多层协调及将 AI 接入搜索、地图、YouTube 等产品的复杂流程,也在拖慢发布进度。

微软 CEO 纳德拉吐槽 Anthropic 的 Fable 模型:内容管控太严苛

微软 CEO 纳德拉在内部会议上批评 Anthropic 的 Fable 模型内容管控过于严格,认为其常因“莫名其妙”的原因拒答。与此同时,Anthropic 也表示,涉及 AI 大模型开发等问题时,可能会用旧版模型返回结果。随着企业高管转向更低成本的 AI 模型,这一争议引发关注。

GPT-5.6用1小时攻克50年数学难题,64个AI摘下图论皇冠

OpenAI称,GPT-5.6 Sol Ultra在不到一小时内完成并证明了困扰数学界50年的“循环双覆盖猜想”,引发广泛关注。研究员Noam Brown表示,这次创造奇迹的模型已向公众开放。消息一出,网友纷纷感叹AI正深刻改变数学研究。

Anthropic首次揭秘Claude“人格”:Opus更爱抬杠,Sonnet更会安慰人,中英文性格还不同

Anthropic 研究用 30 万条真实对话证明,Claude 不同版本和不同语言下会呈现稳定的表达风格、行为倾向与价值取向差异。也就是说,大模型不仅能力有别,“人格”也会随模型与语言环境切换。

暂无评论

暂无评论...