小红书大模型IMO夺金满分,第三题解法让冠军选手直呼优雅

1小时前更新 DataEye
4 0 0

中国大模型首次拿下 IMO 官方金牌水平认证,消息一出,确实让人有点意外。

刚刚,IMO 2026 成绩正式公布,大模型“交卷”也被推到了新高度。率先获得官方评卷满分的,竟然是小红书的 dots-note-3.0。

根据 IMO 官方评定,小红书大模型 dots-note-3.0 六道题全部答对,以满分成绩直接斩获金牌水平认证。

这项成绩的含金量非常高。更关键的是,这是中国大模型首次获得 IMO 官方金牌水平认证,也是继谷歌 Gemini 之后,全球第二个达到这一成绩的大模型。

而且要特别强调,这次拿到的是满分。相比之下,谷歌当年也只答对了 5/6 道题。

这波表现,确实相当亮眼。

小红书大模型IMO夺金满分,第三题解法让冠军选手直呼优雅的封面图

相关快讯

智谱1吉瓦AI数据中心建成,已启动部分运营

智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。

Kimi K3发布后,真正坐不住的不是英伟达

月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。

千问发布语音合成大模型 Qwen-Audio-3.0-TTS

千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

每刻深思携空间光计算方案亮相WAIC,宣布与科华数据达成战略合作

WAIC 2026期间,每刻深思与阶跃联合参展,展示空间光计算芯片与大模型全栈融合方案,并基于STEP 3.7实现实景推理加速,提升效率、降低成本。同时,公司与科华数据达成“算电冷协同”战略合作,围绕UPS、液冷和异构算力协同推进绿色算力方案落地。

阿里巴巴发布语音合成大模型 Qwen-Audio-3.0-TTS

阿里巴巴于7月20日发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度控制、自由指令、多语种方言和复杂声学鲁棒性上全面提升,并推出实时交互的Flash版和高质量生成的Plus版,使语音合成从“能说话”迈向“会表达”。目前Plus版已登顶Artificial Analysis榜单,预览版也曾夺冠。

暂无评论

暂无评论...