阿里斩获 ACL 2026 最佳资源论文奖:揭示 AI Agent 专家能力鸿沟

20小时前更新 haozi9365
2 0 0

过去一年,Deep Research Agent 被普遍视为大模型落地的新突破口。这类智能体不仅具备检索能力,还能调用工具、执行多步推理,并在多个评测榜单上持续攀升,表现亮眼。也正是这项工作,帮助阿里巴巴 ATH-MaaS(Alibaba Token Hub Model-as-a-Service)应用算法团队斩获 ACL 2026 最佳资源论文奖(Best Resource Paper Award)。

在本届 ACL 2026 全球仅有 4 篇的最佳资源论文中,HSCodeComp 的含金量尤为突出。值得关注的是,它也是本届 ACL 2026 Best Resource Awards 中唯一来自中国公司的成果。

阿里斩获 ACL 2026 最佳资源论文奖:揭示 AI Agent 专家能力鸿沟的封面图

相关快讯

智谱1吉瓦AI数据中心建成,已启动部分运营

智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。

Kimi K3发布后,真正坐不住的不是英伟达

月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。

千问发布语音合成大模型 Qwen-Audio-3.0-TTS

千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

每刻深思携空间光计算方案亮相WAIC,宣布与科华数据达成战略合作

WAIC 2026期间,每刻深思与阶跃联合参展,展示空间光计算芯片与大模型全栈融合方案,并基于STEP 3.7实现实景推理加速,提升效率、降低成本。同时,公司与科华数据达成“算电冷协同”战略合作,围绕UPS、液冷和异构算力协同推进绿色算力方案落地。

阿里巴巴发布语音合成大模型 Qwen-Audio-3.0-TTS

阿里巴巴于7月20日发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度控制、自由指令、多语种方言和复杂声学鲁棒性上全面提升,并推出实时交互的Flash版和高质量生成的Plus版,使语音合成从“能说话”迈向“会表达”。目前Plus版已登顶Artificial Analysis榜单,预览版也曾夺冠。

暂无评论

暂无评论...