蚂蚁百灵开源轻量级混合推理MoE模型 Ling-3.0-tiny

2周前更新 projext
4 0 0

今日,蚂蚁百灵大模型正式开源轻量级混合推理 MoE 模型 Ling-3.0-tiny。该模型主打高效推理与智能体应用,核心设计围绕轻量化部署和多步思考能力展开,进一步强化了小模型在复杂任务中的实用性。

在架构层面,Ling-3.0-tiny采用月之暗面自研的 KDA(Kimi 增量注意力)与 DeepSeek 自研的 MLA(多头潜在注意力)以 3:1 比例交替堆叠,并引入由 128 个路由专家组成的稀疏 MoE 前馈网络,形成一套高效的混合线性架构。

在能力表现上,Ling-3.0-tiny兼顾快速响应与多步推理需求,可通过 `enable_thinking` 参数在单次请求中灵活开启或关闭思考模式,从而根据不同场景切换推理深度与响应速度。

蚂蚁百灵开源轻量级混合推理MoE模型 Ling-3.0-tiny的封面图

相关快讯

宇树科技王兴兴:探索物理AI机器人自进化之路

8月20日,宇树科技王兴兴在2026世界机器人大会上表示,公司正持续加码AI模型领域,该方向也是当前投入最多的领域。继8月19日登陆科创板后,公司市值约2779亿元。他首次提出“物理AI机器人自进化”概念,称将依托前沿大模型,让模型自主检索论文、开源方案并生成机器人控制代码,推动机器人模型自进化体系建设。

全球开源AI格局生变:中国开源模型加速崛起

Hugging Face最新观察报告显示,全球开源AI生态加速扩张,中国模型已成为重要力量。2026年以来,多数月份中国企业发布的最大开源模型参数规模显著领先美国,月度上限达7540亿至2.78万亿,而美国多低于1300亿。与此同时,中国大模型在开放授权上也更积极,超八成参数超过200亿的模型采用宽松协议。Qwen已成为重要基础模型,相关衍生模型超过15万个。

“千问办公”首发上线GLM-5.3和DeepSeek V4 Pro两款模型

8月15日,阿里巴巴旗下Agent产品“千问办公”首发接入GLM-5.3和DeepSeek V4 Pro两款前沿模型,用户可在首页“前沿模型”档位直接选择使用。加上此前已首发上线的Qwen3.8-Max,千问办公目前已支持三款国产旗舰模型,进一步扩展了其模型能力选择。

腾讯启动顶尖AI产品人才专项招聘 ━━━━━

腾讯启动“AI产品经理培训生”招聘专项,面向2026届、2027届毕业生开放混元大模型、WorkBuddy及游戏、社交、金融、云等AI产品与业务场景。项目不限学历和专业,重视候选人的AI实力、产品架构设计、技术敏感度、产品审美及从0到1落地能力,并将个人作品和项目成果作为重要参考,重点考察思考、实践、业务判断与协作能力。

小红书开源 dots3-note:IMO 42 分满分同系列模型来了

小红书 dots 实验室宣布开源 dots3-note preview,这是 dots3 系列首个开源版本。该模型承接此前 dots-note-3.0 在国际奥数竞赛中拿下官方认证满分 42 分的成绩,当前开源版本重点面向更贴近现实、评测更困难的长程任务,进一步延续了社区对其能力开放的关注。

中国移动将推出全国统一Token套餐资费

我先按新闻快讯口径重写这段,保持信息点和字数密度基本对齐,分段处理,避免扩写成解读稿。中国移动高管在今日中期业 […]

暂无评论

暂无评论...