蚂蚁百灵正式推出新一代原生混合推理模型 Ling-3.0-Flash。该模型总参数量为 124B,单次计算仅激活 5.1B 参数。在显著压缩模型体量、降低算力消耗的同时,Ling-3.0-Flash 在基础推理、指令遵循和长文本处理等关键能力上,对标甚至超过了参数规模达到其 2 至 3 倍的行业领先模型,体现出更高的“智效比”和落地性价比。
据了解,这一模型已上线 OpenRouter,并将限时免费一周,随后正式开源。作为本次版本升级的重点,Ling-3.0-Flash 面向 Agent 真实应用场景进行了深度优化,扩展了超过 10000 个真实交互训练环境,同时强化了复杂任务中的自我纠错能力与长程规划机制。
相关快讯
小米MiMo-V2.5登顶OpenRouter全球周榜、月榜双第一
OpenRouter最新数据显示,7月27日小米MiMo-V2.5登上全球大模型调用量周榜和月榜双第一,成为当周唯一突破10T的模型。自5月以来,其全球调用量持续快速增长,单周token量由1.46T升至10.46T,约两个月增长616%。
中国科学院出手,AI最尴尬短板有望被补上
GPT-5.5、DeepSeek-V4-Pro和具身机器人分别在论文、代码和物理操作上形成了各自优势,但在复杂人际与社会场景中仍有短板。知境要补足这一缺口,为大模型加入“情商”和可信任感,使其在关键场合更可靠。团队没有沿用堆数据、堆算力的路线,而是设计了可自我进化的训练系统。
Gemini 4有望年底发布,已进入训练阶段
谷歌CEO皮查伊在财报电话会议上表示,Gemini4已投入训练,预计有望年底发布。尽管Gemini3.5 Pro未按原计划于6月推出,谷歌仍希望借Gemini4在编程和智能体等关键能力上追赶前沿水平,并保持行业竞争力。
徐洁云:上周全球前五大模型全是中国AI,小米 MiMo-V2.5 跃居第一
上周全球调用量前五的 AI 大模型全部来自中国,小米 MiMo-V2.5 升至第一,周调用量达 10.5 万亿 Token,环比增长 12%。该系列于 4 月 23 日开启公测,涵盖多款模型,并在推理、Agent、上下文、指令遵循和全模态理解等方面增强,同时优化了 Token Plan 定价方案。
美团LongCat模型负责人确认离职
裴鹏于2023年加入美团,先后负责基座模型预训练与LongCat基础模型团队,全面推进大语言模型、多模态模型及Agent研发,并主导万亿参数大模型LongCat-2.0落地。该模型于2026年6月发布开源,成为首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数大模型,在国产算力适配、推理成本控制和智能体、代码场景优化上取得突破。
Anthropic发布Opus 5:性能接近Fable 5,价格却只要一半
Anthropic在57天内密集更新Claude多条产品线:先后发布Opus 4.8、Fable 5、Mythos 5、Sonnet 5和Opus 5。最新Opus 5性能接近旗舰Fable 5,但价格减半,体现出其在AI模型迭代上的极快节奏。