上周, 全球调用量排名前五再次全部被中国 AI 大模型包揽。其中,小米 MiMo-V2.5 跃升至榜首,周调用量达到 10.5 万亿 Token,环比增长 12%。
据此前消息,小米 MiMo-V2.5 系列模型已于 4 月 23 日开启公测,涵盖 MiMo-V2.5、V2.5-Pro、V2.5-TTS Series、V2.5-ASR 等版本,主打更强推理能力、更稳定的 Agent 表现、更长上下文,以及更强的指令遵循和模糊指令理解能力,同时在全模态感知与理解方面也有提升。
与此同时,小米还对 Token Plan 定价方案进行了优化。
相关快讯
小米MiMo-V2.5登顶OpenRouter全球周榜、月榜双第一
OpenRouter最新数据显示,7月27日小米MiMo-V2.5登上全球大模型调用量周榜和月榜双第一,成为当周唯一突破10T的模型。自5月以来,其全球调用量持续快速增长,单周token量由1.46T升至10.46T,约两个月增长616%。
中国科学院出手,AI最尴尬短板有望被补上
GPT-5.5、DeepSeek-V4-Pro和具身机器人分别在论文、代码和物理操作上形成了各自优势,但在复杂人际与社会场景中仍有短板。知境要补足这一缺口,为大模型加入“情商”和可信任感,使其在关键场合更可靠。团队没有沿用堆数据、堆算力的路线,而是设计了可自我进化的训练系统。
Gemini 4有望年底发布,已进入训练阶段
谷歌CEO皮查伊在财报电话会议上表示,Gemini4已投入训练,预计有望年底发布。尽管Gemini3.5 Pro未按原计划于6月推出,谷歌仍希望借Gemini4在编程和智能体等关键能力上追赶前沿水平,并保持行业竞争力。
蚂蚁百灵发布新一代原生混合推理模型 Ling-3.0-Flash
蚂蚁百灵发布新一代原生混合推理模型 Ling-3.0-Flash,总参数 124B、激活 5.1B,在显著降低算力开销的同时,于推理、指令遵循和长文本处理上表现对标甚至超越更大模型,突出“智效比”。该模型已上线 OpenRouter,限时免费一周后将开源,并针对 Agent 场景强化了超万种真实交互训练、自我纠错和长程规划能力。
美团LongCat模型负责人确认离职
裴鹏于2023年加入美团,先后负责基座模型预训练与LongCat基础模型团队,全面推进大语言模型、多模态模型及Agent研发,并主导万亿参数大模型LongCat-2.0落地。该模型于2026年6月发布开源,成为首个在五万卡国产算力集群上完成全流程训练与推理的万亿参数大模型,在国产算力适配、推理成本控制和智能体、代码场景优化上取得突破。
黄仁勋:杰出人才总能找到答案,中国必将诞生卓越AI技术
黄仁勋在7月25日接受外媒采访时谈到中美AI竞争,认为优秀人才总能找到好答案,中国也必将产生卓越的AI技术。他强调,应继续向中国学习,并与中国开展合作。