千问为何还是不够自信?

10小时前更新 xiaoshan
1 0 0

这几天国产大模型的节奏明显加快,几乎像是在集中开发布会。先是 K3 放出重磅消息,紧接着昨天 Qwen3.8 也正式亮相,两个都是 2T 以上的大参数模型。据说今天 DeepSeek V4 也可能发布,原本还想等 V4 出来后一起聊,但遗憾的是没等到。

不过,仅看当前千问这一波动作,已经能看出不少值得拆解的信号。

从发布时间点来看,Kimi K3 刚刚发布,而且整体表现相当亮眼;DeepSeek V4 也在临近发布,虽然具体水平还未知,但按梁圣一贯的风格,依然很值得期待。夹在这两者之间,Qwen3.8 的处境就显得有些微妙。

如果模型能力打不过 K3,性价比又比不过 V4,那么对外传播时就会比较难找到足够有说服力的叙事空间。

另外一个值得注意的点是,阿里这次在发布时已经明确表示,Qwen3.8 将同步开源

千问为何还是不够自信?的封面图

相关快讯

智谱1吉瓦AI数据中心建成,已启动部分运营

智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。

Kimi K3发布后,真正坐不住的不是英伟达

月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。

千问发布语音合成大模型 Qwen-Audio-3.0-TTS

千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。

每刻深思携空间光计算方案亮相WAIC,宣布与科华数据达成战略合作

WAIC 2026期间,每刻深思与阶跃联合参展,展示空间光计算芯片与大模型全栈融合方案,并基于STEP 3.7实现实景推理加速,提升效率、降低成本。同时,公司与科华数据达成“算电冷协同”战略合作,围绕UPS、液冷和异构算力协同推进绿色算力方案落地。

阿里巴巴发布语音合成大模型 Qwen-Audio-3.0-TTS

阿里巴巴于7月20日发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度控制、自由指令、多语种方言和复杂声学鲁棒性上全面提升,并推出实时交互的Flash版和高质量生成的Plus版,使语音合成从“能说话”迈向“会表达”。目前Plus版已登顶Artificial Analysis榜单,预览版也曾夺冠。

科研人的“超级外挂”来了:中科闻歌磐石用ScienceOne打通AI研究全流程

在世界人工智能大会上,中科闻歌磐石 ScienceOne 团队发布科学多模态统一推理模型 S1-Omni,并将其能力接入 ScienceOne 科研智能平台。该平台由中科院自动化所与中科闻歌协同推进,旨在让大模型深入科研工作流,为科研人员提供24小时在线的学术助理,减少单独训练和部署专用模型的成本。

暂无评论

暂无评论...