千问为何还是不够自信?

2个月前更新 xiaoshan
10 0 0

这几天国产大模型的节奏明显加快,几乎像是在集中开发布会。先是 K3 放出重磅消息,紧接着昨天 Qwen3.8 也正式亮相,两个都是 2T 以上的大参数模型。据说今天 DeepSeek V4 也可能发布,原本还想等 V4 出来后一起聊,但遗憾的是没等到。

不过,仅看当前千问这一波动作,已经能看出不少值得拆解的信号。

从发布时间点来看,Kimi K3 刚刚发布,而且整体表现相当亮眼;DeepSeek V4 也在临近发布,虽然具体水平还未知,但按梁圣一贯的风格,依然很值得期待。夹在这两者之间,Qwen3.8 的处境就显得有些微妙。

如果模型能力打不过 K3,性价比又比不过 V4,那么对外传播时就会比较难找到足够有说服力的叙事空间。

另外一个值得注意的点是,阿里这次在发布时已经明确表示,Qwen3.8 将同步开源

千问为何还是不够自信?的封面图

相关快讯

亮源新创开源通用导航大脑:LightNav-0 发布

9月1日,亮源新创正式发布并开源通用导航大脑LightNav-0。该模型在公开视觉语言导航(VLN)评测基准上取得全面领先,达到当前SOTA水平,体现出其在导航理解与执行能力上的优势。

科大讯飞旗下词元星火开源两款端侧通用大模型

科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和X2.5-1.7B两款端侧通用大模型。两款模型将百万级上下文处理能力带到本地设备,其中X2.5系列是端侧模型中唯一原生支持最长100万Token上下文的模型。

DeepSeek-V4多模态模型刚刚开源

DeepSeek-V4-Flash-Vision-Exp已正式开源,是DeepSeek-V4系列首个实验性多模态模型。该模型此前已于8月21日上线API平台,基于DeepSeek-V4-Flash架构,集成视觉模块并通过持续训练,实现了视觉理解能力。

中国信通院牵头,大模型平台系列行业标准正式发布

工信部近日发布2026年第18号公告,正式批准由中国信通院牵头制定的大模型平台系列行业标准,覆盖数据处理、模型训练、推理、计算资源调度与运维等核心环节。其中4项将于2026年11月1日实施,填补了国内大模型平台系统性标准空白。

**亚马逊AWS押注政府AI市场** 亚马逊AWS重押政府AI赛道:OpenAI、Meta、Anthropic等大模型集体登陆GovCloud

**Drafting concise AWS GovCloudAI summary** 亚马逊云服务AWS宣布扩大GovCloud AI模型可用范围,美国政府机构可通过Amazon Bedrock使用Anthropic、OpenAI、Meta及自家Nova等大模型。AWS GovCloud面向政府监管、安全和外部隔离需求,服务政府客户、国防工业及技术合作伙伴,AWS业务也持续强劲增长。

**腾讯混元 Hy4 调用激增应急扩容** 腾讯混元 Hy4 preview 调用激增,WorkBuddy 紧急扩容应对

**Planning concise Chinese summary** 腾讯混元表示,Hy4 preview于2026年8月28日在WorkBuddy首发接入后,因Agent能力提升受欢迎,首日任务队列即出现排队。公司已对推理集群紧急扩容并持续调配资源,但受高端算力和高峰并发影响,仍可能在个别时段排队。

暂无评论

暂无评论...