王东:推理市场没有“万能芯片”,真正胜出的是解决方案组合

2天前更新 18702252110
1 0 0

据财联社今日报道,GPU 厂商摩尔线程联合创始人、执行总裁王东表示,大模型在国内外都在加速演进,当前头部厂商平均每两个月就会完成一次前沿基础模型的版本迭代。与此同时,在模型调用成本方面,他指出,中国前沿基础模型相较国外同等智力水平模型具备更明显的成本优势,整体性价比也更高。

王东认为,这一现象也反映出,模型公司在算力资源有限的情况下,持续围绕模型效率、价格效率和训练成本做了大量优化工作。他还强调,推理市场并不存在所谓“万能芯片”,更多依赖“解决方案”的组合来落地。

他进一步指出,推理市场的技术应用门槛相对较低,且场景高度碎片化,因此不存在任何一家企业可以垄断所有细分应用场景。

王东:推理市场没有“万能芯片”,真正胜出的是解决方案组合的封面图

相关快讯

智谱1吉瓦AI数据中心建成,已启动部分运营

智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。

Kimi K3发布后,真正坐不住的不是英伟达

月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。

千问发布语音合成大模型 Qwen-Audio-3.0-TTS

千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

每刻深思携空间光计算方案亮相WAIC,宣布与科华数据达成战略合作

WAIC 2026期间,每刻深思与阶跃联合参展,展示空间光计算芯片与大模型全栈融合方案,并基于STEP 3.7实现实景推理加速,提升效率、降低成本。同时,公司与科华数据达成“算电冷协同”战略合作,围绕UPS、液冷和异构算力协同推进绿色算力方案落地。

阿里巴巴发布语音合成大模型 Qwen-Audio-3.0-TTS

阿里巴巴于7月20日发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度控制、自由指令、多语种方言和复杂声学鲁棒性上全面提升,并推出实时交互的Flash版和高质量生成的Plus版,使语音合成从“能说话”迈向“会表达”。目前Plus版已登顶Artificial Analysis榜单,预览版也曾夺冠。

暂无评论

暂无评论...