腾讯混元近日正式推出新一代语音识别模型 **Hy ASR 3.0 preview**。该模型依托最新一代大语言模型 **Hy3** 的语言理解能力,将高精度语音识别与深度语义理解进一步融合,在通用识别、上下文感知、多场景鲁棒性以及方言覆盖等关键维度实现整体升级。面对更复杂的真实输入,Hy ASR 3.0 preview 能输出更准确、更连贯、也更贴近用户意图的转写结果,推动语音识别从“逐字转写、单点优化”迈向“理解语境、兼容场景、一键直出”。
在底层架构上,Hy ASR 3.0 preview 采用兼顾效率与性能的 **MoE** 架构,并将基础模型升级到 **Hy3**,进一步强化语言理解、上下文建模以及语义推理能力。通过这一轮能力整合,模型在复杂场景下的识别稳定性和语义还原能力也得到同步增强。
相关快讯
英伟达据悉推出万亿参数开源AI模型Nemotron 4,挑战顶级开源模型
英伟达正开发新一代开源模型 Nemotron 4,参数规模预计至少 1 万亿,意在挑战全球领先的开源大模型。此举不仅有助于扩大开放模型生态、推动 AI 应用落地,也可能进一步带动市场对其 GPU 算力的需求。英伟达此前已推出 Nemotron 系列开源模型,其中包括 3400 亿参数版本,主要用于训练数据生成、模型开发和企业 AI 应用。
梁汝波回应大模型与海外SOTA差距:坚持自研,接受短期落后,持续优化长期竞争力
梁汝波在字节跳动2026年中全员会上表示,公司AI业务上半年整体表现稳中有进:豆包在C端应用保持竞争力,视频生成模型Seedance维持SOTA。但在大语言模型方面,海外SOTA已拉开差距,字节仍将坚持自研,夯实基础能力,接受短期落后,着眼长期优化。这一判断也与张一鸣此前的表态一致。
字节跳动CEO:大语言模型坚持自研,短期落后也要接受
字节跳动2026年中全员会上表示,大语言模型将坚持自研,夯实基本功,接受短期落后,聚焦长期优化,避免动作变形。梁汝波否认因外部压力而自研,称核心原因是延迟满足、打牢技术基础以支持AGI。张一鸣此前也强调不使用模型蒸馏加速研发,宁可短期性能落后。
字节跳动梁汝波:大语言模型坚持自研,短期落后也要接受
8月6日,梁汝波在字节2026年中全员会上表示,大语言模型与海外领先模型差距拉大,但公司仍将坚持自研、夯实基本功,接受短期落后,聚焦长期能力建设和AGI目标。谭待称,ToB场景只有SOTA模型才能率先释放高价值,Seedance 2.0已推动视频生成从“玩具”走向严肃商业生产。
腾讯混元开源 AngelSpec:这次又带来了什么新能力
7月29日,腾讯混元团队正式开源投机解码框架 AngelSpec,覆盖 drafter 训练、架构设计到线上部署全流程。同时开放 Hy3-A21B 的 MTP 与 DFly drafter 权重及训练代码,方便开发者复现和应用相关能力。
月之暗面 Kimi K3 正式开源
7月27日晚,月之暗面发布Kimi K3模型权重与技术报告,并开源MoonEP、FlashKDA、AgentEnv等关键训练基础设施。Kimi K3为2.8万亿参数的MoE模型,具备原生视觉理解能力,支持100万token上下文窗口,且可自由下载部署并用于研发或产品集成。