有道发布全新开源“子曰4”多模态与TTS引擎

2个月前更新 15083662215
8 0 0

网易有道近日宣布其“子曰”大模型正式升级至4.0版本,全面进入全模态时代。此版本不仅实现了文本、图片和音频的融合交互,还标志着其核心的“多模态模型”与“语音合成(TTS)模型”正式开源

有道发布全新开源“子曰4”多模态与TTS引擎的封面图

相关快讯

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

Meshy完成近4亿美元B轮融资,估值超百亿,押注实时互动多模态内容体验

Meshy 在营收快速增长后完成近 4 亿美元 B 轮融资,投后估值超 100 亿元人民币,成为全球估值最高的 AI 3D 公司,并刷新赛道单轮融资和估值纪录。3D 因同时需要图形学与大模型训练能力,被认为是多模态中最难的方向。

所有人都在卷 Coding Agent,商汤:下一个能真正“交付”的行业是设计

过去一年,AI 最确定的突破发生在 Coding,从 Copilot 到 Agentic Coding,代码率先被 AI 打穿。商汤在 2026 WAIC 发布 SenseNova U1 Pro,定位为面向长程任务的交付级原生多模态 Agent 基座,首站瞄准设计行业。相比已火两年的 AI 生图,现有工具虽惊艳但离专业工作流仍有距离,商业化仍受限制。

文远知行发布物理AI大模型WITT,迈向自动驾驶新突破

7月17日,文远知行正式发布自研物理AI认知基础大模型WeRide WITT。该模型基于视觉语言大模型能力,首次引入“最小物理事实单元”概念,融合视频、图像、文本等多模态信息,将真实场景拆解为可识别、可验证的事实单元,构建以物理事实为核心的AI理解框架。

马斯克旗下 SpaceXAI 宣布开源 Grok Build

SpaceXAI宣布开源Grok Build,并重置所有用户使用限制。针对隐私争议,公司称产品始终遵循零数据保留(ZDR)原则,用户可在命令行中关闭数据上传。自7月12日起,已默认禁用数据保留,并清除先前保存的编码数据。

蚂蚁灵波开源具身智能视频生成基础模型 LingBot-Video

蚂蚁灵波开源全球首个基于MoE架构、面向具身智能的视频生成基础模型LingBot-Video。该模型融合7万小时具身数据,重构视频预训练范式,在推理效率、物理合理性、动作理解和任务完成度上提升明显,并为视频基模迈向具身智能提供新底座。在RBench评测中总分0.620,超过Wan2.6、Seedance 1.5 Pro和Cosmos3 Super。

暂无评论

暂无评论...