有道发布全新开源“子曰4”多模态与TTS引擎

4个月前更新 15083662215
11 0 0

网易有道近日宣布其“子曰”大模型正式升级至4.0版本,全面进入全模态时代。此版本不仅实现了文本、图片和音频的融合交互,还标志着其核心的“多模态模型”与“语音合成(TTS)模型”正式开源

有道发布全新开源“子曰4”多模态与TTS引擎的封面图

相关快讯

亮源新创开源通用导航大脑:LightNav-0 发布

9月1日,亮源新创正式发布并开源通用导航大脑LightNav-0。该模型在公开视觉语言导航(VLN)评测基准上取得全面领先,达到当前SOTA水平,体现出其在导航理解与执行能力上的优势。

科大讯飞旗下词元星火开源两款端侧通用大模型

科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和X2.5-1.7B两款端侧通用大模型。两款模型将百万级上下文处理能力带到本地设备,其中X2.5系列是端侧模型中唯一原生支持最长100万Token上下文的模型。

DeepSeek-V4多模态模型刚刚开源

DeepSeek-V4-Flash-Vision-Exp已正式开源,是DeepSeek-V4系列首个实验性多模态模型。该模型此前已于8月21日上线API平台,基于DeepSeek-V4-Flash架构,集成视觉模块并通过持续训练,实现了视觉理解能力。

DeepSeek发布新多模态模型

DeepSeek-V4-Flash-Vision-Exp已在DeepSeek API平台正式上线。官方称其纯文本能力与DeepSeek-V4-Flash正式版持平,而在视觉理解类Agent Benchmark上表现显著提升,多模态Agent能力已接近Opus-4.8。

DeepSeek Harness开发者预览版开放测试中

8月13日,DeepSeek Harness 开发者预览版(v0.1)正式向全球 Harness 开发者开放测 […]

京东开源实时流式视频编辑模型 JoyAI-Video-Edit

京东于8月5日宣布开源自研实时流式视频编辑模型JoyAI-Video-Edit。该模型支持用户边看视频边修改人物和场景,将视频创作从“先有素材再修改”升级为可实时互动编辑,提升视频制作效率与灵活性。

暂无评论

暂无评论...