相关快讯
亮源新创开源通用导航大脑:LightNav-0 发布
9月1日,亮源新创正式发布并开源通用导航大脑LightNav-0。该模型在公开视觉语言导航(VLN)评测基准上取得全面领先,达到当前SOTA水平,体现出其在导航理解与执行能力上的优势。
科大讯飞旗下词元星火开源两款端侧通用大模型
科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和X2.5-1.7B两款端侧通用大模型。两款模型将百万级上下文处理能力带到本地设备,其中X2.5系列是端侧模型中唯一原生支持最长100万Token上下文的模型。
DeepSeek-V4多模态模型刚刚开源
DeepSeek-V4-Flash-Vision-Exp已正式开源,是DeepSeek-V4系列首个实验性多模态模型。该模型此前已于8月21日上线API平台,基于DeepSeek-V4-Flash架构,集成视觉模块并通过持续训练,实现了视觉理解能力。
DeepSeek Harness开发者预览版开放测试中
8月13日,DeepSeek Harness 开发者预览版(v0.1)正式向全球 Harness 开发者开放测 […]
京东开源实时流式视频编辑模型 JoyAI-Video-Edit
京东于8月5日宣布开源自研实时流式视频编辑模型JoyAI-Video-Edit。该模型支持用户边看视频边修改人物和场景,将视频创作从“先有素材再修改”升级为可实时互动编辑,提升视频制作效率与灵活性。
MiniMax H3正式开源,性能与能力再升级
MiniMax正式开源新一代通用视频模型MiniMax H3。该模型是通用型全模态生成系统,能够统一理解文本、图像、视频和音频等多模态上下文,并生成最高2K分辨率、最长15秒、带原生立体声音频的视频。
暂无评论...
