相关快讯
亮源新创开源通用导航大脑:LightNav-0 发布
9月1日,亮源新创正式发布并开源通用导航大脑LightNav-0。该模型在公开视觉语言导航(VLN)评测基准上取得全面领先,达到当前SOTA水平,体现出其在导航理解与执行能力上的优势。
科大讯飞旗下词元星火开源两款端侧通用大模型
科大讯飞全资子公司词元星火正式推出并开源星火X2.5-4B和X2.5-1.7B两款端侧通用大模型。两款模型将百万级上下文处理能力带到本地设备,其中X2.5系列是端侧模型中唯一原生支持最长100万Token上下文的模型。
DeepSeek-V4多模态模型刚刚开源
DeepSeek-V4-Flash-Vision-Exp已正式开源,是DeepSeek-V4系列首个实验性多模态模型。该模型此前已于8月21日上线API平台,基于DeepSeek-V4-Flash架构,集成视觉模块并通过持续训练,实现了视觉理解能力。
腾讯混元 Hy4 Preview 调用激增,WorkBuddy 紧急扩容
**Planning concise Hy4 preview summary** 腾讯混元称,Hy4 preview 自 2026 年 8 月 28 日在 WorkBuddy 首发接入后因 Agent 能力提升广受欢迎,上线首日即出现排队情况,官方致歉。为保障体验,已对推理集群紧急扩容并持续调配资源,但高峰期仍可能排队,建议临时切换至 Hy3 等模型使用,且 Hy3 的 WorkBuddy 限免已延长。
京东开源实时流式视频编辑模型 JoyAI-Video-Edit
京东于8月5日宣布开源自研实时流式视频编辑模型JoyAI-Video-Edit。该模型支持用户边看视频边修改人物和场景,将视频创作从“先有素材再修改”升级为可实时互动编辑,提升视频制作效率与灵活性。
MiniMax H3正式开源,性能与能力再升级
MiniMax正式开源新一代通用视频模型MiniMax H3。该模型是通用型全模态生成系统,能够统一理解文本、图像、视频和音频等多模态上下文,并生成最高2K分辨率、最长15秒、带原生立体声音频的视频。
暂无评论...
