阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。...
Xmax AI正式发布新一代通用实时交互AI视频模型Xmax X2.0,并开放API与产业合作接入。该模型在实时重渲能力上进一步升级,支持CharX实时换人、ClothX实时换装...
Xmax AI 源于 KEG 实验室这类顶级 AI 团队背景,2 月曾发布全球首个虚实融合实时交互视频模型 X1,引发海外关注但当时仍偏技术突破。5 个月后,Xmax AI 再推 ...
魔芯科技联合浙江大学团队发布MoWorld,号称全球首个Flash World Model,也是首个全栈基于国产NPU构建的实时交互世界模型。该方案把世界模型推至50FPS实时交...
生数科技正式发布Vidu S1实时交互模型,主打新一代实时视频生成能力,可实现视频通话与语音控制视频走向。该模型支持540P高清分辨率、25FPS帧率,最高可达42F...
阿里巴巴ATH于4月16日正式推出其开放世界模型产品Happy Oyster,现已开启早期体验。Happy Oyster由阿里巴巴ATH团队开发,旨在支持实时的世界创建与交互。
阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms
阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。...