Xmax AI发布X2.0:通用实时交互AI视频模型亮相

2个月前更新 xiaoshan
16 0 0

今日,Xmax AI正式推出新一代通用实时交互AI视频模型Xmax X2.0,并同步开放API与产业合作接入通道。该模型的实时重渲能力进一步升级,已可支持CharX实时换人、ClothX实时换装、VibeX实时换风格等多项能力。

在交互层面,Xmax X2.0通过统一交互架构完成升级,推动模型从“只理解Prompt”的单一输入模式,进化为能够同时理解摄像头画面、视频流以及手势行为的全能型模型。

Xmax AI发布X2.0:通用实时交互AI视频模型亮相的封面图

相关快讯

阿里视频大模型Wan3.0正式上线,视频生成能力再升级

8月24日,阿里巴巴视频生成大模型Wan3.0正式上线。新版本在生成时长、创作能力、参考能力和真实世界还原效果等方面全面升级,单次可生成最长30秒视频,并首次支持doc、xls、ppt、pdf、md等多种文档格式输入,进一步拓展了视频创作的应用场景。

7亿年薪留不住,余家辉为何转身创业?

余家辉在加入Meta一年多后宣布离职创业,并已更新个人网站履历。他曾带领多模态团队连续推出Muse Spark、Voice Mode、Muse Image和Muse Video等成果。其离职声明称,参与TBD Lab建设很受启发,也更坚定投身于一项对人类未来重要、但仍待深入探索的方向。

即梦AI推出Maya/Blender等插件,适配Seeance2.5加速专业场景落地

即梦AI首发上线Seedance2.5,并强化专业视频创作能力:支持最长3分钟超长生成,网页版新增“智能编辑”模式,更适合局部增删改;多帧编辑可细调成片细节,同时推出Maya/Blender插件,打通三维资产、绿幕素材与AI创作流程。

阿里云Qwen-Image-3.0正式上线千问AI平台

阿里巴巴千问图像生成模型Qwen-Image-3.0已正式上线千问AI平台,面向所有用户开放。旗舰版Pro和标准版Standard同步开放API,文生图价格0.18元/张起,海外用户可通过Qwen Cloud接入。该模型在Arena.ai最新文生图榜单中位列国内第一。

DeeVid AI悄然跻身第一梯队,斩获3000万欧美用户

DeeVid AI 是一款面向欧美市场的 AI 视频 Agent 产品,上线一年半已积累 3000 万注册用户,ARR 达数千万美元。它支持图片、音频、视频一体化生成,并可通过对话式 Agent 模式创建与引用 Skill、添加参考资料。整体体验主打“省心”,由 Agent 负责理解需求、拆解任务并在关键节点让用户确认。

阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms

阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。模型端到端延迟约 550ms,较常见实时语音对话系统更快;输出分辨率提升至 640×368@25FPS,微表情和细节表现更清晰。

暂无评论

暂无评论...