Xmax AI 发布 X2.0:把视频变成可交互“玩”的界面

2个月前更新 crj211401
7 0 0

智谱诞生于 KEG 实验室,这里本身就是国内顶尖的 AI Lab。其实早在今年 2 月,Xmax AI 就已发布全球首个虚实融合的实时交互视频模型 X1。虽然当时在海外社交媒体上引发了不小关注,但能力层面仍主要停留在技术突破阶段。

时隔 5 个月,Xmax AI 又在今日凌晨于 X(Twitter)正式发布 X2.0 模型,并同步开放商用 API。放眼国内,这一赛道基本仍属空白,Xmax AI 也被视为落地进度最快的团队,是目前国内唯一能够实现可商用、规模化部署实时编辑与交互模型的公司。

01 从 X1 到 X2.0
今年 2 月,Xmax AI 发布了全球首个虚实融合的实时交互视频模型 X1。

Xmax AI 发布 X2.0:把视频变成可交互“玩”的界面的封面图

相关快讯

剪映员工离职创业为何频现“人传人”现象

7月中旬,LibTV与Flova相继推出视频 Agent 功能并加大推广,行业竞争迅速升温。Flova强调其首创 Agent 创作 AI 视频范式,试图建立先发优势。与此同时,创业潮持续扩散,过去两年至少有10位“剪映系”创业者投身 AI 应用公司,今年上半年尤为密集,显示相关人才正加速外溢。

前 TikTok 产品经理创业,AI 视频共创平台 Wapoo 获千万美元天使融资

Wapoo 面向 Gen Alpha 推出视频共创社交平台,已完成近千万美元天使轮融资。创始人杨名宇曾任快手用户研究、TikTok 产品经理,参与过 TikTok Stories、TikTok Now 等项目。平台希望把 AI 视频生成变成轻量社交动作,让发布从“终点”变成“起点”,用户只需表达简单意图即可完成创作。

DeeVid AI悄然跻身第一梯队,斩获3000万欧美用户

DeeVid AI 是一款面向欧美市场的 AI 视频 Agent 产品,上线一年半已积累 3000 万注册用户,ARR 达数千万美元。它支持图片、音频、视频一体化生成,并可通过对话式 Agent 模式创建与引用 Skill、添加参考资料。整体体验主打“省心”,由 Agent 负责理解需求、拆解任务并在关键节点让用户确认。

Flova定义的Agent视频范式,正在成为新标杆

作者最近常用 Flova 制作 AI 小视频,并观察到许多 AI 视频产品的界面正趋于同质化:从 Agent 定位、交互方式到功能模块和操作流程,都在向相似方向演进。这种现象类似 ChatGPT 出现后,许多对话类 AI 产品纷纷模仿其对话框布局。

阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms

阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。模型端到端延迟约 550ms,较常见实时语音对话系统更快;输出分辨率提升至 640×368@25FPS,微表情和细节表现更清晰。

谷歌 Google Vids 新增数字分身功能,轻松自导自演“AI 大片”

谷歌为 Google Vids 增加个人数字分身和 Gemini Omni 视频生成能力:用户可上传自拍和语音生成拟真虚拟形象,也能用文字和图片创建视频,或修改背景、光线与特效,并支持分步对话式编辑。此次升级让 Vids 从职场演示工具进一步转向完整视频创作平台,并与 HeyGen、Synthesia 等竞争。

暂无评论

暂无评论...