相关快讯
RynnWorld-4D:让机器人“看到三维未来”,重塑4D具身世界模型
近两年具身智能中,视频生成模型被广泛用于动作预测,思路是先生成未来视频,再提取动作执行。但这一范式仍受限于2D像素表征与3D物理世界之间的鸿沟:机器人需要精确距离和空间关系,而像素预测只能提供大致位置,难以支撑高精度操控。
Xmax AI发布X2.0:通用实时交互AI视频模型亮相
Xmax AI正式发布新一代通用实时交互AI视频模型Xmax X2.0,并开放API与产业合作接入。该模型在实时重渲能力上进一步升级,支持CharX实时换人、ClothX实时换装、VibeX实时换风格等功能;同时通过统一交互架构,提升为可理解摄像头、视频流和手势行为的全能模型。
蚂蚁灵波开源具身智能视频生成基础模型 LingBot-Video
蚂蚁灵波开源全球首个基于MoE架构、面向具身智能的视频生成基础模型LingBot-Video。该模型融合7万小时具身数据,重构视频预训练范式,在推理效率、物理合理性、动作理解和任务完成度上提升明显,并为视频基模迈向具身智能提供新底座。在RBench评测中总分0.620,超过Wan2.6、Seedance 1.5 Pro和Cosmos3 Super。
生数科技正式发布 Vidu S1 实时交互模型,开启全新交互体验
生数科技正式发布Vidu S1实时交互模型,主打新一代实时视频生成能力,可实现视频通话与语音控制视频走向。该模型支持540P高清分辨率、25FPS帧率,最高可达42FPS,并可基于真人、动漫、萌宠等形象及个性化音色,快速生成专属交互角色。
AI视频史上最大单笔融资,203.8亿即将诞生
据《南华早报》援引知情人士消息,快手旗下可灵AI拟完成约30亿美元融资,投后估值约180亿美元,较4月设定的200亿美元目标下调20亿美元。腾讯参与本轮融资。随着中国AI视频生成竞争加剧,可灵AI正加速独立融资及后续上市安排,估值调整反映市场预期变化。
Sora停摆4个月后,谷歌终于出手了
OpenAI在3月24日宣布关停Sora,App于4月26日下线,API也将在9月24日彻底停止服务。这个曾被视为“AI视频革命”的产品,虽然每天烧掉约100万美元算力,但从上线到关停总共只赚了210万美元。与此同时,Nano Banana Pro面向专业设计师,主打复杂推理、4K精度和创意控制;Lite版已开始在Google AI Studio、Gemini API、Gemini app、NotebookLM、Google Photos和Google Ads等产品中开放使用。
