谷歌 Google Vids 新增数字分身功能,轻松自导自演“AI 大片”

4天前更新 kw178
4 0 0

谷歌近日宣布为 Google Vids 增加个人数字分身功能,用户只需上传一张自拍照并录制一段语音,就能生成一个外貌和声音都尽量贴近本人的虚拟形象。

与此同时,多模态 AI 模型 Gemini Omni 也将接入 Google Vids。用户可以同时提供文字提示词和参考图片,由 Omni 综合这些素材,生成所需视频内容。除了从零创建 AI 视频,Omni 还能对手机视频进行背景替换、光线优化,或直接加入特效。

Omni 还支持分步式修改。用户可以在制作过程中持续提出调整需求,不必因为局部改动而重新生成整段视频,编辑效率因此明显提升。

Google Vids 最初是一款面向职场演示场景的 AI 辅助工具,此次更新后,产品形态进一步向功能更完整的视频创作平台靠拢。业内认为,随着个人数字分身和对话式编辑能力加入,Google Vids 将更深入切入 AI 视频创作市场,并与 HeyGen、Synthesia、Captions、D-ID 等平台展开竞争。

谷歌 Google Vids 新增数字分身功能,轻松自导自演“AI 大片”的封面图

相关快讯

Flova定义的Agent视频范式,正在成为新标杆

作者最近常用 Flova 制作 AI 小视频,并观察到许多 AI 视频产品的界面正趋于同质化:从 Agent 定位、交互方式到功能模块和操作流程,都在向相似方向演进。这种现象类似 ChatGPT 出现后,许多对话类 AI 产品纷纷模仿其对话框布局。

阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms

阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。模型端到端延迟约 550ms,较常见实时语音对话系统更快;输出分辨率提升至 640×368@25FPS,微表情和细节表现更清晰。

Xmax AI 发布 X2.0:把视频变成可交互“玩”的界面

Xmax AI 源于 KEG 实验室这类顶级 AI 团队背景,2 月曾发布全球首个虚实融合实时交互视频模型 X1,引发海外关注但当时仍偏技术突破。5 个月后,Xmax AI 再推 X2.0 并开放商用 API,成为国内在实时编辑与交互视频模型方向落地最快、且唯一可规模化商用部署的公司。

阿里加码,AI视频赛道强势崛起

爱诗科技宣布完成整体C轮融资,累计融资达29.8亿元人民币,最新C+轮由阿里巴巴领投,十余家机构跟投。公司成立仅三年多便接近完成30亿元单轮融资,融资规模跻身国内AI视频与大模型领域第一梯队,也反映出AI视频正成为AI商业落地的重要赛道。

Sora停摆4个月后,谷歌终于出手了

OpenAI在3月24日宣布关停Sora,App于4月26日下线,API也将在9月24日彻底停止服务。这个曾被视为“AI视频革命”的产品,虽然每天烧掉约100万美元算力,但从上线到关停总共只赚了210万美元。与此同时,Nano Banana Pro面向专业设计师,主打复杂推理、4K精度和创意控制;Lite版已开始在Google AI Studio、Gemini API、Gemini app、NotebookLM、Google Photos和Google Ads等产品中开放使用。

203.8亿!AI视频领域最大单笔融资或将诞生

据《南华早报》消息,快手旗下可灵AI正筹备30亿美元融资,腾讯参与其中,投后估值约180亿美元,较此前目标下调20亿美元。知情人士称,可灵AI预计未来12个月内启动港股IPO,募资将主要用于算力、数据中心建设及人才引进留存。

暂无评论

暂无评论...