谷歌推出Gemini Omni模型:一键AI视频编辑新体验

4个月前更新
12 0 0

5月20日消息,谷歌推出了Gemini模型家族的旗舰版——Gemini Omni,这是一款全新的视频生成模型,基于其在世界模型领域的深厚积累。Gemini Omni能够根据多种输入生成视频,并具备对话式编辑功能。用户可通过自然语言修改角色、背景和场景,亦可上传自拍并将其转化为不同风格或内容。DeepMind首席执行官哈萨比斯表示,未来Omni将实现根据任何输入生成任何输出的能力,首款模型Gemini Omni Flash预计将于今年夏季发布。

谷歌推出Gemini Omni模型:一键AI视频编辑新体验的封面图

相关快讯

SkyProduction接入阿里Wan 3.0视频生成模型,限时3天免费体验

8月28日,昆仑万维旗下AI平台SkyProduction(天工工作台)正式接入阿里巴巴最新视频生成模型Wan 3.0。与此同时,SkyProduction与通义万相联合宣布,Wan 3.0于8月28日至30日在官网面向所有用户限时免费开放使用。

谷歌据悉将AI责任团队移出DeepMind实验室

据悉,谷歌计划将负责AI责任与伦理相关工作的团队从DeepMind实验室中移出,或将其独立调整组织架构。这一变动显示公司在强化AI治理与研发分工方面可能有新安排。(财联社)

谷歌AI竞赛告急,布林出手整顿DeepMind团队

消息称,谷歌共同创办人布林近几个月多次敦促公司核心AI团队全力推进Gemini研发,力求缩小Alphabet与竞争对手的差距。4月,在Anthropic凭借Claude Mythos预览版抢占先机时,布林还在一场有数百名员工参加的内部大会上要求Google DeepMind加快开发进度。

诺奖得主卸任DeepMind CEO,Jeff Dean转身创业,谷歌AI巨震

Google AI 近年从基础设施、神经网络到 TensorFlow 和 TPU 持续推进转型,Jeff Dean 被视为关键推动者。Demis Hassabis 卸任 Google DeepMind CEO 后,团队目标进一步指向更高阶的 AI 研究,聚焦用 AI 重塑科学发现,并向 ASI 迈进。Oriol Vinyals 作为 Gemini 核心负责人,也被视为重要人物。

字节跳动梁汝波:大语言模型坚持自研,短期落后也要接受

8月6日,梁汝波在字节2026年中全员会上表示,大语言模型与海外领先模型差距拉大,但公司仍将坚持自研、夯实基本功,接受短期落后,聚焦长期能力建设和AGI目标。谭待称,ToB场景只有SOTA模型才能率先释放高价值,Seedance 2.0已推动视频生成从“玩具”走向严肃商业生产。

谷歌AI领导层大调整:效力27年的AI元老离职,DeepMind创始人转任首席科学家

Alphabet宣布重组旗下AI部门:DeepMind创始人Demis Hassabis卸任CEO,改任董事长并兼任Alphabet首席科学家;任职27年的AI元老Jeff Dean离职创业,带走多名核心研究人员。DeepMind技术负责人Koray Kavukcuoglu将接管谷歌AI部门,主导Gemini 4研发,并直接向CEO皮查伊汇报。

暂无评论

暂无评论...