Flova定义的Agent视频范式,正在成为新标杆

1天前更新 Content True
1 0 0

最近开始频繁用 Flova 制作一些 AI 小视频。观察下来会发现,不少 AI 视频产品的界面正变得越来越相似:从 Agent 的定位,到具体的交互方式、功能模块,再到整体操作流程,几乎都在向同一个方向收拢。

这种趋势,像极了当年 ChatGPT 刚出现之后的那一波变化——几乎所有对话类 AI 产品,都会先去模仿它的对话框布局,再在此基础上做自己的延展。

Flova定义的Agent视频范式,正在成为新标杆的封面图

相关快讯

阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms

阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。模型端到端延迟约 550ms,较常见实时语音对话系统更快;输出分辨率提升至 640×368@25FPS,微表情和细节表现更清晰。

谷歌 Google Vids 新增数字分身功能,轻松自导自演“AI 大片”

谷歌为 Google Vids 增加个人数字分身和 Gemini Omni 视频生成能力:用户可上传自拍和语音生成拟真虚拟形象,也能用文字和图片创建视频,或修改背景、光线与特效,并支持分步对话式编辑。此次升级让 Vids 从职场演示工具进一步转向完整视频创作平台,并与 HeyGen、Synthesia 等竞争。

豆包首款无限进步模型 Seed-Evolving 实测:真的告别版本号了?

火山引擎方舟上线了新模型 Doubao-Seed-Evolving,模型 ID 固定不变,但能力会高频持续升级。作者对这种“悄悄变强”的更新方式印象深刻,也特别提到豆包上下文窗口终于提升到 1M Tokens,更适合 Agent 场景使用。

Agent 创业公司的黄金时代,可能正在结束

文中提到,AI 产品竞争已进入拼技术、拼功能的阶段,模型与 Agent 持续提升应用想象力,但产品的“惊艳期”越来越短。2025 年 3 月发布的 Manus 以 Agent 执行任务、直接交付结果迅速出圈,随后又加入长期记忆引擎和多智能体协同等能力,上线 8 个月 ARR 便突破 1 亿美元,成为 AI 领域增长最快的初创产品之一。

Xmax AI 发布 X2.0:把视频变成可交互“玩”的界面

Xmax AI 源于 KEG 实验室这类顶级 AI 团队背景,2 月曾发布全球首个虚实融合实时交互视频模型 X1,引发海外关注但当时仍偏技术突破。5 个月后,Xmax AI 再推 X2.0 并开放商用 API,成为国内在实时编辑与交互视频模型方向落地最快、且唯一可规模化商用部署的公司。

阿里加码,AI视频赛道强势崛起

爱诗科技宣布完成整体C轮融资,累计融资达29.8亿元人民币,最新C+轮由阿里巴巴领投,十余家机构跟投。公司成立仅三年多便接近完成30亿元单轮融资,融资规模跻身国内AI视频与大模型领域第一梯队,也反映出AI视频正成为AI商业落地的重要赛道。

暂无评论

暂无评论...