相关快讯
阿里视频大模型Wan3.0正式上线,视频生成能力再升级
8月24日,阿里巴巴视频生成大模型Wan3.0正式上线。新版本在生成时长、创作能力、参考能力和真实世界还原效果等方面全面升级,单次可生成最长30秒视频,并首次支持doc、xls、ppt、pdf、md等多种文档格式输入,进一步拓展了视频创作的应用场景。
7亿年薪留不住,余家辉为何转身创业?
余家辉在加入Meta一年多后宣布离职创业,并已更新个人网站履历。他曾带领多模态团队连续推出Muse Spark、Voice Mode、Muse Image和Muse Video等成果。其离职声明称,参与TBD Lab建设很受启发,也更坚定投身于一项对人类未来重要、但仍待深入探索的方向。
即梦AI推出Maya/Blender等插件,适配Seeance2.5加速专业场景落地
即梦AI首发上线Seedance2.5,并强化专业视频创作能力:支持最长3分钟超长生成,网页版新增“智能编辑”模式,更适合局部增删改;多帧编辑可细调成片细节,同时推出Maya/Blender插件,打通三维资产、绿幕素材与AI创作流程。
阿里云Qwen-Image-3.0正式上线千问AI平台
阿里巴巴千问图像生成模型Qwen-Image-3.0已正式上线千问AI平台,面向所有用户开放。旗舰版Pro和标准版Standard同步开放API,文生图价格0.18元/张起,海外用户可通过Qwen Cloud接入。该模型在Arena.ai最新文生图榜单中位列国内第一。
DeeVid AI悄然跻身第一梯队,斩获3000万欧美用户
DeeVid AI 是一款面向欧美市场的 AI 视频 Agent 产品,上线一年半已积累 3000 万注册用户,ARR 达数千万美元。它支持图片、音频、视频一体化生成,并可通过对话式 Agent 模式创建与引用 Skill、添加参考资料。整体体验主打“省心”,由 Agent 负责理解需求、拆解任务并在关键节点让用户确认。
阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms
阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。模型端到端延迟约 550ms,较常见实时语音对话系统更快;输出分辨率提升至 640×368@25FPS,微表情和细节表现更清晰。
