蚂蚁灵波开源具身智能视频生成基础模型 LingBot-Video

2周前更新 xiaoshan
9 0 0

蚂蚁灵波今天正式开源 LingBot-Video,这是一款全球首个基于 MoE 架构、面向具身智能场景的开源视频生成基础模型。该模型整合了 7 万小时具身数据,并围绕机器人任务的核心诉求重新设计视频预训练范式,在推理效率、物理合理性、动作理解以及任务完成度等方面实现系统性提升,为视频基础模型从数字内容创作进一步迈向具身智能应用提供了新的底座。

在评测表现上,LingBot-Video 于北大联合字节发布的 RBench 中取得总分 0.620,成绩超过 Wan2.6、Seedance 1.5 Pro 和 Cosmos3 Super。

蚂蚁灵波开源具身智能视频生成基础模型 LingBot-Video的封面图

相关快讯

深庭纪正式发布户外具身智能架构 SWAN

深庭纪正式发布户外伴随机器人专属具身智能架构SWAN,可在端侧实时运行。该架构由模型推理主链、混合记忆身份数据库和安全数据飞轮系统组成,形成实时决策、长期记忆与安全迭代闭环。SWAN将首发用于其消费级双轮足户外陪伴机器人Rovar,预计年底上市,公司目前已完成Pre-A轮融资。

具识智能发布全球首个具身语义智能体系统,推动AI进入新阶段

具识智能正式发布全球首个具身语义智能体系统 insightOS Semantic,并同步推出开发者生态社区与培育计划。该系统已在售货仓取货配送、拆码垛搬运、多机协同流水线和定时巡检等真实物理场景中完成验证,显示出落地应用能力。

Kimi K3发布后,真正坐不住的不是英伟达

月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。

机器人会干活了,行业更需要“刁钻坏人”来找漏洞

2026年WAIC上,观众对机器人不再只看唱歌跳舞,而更关注它们能否真正干活、性能如何。展馆里,具身智能公司集中展示泡茶、叠衣服、搬箱子、整理物品等能力,并把汽车工厂、物流分拣、3C制造、智慧药房等真实场景搬进展区,体现行业从“表演”转向“应用落地”。

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

影身智能携手多家越南企业达成战略合作,首批交付数百台机器人

杭州影身智能与宝龙鞋业、顺斐鞋业、越韩鞋业等越南制鞋企业达成战略合作,将交付ShadowGlue和ShadowPress两款制鞋具身机器人。首批出口数百台,订单金额达数千万元,助力越南制鞋产线向柔性化、智能化升级。

暂无评论

暂无评论...