小鹏正式发布 TuringViT 高效视觉编码器

2小时前更新 routerbase
1 0 0

近日,小鹏正式推出 TuringViT 高效视觉编码器,面向 VLM/VLA 时代,对视觉编码器的架构设计、数据范式与训练流程进行系统性重构。该编码器将全面支撑智能驾驶、智能座舱以及 IRON 人形机器人三大业务场景。

小鹏正式发布 TuringViT 高效视觉编码器的封面图

相关快讯

腾讯官宣:OpenAI前研究员田永龙入职,参与VLM研发

腾讯近期再从OpenAI引入人才,前研究员Yonglong Tian已加入腾讯大语言模型部,后续将参与VLM研发。这被视为腾讯再次“挖角”OpenAI。去年腾讯已升级大模型架构,并任命前OpenAI高级研究员姚顺雨担任首席AI科学家及相关部门负责人。

小鹏与福耀携手推出首款量产AI调光隐私玻璃

4月10日,小鹏集团与福耀集团在福州举行活动,正式发布了双方共同研发的AI调光隐私玻璃,并完成首块量产交付。这种玻璃具有变光快速、强隐私保护、高防晒能力和长寿命等七大核心性能,首批将应用于小鹏GX车型。

Magic Leap 转型 AI 智能眼镜光波导供应商,同步裁员近 200 人

Magic Leap 再次转型,停止研发自有 AR 头显,改为聚焦 AR 光波导技术供应,为其他厂商的 AI 智能眼镜提供核心显示方案。公司未来将以生态合作伙伴、光波导供应商和整机集成方案提供者的身份,帮助合作伙伴更快推出面向大众市场的产品。

腾讯、阿里、字节齐发力,AI办公大战全面打响

腾讯旗下AI办公智能体WorkBuddy在2026年6月月活访问量达2097万,较4个月前增长显著,并在易观Q2报告中位居17款主流产品首位,领先第二、第三名总和。同时,腾讯、字节、阿里等大厂加速整合旗下AI产品;腾讯QClaw相关业务和部分团队也将调整至云产品六部,与WorkBuddy纳入同一体系,但产品仍独立运营。

谷歌 DeepMind 发布 GenCeption:基于阿里 Wan2.1 的计算机视觉新突破

谷歌 DeepMind 发布 GenCeption,尝试把预训练的视频生成模型改造为通用视觉基础模型,用于深度估计、分割等经典任务。其思路借鉴大语言模型通过预测下一个 Token 学习语法和知识,但视觉领域长期缺少类似训练范式,因此一直依赖 Segment Anything、Depth Anything 这类面向单一任务的专用模型。

月之暗面:B端七成收入来自API调用,已跑通可持续正向循环

月之暗面即将上线 Kimi Hosted Agent 平台,面向企业客户开放沙箱和 Harness 能力,提供 PPT 生成、投研系统搭建等标准化 API,并支持自定义输出风格、嵌入内部办公系统。公司当前 B 端收入以 API 调用为主,占比达 70%,商业化路径较为清晰,已形成持续增长的正向循环。

暂无评论

暂无评论...