Chance AI发布全新视觉推理智能Chance Vision 1.5,能力再升级

2个月前更新 kw178
40 0 0

在 WAIC 2026 期间,视觉智能公司 Chance AI 正式发布新一代视觉推理智能 Chance Vision 1.5,并集中展示 Chance AI App 以及以摄像头为入口的 Camera-First Visual Agent 技术路径。

该模型在高难度多模态理解与推理基准 MMMU-Pro 官方公开榜单上取得 86.9% 的综合准确率,达到该基准的 SOTA 水平。

Chance AI发布全新视觉推理智能Chance Vision 1.5,能力再升级的封面图

相关快讯

美图RoboNeo接入MiniMax H3,新增局部编辑与多模态理解

美图旗下RoboNeo正式接入MiniMax H3,进一步提升多模态理解能力,可处理文字、图片、视频和音频等输入。此次升级还增强了视频局部编辑能力,支持人物替换、物体增减、背景修改、特效调整、音色迁移及台词修改等功能。

中国医疗AI再登顶,微信“私人医生”迎来重磅升级

过去十年医疗AI经历两次范式跃迁:先是基于数字化医学文献获得知识检索能力,后是通过WiseDiag V2等升级实现对影像、报告、化验单和体征照片的多模态理解。2026年7月底发布的WiseDiag V3与好伴AI,进一步夯实了医疗AI“看得见、看得懂”的统一推理基础。

开悟世界模型在RoboTwin 2.0具身智能评测中领先表现

大晓机器人推出的开悟世界模型(Kairos)在多个全球评测中表现卓越,分别在RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot和DreamGen等具身智能视频生成与状态预测领域中获得第一名。该模型采用了“多模态理解—生成—预测”的一体化架构,并已向整个行业开源。

阶跃星辰发布开源 Step 3.7 Flash 模型:每秒生成高达 400 Tokens

阶跃星辰发布并开源了 Step 3.7 Flash,这是为 Agent 生产化阶段设计的新一代模型。该模型经过系统优化,专注于 Agent、Coding、Search 和多模态工作流。Step 3.7 Flash 采用稀疏 MoE 架构,拥有196B+1.8B(ViT)总参数和11B激活参数,最高生成速度可达400 Tokens/s,适合高频、多轮和低延迟的应用。其主要功能包括原生多模态理解与执行,能够处理UI、图表、文档、图片及应用界面,将复杂视觉信息转化为结构化结果、代码生成及可执行任务。

商汤科技发布并开源全新SenseNova U1系列模型

商汤科技今天发布并开源了日日新SenseNova U1系列原生理解生成统一模型。该模型基于商汤于三月推出的NEO-unify架构,整合了多模态理解、推理与生成。SenseNova U1系列能够将语言与视觉信息作为统一复合体进行建模,实现高效的协同理解与生成能力,既保留丰富的语义,又维持像素级的视觉保真度。

阿里推出全新千问大语言模型Qwen3.6-Plus

阿里发布了新一代大语言模型Qwen3.6-Plus,具备原生多模态理解和推理能力。该模型在前端网页开发和复杂任务处理等实测场景中,能够自主拆解任务、规划路径并进行测试和修改,直至完成任务。Qwen3.6-Plus已在阿里云百炼上架,输入费用为每百万Tokens最低2元。同时,千问3.6也已在悟空、千问App等阿里AI平台上线。

暂无评论

暂无评论...