Chance AI发布全新视觉推理智能Chance Vision 1.5,能力再升级

19小时前更新 kw178
1 0 0

在 WAIC 2026 期间,视觉智能公司 Chance AI 正式发布新一代视觉推理智能 Chance Vision 1.5,并集中展示 Chance AI App 以及以摄像头为入口的 Camera-First Visual Agent 技术路径。

该模型在高难度多模态理解与推理基准 MMMU-Pro 官方公开榜单上取得 86.9% 的综合准确率,达到该基准的 SOTA 水平。

Chance AI发布全新视觉推理智能Chance Vision 1.5,能力再升级的封面图

相关快讯

开悟世界模型在RoboTwin 2.0具身智能评测中领先表现

大晓机器人推出的开悟世界模型(Kairos)在多个全球评测中表现卓越,分别在RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot和DreamGen等具身智能视频生成与状态预测领域中获得第一名。该模型采用了“多模态理解—生成—预测”的一体化架构,并已向整个行业开源。

阶跃星辰发布开源 Step 3.7 Flash 模型:每秒生成高达 400 Tokens

阶跃星辰发布并开源了 Step 3.7 Flash,这是为 Agent 生产化阶段设计的新一代模型。该模型经过系统优化,专注于 Agent、Coding、Search 和多模态工作流。Step 3.7 Flash 采用稀疏 MoE 架构,拥有196B+1.8B(ViT)总参数和11B激活参数,最高生成速度可达400 Tokens/s,适合高频、多轮和低延迟的应用。其主要功能包括原生多模态理解与执行,能够处理UI、图表、文档、图片及应用界面,将复杂视觉信息转化为结构化结果、代码生成及可执行任务。

商汤科技发布并开源全新SenseNova U1系列模型

商汤科技今天发布并开源了日日新SenseNova U1系列原生理解生成统一模型。该模型基于商汤于三月推出的NEO-unify架构,整合了多模态理解、推理与生成。SenseNova U1系列能够将语言与视觉信息作为统一复合体进行建模,实现高效的协同理解与生成能力,既保留丰富的语义,又维持像素级的视觉保真度。

阿里推出全新千问大语言模型Qwen3.6-Plus

阿里发布了新一代大语言模型Qwen3.6-Plus,具备原生多模态理解和推理能力。该模型在前端网页开发和复杂任务处理等实测场景中,能够自主拆解任务、规划路径并进行测试和修改,直至完成任务。Qwen3.6-Plus已在阿里云百炼上架,输入费用为每百万Tokens最低2元。同时,千问3.6也已在悟空、千问App等阿里AI平台上线。

Google被曝研发新一代服务器AI芯片,Gemini或将直接固化进硬件

Google正在研发代号“Frozen v2”的服务器芯片,计划将Gemini部分稳定、重复的计算路径直接固化进硬件。知情人士称,其每瓦Token输出能力或达现有自研AI芯片的6到10倍,最快2028年部署。若成功,Gemini推理成本可能大幅下降,但也面临模型架构变化带来的适配风险。

智谱1吉瓦AI数据中心建成,已启动部分运营

智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。

暂无评论

暂无评论...