相关快讯
Chance AI发布全新视觉推理智能Chance Vision 1.5,能力再升级
在WAIC 2026期间,Chance AI发布新一代视觉推理智能Chance Vision 1.5,并展示Chance AI App及以摄像头为入口的Camera-First Visual Agent技术路线。该模型在高难度多模态理解与推理基准MMMU-Pro官方榜单取得86.9%综合准确率,达到SOTA水平。
OpenAI科学家访谈:AI时代真正重要的,是好奇心和实验精神
免疫学家Derya Unutmaz借助Codex等AI工具,从零开发了流式细胞术分析、CRISPR设计和T细胞通路模拟等科研工具,显示AI正深度重塑科研与医疗。他认为,AI将以指数级速度推动医学突破,未来十年可能治愈多数疾病,15年内甚至有望逆转衰老。
开悟世界模型在RoboTwin 2.0具身智能评测中领先表现
大晓机器人推出的开悟世界模型(Kairos)在多个全球评测中表现卓越,分别在RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot和DreamGen等具身智能视频生成与状态预测领域中获得第一名。该模型采用了“多模态理解—生成—预测”的一体化架构,并已向整个行业开源。
阶跃星辰发布开源 Step 3.7 Flash 模型:每秒生成高达 400 Tokens
阶跃星辰发布并开源了 Step 3.7 Flash,这是为 Agent 生产化阶段设计的新一代模型。该模型经过系统优化,专注于 Agent、Coding、Search 和多模态工作流。Step 3.7 Flash 采用稀疏 MoE 架构,拥有196B+1.8B(ViT)总参数和11B激活参数,最高生成速度可达400 Tokens/s,适合高频、多轮和低延迟的应用。其主要功能包括原生多模态理解与执行,能够处理UI、图表、文档、图片及应用界面,将复杂视觉信息转化为结构化结果、代码生成及可执行任务。
商汤科技发布并开源全新SenseNova U1系列模型
商汤科技今天发布并开源了日日新SenseNova U1系列原生理解生成统一模型。该模型基于商汤于三月推出的NEO-unify架构,整合了多模态理解、推理与生成。SenseNova U1系列能够将语言与视觉信息作为统一复合体进行建模,实现高效的协同理解与生成能力,既保留丰富的语义,又维持像素级的视觉保真度。
阿里推出全新千问大语言模型Qwen3.6-Plus
阿里发布了新一代大语言模型Qwen3.6-Plus,具备原生多模态理解和推理能力。该模型在前端网页开发和复杂任务处理等实测场景中,能够自主拆解任务、规划路径并进行测试和修改,直至完成任务。Qwen3.6-Plus已在阿里云百炼上架,输入费用为每百万Tokens最低2元。同时,千问3.6也已在悟空、千问App等阿里AI平台上线。
