相关快讯
开悟世界模型在RoboTwin 2.0具身智能评测中领先表现
大晓机器人推出的开悟世界模型(Kairos)在多个全球评测中表现卓越,分别在RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot和DreamGen等具身智能视频生成与状态预测领域中获得第一名。该模型采用了“多模态理解—生成—预测”的一体化架构,并已向整个行业开源。
阶跃星辰发布开源 Step 3.7 Flash 模型:每秒生成高达 400 Tokens
阶跃星辰发布并开源了 Step 3.7 Flash,这是为 Agent 生产化阶段设计的新一代模型。该模型经过系统优化,专注于 Agent、Coding、Search 和多模态工作流。Step 3.7 Flash 采用稀疏 MoE 架构,拥有196B+1.8B(ViT)总参数和11B激活参数,最高生成速度可达400 Tokens/s,适合高频、多轮和低延迟的应用。其主要功能包括原生多模态理解与执行,能够处理UI、图表、文档、图片及应用界面,将复杂视觉信息转化为结构化结果、代码生成及可执行任务。
商汤科技发布并开源全新SenseNova U1系列模型
商汤科技今天发布并开源了日日新SenseNova U1系列原生理解生成统一模型。该模型基于商汤于三月推出的NEO-unify架构,整合了多模态理解、推理与生成。SenseNova U1系列能够将语言与视觉信息作为统一复合体进行建模,实现高效的协同理解与生成能力,既保留丰富的语义,又维持像素级的视觉保真度。
阿里推出全新千问大语言模型Qwen3.6-Plus
阿里发布了新一代大语言模型Qwen3.6-Plus,具备原生多模态理解和推理能力。该模型在前端网页开发和复杂任务处理等实测场景中,能够自主拆解任务、规划路径并进行测试和修改,直至完成任务。Qwen3.6-Plus已在阿里云百炼上架,输入费用为每百万Tokens最低2元。同时,千问3.6也已在悟空、千问App等阿里AI平台上线。
Google被曝研发新一代服务器AI芯片,Gemini或将直接固化进硬件
Google正在研发代号“Frozen v2”的服务器芯片,计划将Gemini部分稳定、重复的计算路径直接固化进硬件。知情人士称,其每瓦Token输出能力或达现有自研AI芯片的6到10倍,最快2028年部署。若成功,Gemini推理成本可能大幅下降,但也面临模型架构变化带来的适配风险。
智谱1吉瓦AI数据中心建成,已启动部分运营
智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。
