一口气连发三款,谷歌这次几乎不再遮掩。
今天,谷歌 DeepMind 一次性抛出三张新牌:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber。一个是更强的主力版本,一个是更快的轻量版本,还有一个则是专门面向漏洞防护的安全特种模型。
这三款 Gemini 的共同指向非常明确:让部署在生产环境中的 AI Agent 跑得更快、变得更聪明,同时把成本压得更低。
更值得注意的是,就在同一天,谷歌还放出了一则更重磅的消息——谷歌 DeepMind 已经启动“史上最激进的一次预训练”,目标直指下一代模型 Gemini 4。
一边是 Gemini 三连发密集登场,一边是 Gemini 4 预训练同步开跑。谷歌释放的信号已经足够清楚:AI 这场终极牌局,真正的高潮才刚开始。
相关快讯
腾讯、阿里、字节齐发力,AI办公大战全面打响
腾讯旗下AI办公智能体WorkBuddy在2026年6月月活访问量达2097万,较4个月前增长显著,并在易观Q2报告中位居17款主流产品首位,领先第二、第三名总和。同时,腾讯、字节、阿里等大厂加速整合旗下AI产品;腾讯QClaw相关业务和部分团队也将调整至云产品六部,与WorkBuddy纳入同一体系,但产品仍独立运营。
谷歌 DeepMind 发布 GenCeption:基于阿里 Wan2.1 的计算机视觉新突破
谷歌 DeepMind 发布 GenCeption,尝试把预训练的视频生成模型改造为通用视觉基础模型,用于深度估计、分割等经典任务。其思路借鉴大语言模型通过预测下一个 Token 学习语法和知识,但视觉领域长期缺少类似训练范式,因此一直依赖 Segment Anything、Depth Anything 这类面向单一任务的专用模型。
阿里斩获 ACL 2026 最佳资源论文奖:揭示 AI Agent 专家能力鸿沟
阿里巴巴 ATH-MaaS 应用算法团队围绕 Deep Research Agent 的研究成果 HSCodeComp,摘得 ACL 2026 最佳资源论文奖。该奖项全球仅 4 篇,HSCodeComp 还是其中唯一来自中国公司的论文,体现了其在检索、工具调用和多步推理方向的领先价值。
所有人都在卷 Coding Agent,商汤:下一个能真正“交付”的行业是设计
过去一年,AI 最确定的突破发生在 Coding,从 Copilot 到 Agentic Coding,代码率先被 AI 打穿。商汤在 2026 WAIC 发布 SenseNova U1 Pro,定位为面向长程任务的交付级原生多模态 Agent 基座,首站瞄准设计行业。相比已火两年的 AI 生图,现有工具虽惊艳但离专业工作流仍有距离,商业化仍受限制。
京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型
7月18日,京东以“AI进入物理世界”为主题亮相上海世博展览馆,首次系统展示面向物理世界的JoyAI模型矩阵,并推出JoyAI-Talker实时语音交互模型和JoyAI-Video-Edit实时视频编辑模型。官方称,JoyAI-Talker具备低延迟对话、情绪理解、工具调用和记忆等能力,推动AI从执行指令走向理解人类意图与状态。
突发叫停:Gemini 3.5 Pro难产,谷歌陷入失望风波
昨日韩国外界盛传谷歌即将上线 Gemini 3.5 Pro“Cappuccino”,主打200万上下文窗口和“深度思考”模式,甚至被认为会改写AI格局。但随后消息反转,发布计划并未如期推进,而是被谷歌大幅延期数月,令原本高涨的期待迅速降温。