就在昨天,整个 AI 圈还笼罩在一片高涨情绪中。各路爆料接连涌现:谷歌的“终极武器” Gemini 3.5 Pro,代号 “Cappuccino”,据称将在 48 小时内正式上线。200 万的超大上下文窗口、全新的“深度思考”推理模式,再加上传闻中已在内部评测里全面压过 GPT-5.6 Sol 和 Claude Fable 5,这一切都让它看起来像是一款足以改写 AI 格局的重磅产品。彼时,所有人都在兴奋倒计时,摩拳擦掌,只等见证历史时刻。
然而,等到一觉醒来,局面却急转直下。最新消息像一盆冷水,瞬间浇灭了前一晚积攒的热度:Gemini 3.5 Pro 的发布被延期了,而且不是推迟几天,而是直接拖延数月。原本有望载入史册的发布节奏,被谷歌自己按下了暂停键。
相关快讯
智谱1吉瓦AI数据中心建成,已启动部分运营
智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。
Kimi K3发布后,真正坐不住的不是英伟达
月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。
谷歌研发新型“Frozen”芯片,Gemini AI运行效率大幅提升
谷歌正研发内部代号“Frozen v2”的新型服务器芯片,计划将Gemini AI模型设计蓝图直接集成其中,以提升AI服务效率并缓解算力短缺。知情人士称,这款芯片按单位功耗可处理的Token效率,预计将比谷歌现有最新自研AI芯片高出6至10倍,也有助于缓解内部资源争夺并改善云业务接单能力。
千问发布语音合成大模型 Qwen-Audio-3.0-TTS
千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。
千问为何还是不够自信?
这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。
谷歌推出新型“Frozen”芯片,显著提升Gemini AI运行效率
谷歌正研发代号“Frozen v2”的新型服务器芯片,计划将Gemini AI模型设计蓝图直接集成其中,以提升AI服务效率并缓解算力短缺。该问题已引发内部资源争夺,甚至导致谷歌云拒绝部分外部客户合作。