09
7 月
KernelBench-Mega最新GPU算子测试显示,Fable 5以18.7倍表现领先,远超Claude Opus 4.8的14.4倍和GPT-5.5的4.34倍,号称写出了全球最快的底层代码,速度与代码纯度都很突出。
大厂面试官现在最爱问:你怎么用AI干活?
2个月前她在2026年春招中投递两百多家市场、品牌岗,跨界底气来自AI工具。2025年外企实习时,她借助ChatGPT和Claude边学边做,完成了原本难以胜任的分析报告。如今,AI能力已从技术岗延伸到市场、运营、行政等几乎所有岗位,成为招聘中的重要加分项。
机器人为什么要拟人?这个回答终于说清了
2个月前英伟达在 GTC 台北大会发布 Isaac GR00T 人形机器人参考平台,标志着“机器人本体是 AI 基础设施”正式进入其战略路线。为突破具身智能的数据瓶颈,智元机器人等企业正加速建设大规模数据采集工厂和中心,尝试把人类自然动作转化为训练数据。黄仁勋也认为,因更易获得模仿数据,下一代机器人很可能是人形。
英国一台名为 Dawn 的强力 AI 超算在 30 多度高温下宕机一周,引发关注。它位于剑桥大学,是英国国家 AI 算力计划的重要组成部分,配备 1024 块 Intel GPU 和 256 台液冷服务器,已支持 350 多个科研项目,常用于快速筛查海量分子,寻找治疗帕金森等疾病的候选化合物。
字节跳动Seed团队发布多模态图像创作模型Seedream 5.0 Pro,已上线火山方舟体验中心,后续将陆续登陆豆包和即梦。实测显示,该模型在商业海报、真实摄影和精准编辑等场景表现稳定,也能生成部分接近“真假难辨”的高拟真图像效果。
阶跃星辰宣布将推出新一代智能体终端,并被曝将发布AI终端品牌、智能体系统及首款AI智能体手机,抢先于OpenAI布局落地。知情人士称,该手机由华勤技术代工生产,双方为深度绑定合作,并非普通贴牌模式。
马斯克旗下 SpaceXAI 发布旗舰模型 Grok 4.5,称其性能大致相当于 Opus 4.7,但速度更快。该模型由数万块 GB300 训练而成,被视为上市后的首张王牌。马斯克还预告,下周其上下文长度将升级到 100 万。Grok 4.5 基于 V9(1.5T)底座,并在训练中喂入了数以万亿计的 Cursor 数据,体现出其在数据和算力上的重投入。
AI商业化:为什么大厂总算不清这笔账
2个月前某公司因内部AI需求增长,上半年对接多家国内供应商后选定一家并签约,却在当天下午遭遇对方临时变更计费方式,要求从按次付费改为纯Token计费,导致采购成本或增至5倍。公司因此拉黑该供应商并更换合作方。此事也反映出国内AI商用付费模式仍在磨合中,供应商需平衡算力成本、生态差异与商业惯性。
AI让“造艺人”变成大众游戏
2个月前今年上半年,AI艺人产业加速成形:Yuri获得全国首张AI角色“数字身份证”,桥桥子等AI脱口秀演员快速涨粉,麦橘团队的人脸“角色资产库”被平台和影视游戏批量采购。B站、汽水音乐等平台也推出扶持通道,带动AI歌手、AI演员等角色涌现,虚拟人赛道持续扩张。
据知情人士透露,阶跃星辰将推出AI智能体手机,由A股上市公司华勤技术代工生产。双方合作关系较深,并非普通贴牌代工。华勤技术在智能手机、笔记本和平板等出货量方面均超过全球10%。
研究指出,AI 超级周期正推动组织范式从“多人协作”转向以单人为核心的 OPX(One-Person X)模式:少数人负责决策与价值判断,AI 智能体集群承担执行与产出。同时,IDC 预测 2026 年中国 PC 市场出货量约 4038 万台,同比微降 6.1%,整体规模小幅收缩。
乱用AI,打工人到底被坑得有多惨
2个月前AI已深度融入日常工作,成为写方案、生成文书、编代码的“随叫随到的实习生”,其高效交付常让人产生“掌握魔法”的错觉。但它也会编造竞品、数据和法条,甚至擅自改代码,最危险之处正是答案太像真的,容易让人放松警惕。
为什么品牌再有名,系统也可能“看不见”
2个月前当消费者开始向AI询问“买什么”时,品牌竞争规则正在改变。研究发现,Nike、迪士尼等知名品牌在AI推荐中未必占优,反而可能输给小众品牌。关键不再是谁最有名,而是谁的品牌属性更清晰、证据更可验证、最容易被AI读懂,从而被纳入推荐。
OpenAI 上线新一代语音模型 GPT-Live,进一步升级 ChatGPT Voice。它采用全双工架构,可同时听和说,能用“mhmm”“yeah”等自然回应参与快速对话,也会在用户思考时保持安静,带来更轻松自然的语音交互体验。OpenAI 称其为目前最智能的语音模型。
蚂蚁灵波开源全球首个基于MoE架构、面向具身智能的视频生成基础模型LingBot-Video。该模型融合7万小时具身数据,重构视频预训练范式,在推理效率、物理合理性、动作理解和任务完成度上提升明显,并为视频基模迈向具身智能提供新底座。在RBench评测中总分0.620,超过Wan2.6、Seedance 1.5 Pro和Cosmos3 Super。
SpaceXAI 正式发布 Grok 4.5,这是其首个专为编程和智能体任务训练的模型,由 SpaceXAI 与 Cursor 联合训练。该模型主打前沿智能、速度和成本效率,被马斯克称为“Opus 级模型”,适用于大型代码库、多仓库协作及长时间复杂任务,并在数万块 NVIDIA GB300 GPU 上完成训练,数据处理上强调去重、质量评分和领域聚焦。
MXC600 是沐曦股份今年的主力芯片,已开始大规模出货。该芯片定位为新一代 AI 训练推理旗舰,采用自研 GPU 架构,并在设计、制造、封装及软件栈上实现全国产化。基于 MXC600,沐曦还推出了曦云 C600、曦思 N300 和曦索 X300 系列产品,且该芯片已于 5 月 26 日通过国家《安全可靠测评》。
亚马逊正研发代号 Moonraker 的新 Alexa 项目,目标是让语音助手能处理更复杂的多步骤任务,向 AI 智能体方向升级。此前亚马逊已于 2025 年 2 月推出基于生成式 AI 重建的 Alexa+,这是自 2014 年首代 Alexa 以来最大更新。内部文件还显示,该项目被列为“最高成本”新项目,预计 2026 年 GPU 算力开销将超过 1 亿美元。
字节跳动Seed团队正式发布多模态图像创作模型Seedream 5.0 Pro,距5.0预览版上线约5个月。新版本在图文匹配、结构合理性、文字渲染和画面美感等基础能力上升级,并重点增强复杂信息可视化、交互式精准编辑、真实影像与人像质感以及原生多语种输入与生成能力。API按输入图和输出图计费,输出图不超过236万像素时,首张输入图免费,后续输入图0.02元/张,输出图0.3元/张。
SpaceXAI正式发布Grok 4.5,这是其首个面向编程和智能体任务训练的大模型,由SpaceXAI与Cursor联合训练,使用数万台英伟达GB300 GPU。该模型覆盖编程、科学、工程和数学等数据,定价为输入每百万Token 2美元、输出6美元,低于同类模型一半。目前已接入SpaceXAI控制台、Grok Build和Cursor,并成为Grok Build默认模型,欧盟地区预计7月中旬开放。
OpenAI 刚推出新一代语音模型 GPT-Live,旨在改善 AI 语音助手常见的打断、误判说完等问题,让语音交流更自然流畅,不再像“你一句我一句”的回合制对话。官方称,ChatGPT 语音和听写功能每周已有超 1.5 亿用户,广泛用于外语练习、讲睡前故事和通勤消遣。
OpenAI推出新一代语音模型GPT-Live,采用全双工架构,可实现边听边说的实时交互。该模型将提供两个版本:GPT-Live-1和更轻量的GPT-Live-1 mini,满足不同场景的使用需求。
腾讯混元公告称,Hy3 在 WorkBuddy 首发后调用量迅速上涨,7 月 8 日上午算力消耗达到峰值,下午排队率一度超过 50%。为保障使用体验和稳定服务,官方已紧急调度资源并完成扩容。此前,Hy3 模型已于 7 月 6 日开源发布。
商务部等9部门印发意见,提出加快零售业创新发展,支持零售主体数字化改造,推动进销存、物流配送等全链条数字化,打通线上线下渠道与数据。鼓励平台和科技企业为中小零售提供技术赋能和综合解决方案,推广“人工智能+”应用,拓展智能导购、低空配送、无人售货等场景,并推动数字人民币用于消费券发放和结算。