智源宣布FlagOS成功适配DeepSeekV4八款芯片

3个月前更新 zmtzn
6 0 0

DeepSeek今日推出了DeepSeek-V4-Pro旗舰模型,参数量达到1.86万亿,以及高效模型DeepSeek-V4-Flash,参数为2840亿。由智源研究院主导的众智FlagOS迅速对这两个模型进行了全面适配,成功实现DeepSeek-V4-Flash在超过8款AI芯片上的推理部署,涵盖海光、沐曦、华为昇腾、摩尔线程(FP8)、昆仑芯、平头哥真武、天数和英伟达(FP8)等。与此同时,FlagOS也在积极推进DeepSeek-V4-Pro模型在多个芯片上的迁移适配,后续将开源。

智源宣布FlagOS成功适配DeepSeekV4八款芯片的封面图

相关快讯

微软与AMD扩大合作:Azure将部署下一代AI芯片

AMD正扩大与微软的战略合作,微软将把AMD下一代AI芯片和处理器部署到Azure云上,并采用Helios机架级AI平台,为自家AI服务及Azure客户的前沿模型推理提供算力。AMD预计将于2026年下半年开始向包括微软在内的客户出货Helios平台。

谷歌研发新型“Frozen”芯片,Gemini AI运行效率大幅提升

谷歌正研发内部代号“Frozen v2”的新型服务器芯片,计划将Gemini AI模型设计蓝图直接集成其中,以提升AI服务效率并缓解算力短缺。知情人士称,这款芯片按单位功耗可处理的Token效率,预计将比谷歌现有最新自研AI芯片高出6至10倍,也有助于缓解内部资源争夺并改善云业务接单能力。

谷歌推出新型“Frozen”芯片,显著提升Gemini AI运行效率

谷歌正研发代号“Frozen v2”的新型服务器芯片,计划将Gemini AI模型设计蓝图直接集成其中,以提升AI服务效率并缓解算力短缺。该问题已引发内部资源争夺,甚至导致谷歌云拒绝部分外部客户合作。

DeepSeek V4「满血版」曝光:最快明天发布

DeepSeek V4正式版预计最早明日、最迟这几天发布,部分用户已获GA灰度测试权限,首轮demo也开始外流。新版本首次引入“峰谷计费”,体验被认为依旧很强,但能否再造“DeepSeek时刻”,关键仍在价格。上月底官方已邮件通知,V4将于7月中旬上线。

英伟达销售体系迎来新变局:微软26年老将加盟执掌销售业务

英伟达任命一位在微软任职 26 年的高管负责全球销售,释放出其不满足于 AI 芯片领先地位、正布局下一阶段增长的信号。未来重点不只是卖出更多芯片,而是帮助客户把 AI 真正落地到业务中。

国科微拟定增募资不超50.61亿元,加码新一代AI视觉芯片研发产业化

国科微拟向不超过35名特定对象发行股票,募集资金不超过50.61亿元,主要投向新一代AI视觉处理芯片、媒体交互AI芯片、端侧AI芯片研发及产业化项目,并补充流动资金。此次发行数量不超过6513.07万股,旨在增强AI芯片研发与产业化能力,支持业务发展和市场拓展。

暂无评论

暂无评论...