智源宣布FlagOS成功适配DeepSeekV4八款芯片

5个月前更新 zmtzn
9 0 0

DeepSeek今日推出了DeepSeek-V4-Pro旗舰模型,参数量达到1.86万亿,以及高效模型DeepSeek-V4-Flash,参数为2840亿。由智源研究院主导的众智FlagOS迅速对这两个模型进行了全面适配,成功实现DeepSeek-V4-Flash在超过8款AI芯片上的推理部署,涵盖海光、沐曦、华为昇腾、摩尔线程(FP8)、昆仑芯、平头哥真武、天数和英伟达(FP8)等。与此同时,FlagOS也在积极推进DeepSeek-V4-Pro模型在多个芯片上的迁移适配,后续将开源。

智源宣布FlagOS成功适配DeepSeekV4八款芯片的封面图

相关快讯

**Optimizing Chinese news headline** 燧原科技董事长最新发声:算力需求正迎来爆发式增长

**Planning concise Chinese summary** 燧原科技董事长赵立东表示,公司8年来持续聚焦云端AI芯片,已完成四代架构、五款芯片迭代,并形成覆盖芯片、加速卡、超节点、智算集群和软件平台的完整体系。公司希望借助资本增强自主创新与业务扩展能力,提升在AI与集成电路产业链中的影响力。赵立东认为,AI产业已进入下半场,全球算力需求正爆发式增长。

黄仁勋:VeraRubin平台或为英伟达带来每吉瓦超400亿美元营收

8月31日,英伟达CEO黄仁勋表示,Vera Rubin平台有望为英伟达带来巨大商业价值,按每吉瓦计算营收可超过400亿美元,显示其在AI算力基础设施领域的强劲变现能力。

DeepSeek今年前7个月营收近4.75亿元,已达去年全年约10倍水平

据 The Information 援引知情人士消息,DeepSeek 今年前七个月营收约 4.75 亿元,已约为 2025 年全年营收的 10 倍;同期净亏损约 7.15 亿元,接近去年全年亏损的 9.35 亿元。尽管其收入规模仍明显低于 Anthropic、OpenAI 等海外厂商,但毛利率已较为健康,主要得益于模型运行成本得到有效控制。

OpenAI自研AI芯片测试表现超越英伟达GB300,芯片布局再进一步

OpenAI于8月25日宣布,全新Jalapeno芯片在测试中表现优于英伟达现有产品线,主要体现在两项指标:单位功耗下可处理更多AI工作负载,以及更快的响应速度。相关结果显示,Jalapeno在能效与性能响应方面具备优势,但目前仍处于测试阶段,最终表现和商业化情况尚待进一步验证。

英伟达AI芯片价格或涨17%,服务器厂商已通知客户

据知情人士透露,服务器厂商已通知客户,英伟达部分旗舰AI服务器芯片系统价格预计上调约17%。涨价主要涉及将于明年交付的Grace Blackwell 300和Vera Rubin 200系统。按当前报价估算,若建设一座1吉瓦数据中心,成本至少将增加50亿美元。

小米发布国内首款3nm智驾高算力AI芯片玄戒D100

小米集团发布国内首款3nm智驾高算力AI芯片玄戒D100,采用3nm工艺,配备20核CPU和16核NPU,最高支持160GB统一内存,可本地部署200B参数大模型。该芯片已研发完成,计划于明年正式商用。

暂无评论

暂无评论...