北美CSP大规模采购NVIDIA GB/Rubin整柜式方案,2026年AI推理算力预计提升1.2倍

2个月前更新 775800
3 0 0

5月20日讯,TrendForce集邦咨询发布的最新AI产业研究显示,预计到2026年,AI训练机型将占AI服务器出货的约55%,而中长期内市场主力将转向AI推理机型。根据北美五大云服务提供商(CSP)所构建的GB/VR整柜式方案分析,预计到2026年,这五大厂商的AI训练算力将实现超过56%的年增长,而AI推理算力则将激增约122%。同时,NVIDIA(英伟达)、AMD(超威)及CSP自研ASIC平台将在2026年同步推出,推动五大CSP服务器功耗年增116%。

北美CSP大规模采购NVIDIA GB/Rubin整柜式方案,2026年AI推理算力预计提升1.2倍的封面图

相关快讯

机器人为什么要拟人?这个回答终于说清了

英伟达在 GTC 台北大会发布 Isaac GR00T 人形机器人参考平台,标志着“机器人本体是 AI 基础设施”正式进入其战略路线。为突破具身智能的数据瓶颈,智元机器人等企业正加速建设大规模数据采集工厂和中心,尝试把人类自然动作转化为训练数据。黄仁勋也认为,因更易获得模仿数据,下一代机器人很可能是人形。

摩尔线程完成美团 LongCat-2.0 Day-0 极速适配

美团正式开源万亿参数大模型 LongCat-2.0,摩尔线程随即宣布已基于 MTT S5000 GPU 和 MUSA 软件栈完成快速适配。此次适配涵盖模型加载、推理引擎、关键算子优化、部署验证和精度校验等全链路,确保模型可在该平台稳定高效推理。LongCat-2.0 为美团自研新一代 MoE 大模型,总参数量达 1.6T。

Anthropic与微软洽谈合作,共同开发AI芯片

据报道,Anthropic正在与微软进行谈判,计划租用搭载微软自主设计的AI服务器芯片的服务器。

联想集团推出创新龙虾湖企业解决方案

联想集团推出了“龙虾湖”解决方案,整合了多种产品,包括万全异构智算平台、问天WA5480 G3服务器、存储和数据网络交换机。该方案能够高效执行复杂工作流,延迟低于12毫秒,成本控制在每百万Tokens不到1元。它支持最多1000只龙虾常驻,并在4K上下文长度下实现每日输出百亿Tokens的能力。

联想集团推出创新企业龙虾湖解决方案

联想集团发布了“龙虾湖”解决方案,整合了多种产品,包括联想万全异构智算平台、问天WA5480 G3服务器、存储和数据网络交换机。该方案能够实现复杂工作流的高效执行,延迟低于12毫秒,每百万Tokens的成本不到1元。它支持最多1000只龙虾常驻,并在4K上下文长度下每天输出百亿Tokens。

中国AI大模型周调用量突破4.69万亿Token!

OpenRouter最新数据显示,截至3月15日,中国AI大模型的周调用量达到4.69万亿Token,连续第二周超越美国,且全球调用量排名前三均为中国模型。摩根大通预测,中国的AI推理Token消耗量将从2025年的约10千万亿增长至2030年的约3900千万亿,预计在五年内增长约370倍。

暂无评论

暂无评论...