相关快讯
Cerebras发布CS-4 AI加速器:推理速度最高达GPU方案30倍
当地时间8月18日,Cerebras发布新一代AI加速器CS-4,搭载三颗WSE-3 Turbo晶圆级引擎,AI算力达750PFLOPS、内存带宽达129.6PB/s。在GPT-OSS-120B测试中,CS-4每用户每秒生成超440个Token,推理速度最高为GPU方案30倍,每瓦吞吐量较CS-3提升10倍,可支持超50万亿参数模型,预计今年第三季度出货。
阿里云灵骏真武M890超节点实例正式上线,首批乌兰察布开服
阿里云宣布灵骏真武M890超节点实例正式上线,首批已在乌兰察布开售。该实例支持企业在云上开通64卡高速互联算力单元,可承载十万亿参数级MoE大模型推理,并已成功运行超2万亿参数大模型,Kimi K3和Qwen3.8 Max已基于此对外提供服务。
阿里云真武芯片超节点成功适配Qwen3.8,已在百炼上线推理服务
7月23日,阿里真武M890超节点已完成对Qwen3.8的适配,并在阿里云百炼平台上线模型推理服务。该超节点可成功运行参数规模超过2万亿的大模型,成为国内首个实现这一能力的超节点,标志着国产大模型基础设施能力取得新进展。
元脑SD200超节点再提速:万亿参数大模型Token延迟跑进5ms
元脑SD200超节点AI服务器完成Kimi K2.6、DeepSeek V4、GLM 5.2、MiniMax M3等主流开源大模型的高性能优化,并在Kimi K2.6万亿参数模型上将Token生成时间提升至4.77ms。其基于高带宽、低延时开放总线协议和3D Mesh互连架构,支持64张本土AI芯片扩展,显著增强Agent场景下的低延迟推理能力。
杨立昆刚质疑AGI,Anthropic就找到了AGI的关键证据
Anthropic在研究Claude时发现了一个名为J-space的区域,似乎负责其思考和推理;一旦缺失,Claude就会退化到只能回答很基础的问题。更令人震惊的是,这一机制并非人工设计,而是在长期训练中自行形成的。Anthropic因此发表了《语言模型中的全局工作空间》论文,探讨语言模型内部的这种“类AGI”现象。
阿里达摩院推出Vibe Coding:探索前所未见的“语构”体验
阿里达摩院推出了一款名为“语构”的AI原生开发平台,核心以Vibe Coding为基础,旨在将复杂的工程逻辑转化为直观的创作体验。该平台的主要特点是允许用户使用自然语言进行应用开发,并提供开箱即用的AI能力资源库。语构内置了多种标准化能力接口,用户可以零代码调用,包括大模型对话等功能,最终开发过程需要用户选择参与人数和其他设置,确认后即可进入开发阶段。
