英伟达近日推出首款开源大模型Nemotron 3.5 Lightning,响应首席执行官黄仁勋此前对开源模型的支持。该模型主打轻量高效,可在普通笔记本电脑或台式机的单块G...
CoreWeave在申报文件中警告称,公司目前高度依赖英伟达AI芯片,若要寻找替代GPU,可能需要投入大量时间、资金和资源。客户需求变化或迫使其调整供应结构,但...
据报道,英伟达正考虑下调下一代GPU产品Rubin Ultra的内存配置。公司已测试至少三个版本,其中部分版本内存容量低于此前公布的设计方案,原因可能是先进存储...
王东表示,国内外大模型迭代速度都很快,头部厂商平均每两个月更新一次前沿基础模型。相比海外同等智力水平模型,中国前沿基础模型在调用成本上更具优势,体...
MXC600 是沐曦股份今年的主力芯片,已开始大规模出货。该芯片定位为新一代 AI 训练推理旗舰,采用自研 GPU 架构,并在设计、制造、封装及软件栈上实现全国产...
英伟达此前在CES暗示可能重新推出老款GeForce RTX显卡,如今已成现实。Newegg上架了技嘉RTX 3060 12GB,起售价339.99美元,较五年前官方建议价高10美元。不过...
SpaceX宣布以600亿美元收购Cursor,后者推出了一个新的1.5万亿+参数的大模型,该模型在超过10万块GPU上预训练。至今,只有Anthropic成功达到约10万亿参数规模...
谷歌于6月10日发布了实验性开源模型DiffusionGemma,采用文本扩散架构,在专用GPU上文本生成速度比传统自回归大语言模型快最多4倍。该模型以Apache 2.0许可证...
6月8日晚,小米MiMo技术团队推出了Xiaomi MiMo-V2.5-Pro-UltraSpeed模式。该模式通过优化模型推理系统的全链路工程能力,实现了推理速度提升至1000 tokens/s...
阿里巴巴达摩院发布了“敏迭”求解器(MindOpt)的GPU版本,充分利用GPU的并行加速特性,并引入新算法以解决“长尾效应”难题。经过对约2000个通用算例的测试,敏...
摩尔线程与光轮智能近期达成战略合作,旨在联合开发高置信度仿真数据合成方案。合作将依托摩尔线程的全功能GPU和光轮智能的夸娥(KUAE)智算集群,同时结合其...
在2026年中关村论坛年会上,中科曙光发布了首个无线缆箱式超节点scaleX40。该设备内置40张GPU,具备超过28 PFLOPS(FP8精度)的总算力和超过5TB的显存总容量...
在2026年中关村论坛年会上,中科曙光发布了首个无线缆箱式超节点scaleX40。该设备内置40张GPU,具备超过28 PFLOPS的算力(FP8精度),显存总容量超过5TB。sca...
英伟达开源Nemotron 3.5大模型,Lightning正式上线,全球开发者可免费使用修改
英伟达近日推出首款开源大模型Nemotron 3.5 Lightning,响应首席执行官黄仁勋此前对开源模型的支持。该模型主打轻量高效,可在普通笔记本电脑或台式机的单块G...
magiceraser05781340
in 未分类