Fable 5手搓首个CUDA“超级内核”,2.5小时提速18.7倍

2个月前更新 775800
6 0 0

AI竟然写出了“史上最快内核”。在全新一轮 GPU 算子基准测试 KernelBench-Mega 中,Fable 5 的表现可谓一骑绝尘。对比之下,实力强劲的 Claude Opus 4.8 也只跑出 14.4 倍,而 GPT-5.5 仅有 4.34 倍。

Fable 5 最终狂飙至 18.7 倍,直接碾压 GPT-5.5。AI 不仅写出了全球最快的底层代码,在运行速度上全面领先人类方案,甚至在代码“纯度”上也做到了极致。

Fable 5手搓首个CUDA“超级内核”,2.5小时提速18.7倍的封面图

相关快讯

智谱认领神秘AI模型Ox Alpha:使用量已超DeepSeek两倍

智谱周三证实,Ox Alpha是GLM系列模型的新一代版本,并计划于当晚公开发布模型权重,供开发者基于其参数开发产品。目前Ox Alpha仍可免费使用,已登顶OpenRouter AI模型排行榜,使用量超过DeepSeek两倍,显示出较强的市场热度和影响力。

宇树科技王兴兴:探索物理AI机器人自进化之路

8月20日,宇树科技王兴兴在2026世界机器人大会上表示,公司正持续加码AI模型领域,该方向也是当前投入最多的领域。继8月19日登陆科创板后,公司市值约2779亿元。他首次提出“物理AI机器人自进化”概念,称将依托前沿大模型,让模型自主检索论文、开源方案并生成机器人控制代码,推动机器人模型自进化体系建设。

“千问办公”首发上线GLM-5.3和DeepSeek V4 Pro两款模型

8月15日,阿里巴巴旗下Agent产品“千问办公”首发接入GLM-5.3和DeepSeek V4 Pro两款前沿模型,用户可在首页“前沿模型”档位直接选择使用。加上此前已首发上线的Qwen3.8-Max,千问办公目前已支持三款国产旗舰模型,进一步扩展了其模型能力选择。

中国移动将推出全国统一Token套餐资费

我先按新闻快讯口径重写这段,保持信息点和字数密度基本对齐,分段处理,避免扩写成解读稿。中国移动高管在今日中期业 […]

Google Gemma 4全球下载量突破3亿次

Google Gemma 4 模型在 Google I/O 上海传出下载量已突破 3 亿。该系列于今年 4 月发布,面向高级推理与智能体(Agentic)工作流场景设计,显示出较强的市场关注度和应用热度。

蚂蚁百灵开源轻量级混合推理MoE模型 Ling-3.0-tiny

蚂蚁百灵开源轻量级混合推理 MoE 模型 Ling-3.0-tiny,采用 KDA 与 MLA 3:1 交替堆叠,并配备 128 个路由专家的稀疏 MoE 前馈网络,兼顾高效计算与推理能力。模型支持通过 `enable_thinking` 参数在单次请求中灵活切换思考模式,兼顾快速响应和多步推理、智能体任务需求。

暂无评论

暂无评论...