前 OpenAI 创始团队成员、特斯拉前 AI 高级总监 Andrej Karpathy 抛出一个激进思路:别再用 RAG 去检索知识库,而是让大模型把知识“编译”成一座持续生长的活 Wiki。这个项目上线两个多月后,在 GitHub 已经冲到 5000+ star。
现任 Anthropic 工程师、前 OpenAI 联合创始人、Tesla 前 AI 总监 Karpathy 直言,他看不下去了,直接扔出一枚“炸弹”。在他看来,RAG 只是搬运工,只能处理局部信息,根本无法把握全局语境。它还很容易“人格分裂”:如果你半年前认定 A 是对的,昨天又写笔记反驳 A,RAG 往往会在两种结论之间来回打架,最后吐出一堆自相矛盾、逻辑混乱的废话。
相关快讯
苹果牵手阿里训练中国专属大模型:告别纯“借力”
路透称,苹果已为中国市场训练一款大语言模型,改变了此前主要依赖第三方模型的做法。知情人士表示,这款中国专属AI模型由苹果与阿里巴巴合作开发,并在阿里支持下完成训练。此事此前未被公开报道,显示苹果正为在华销售的iPhone等设备引入生成式AI功能,进一步强化本土化策略。
英伟达据悉推出万亿参数开源AI模型Nemotron 4,挑战顶级开源模型
英伟达正开发新一代开源模型 Nemotron 4,参数规模预计至少 1 万亿,意在挑战全球领先的开源大模型。此举不仅有助于扩大开放模型生态、推动 AI 应用落地,也可能进一步带动市场对其 GPU 算力的需求。英伟达此前已推出 Nemotron 系列开源模型,其中包括 3400 亿参数版本,主要用于训练数据生成、模型开发和企业 AI 应用。
梁汝波回应大模型与海外SOTA差距:坚持自研,接受短期落后,持续优化长期竞争力
梁汝波在字节跳动2026年中全员会上表示,公司AI业务上半年整体表现稳中有进:豆包在C端应用保持竞争力,视频生成模型Seedance维持SOTA。但在大语言模型方面,海外SOTA已拉开差距,字节仍将坚持自研,夯实基础能力,接受短期落后,着眼长期优化。这一判断也与张一鸣此前的表态一致。
字节跳动CEO:大语言模型坚持自研,短期落后也要接受
字节跳动2026年中全员会上表示,大语言模型将坚持自研,夯实基本功,接受短期落后,聚焦长期优化,避免动作变形。梁汝波否认因外部压力而自研,称核心原因是延迟满足、打牢技术基础以支持AGI。张一鸣此前也强调不使用模型蒸馏加速研发,宁可短期性能落后。
字节跳动梁汝波:大语言模型坚持自研,短期落后也要接受
8月6日,梁汝波在字节2026年中全员会上表示,大语言模型与海外领先模型差距拉大,但公司仍将坚持自研、夯实基本功,接受短期落后,聚焦长期能力建设和AGI目标。谭待称,ToB场景只有SOTA模型才能率先释放高价值,Seedance 2.0已推动视频生成从“玩具”走向严肃商业生产。
腾讯混元 Hy ASR 3.0 Preview 发布:通用识别、方言覆盖、场景鲁棒性全面升级
腾讯混元发布新一代语音识别模型 Hy ASR 3.0 preview,融合 Hy3 大语言模型的理解能力,提升通用识别、上下文感知、场景鲁棒性和方言覆盖。新模型采用 MoE 架构,增强语言理解、上下文建模与语义推理,实现从逐字转写到理解语境、兼容场景的一键直出。