毕马威调查:AI按量计费让企业高管望而却步,近三分之一坦言算不清经济账
相关快讯
全球首个千亿参数级“风和”模型全球开源计划正式启动
中国气象局发布人工智能气象服务系统“风和”大语言模型,并启动全球开源计划,旨在以开放共享推动气象人工智能国际化发展。该计划将联合开发者、科研机构和国际伙伴,共同建设生态,服务全球防灾减灾合作与可持续发展。
Meta 高管预测:AI 使用成本未来或超员工工资,公司拟设词元上限
Instagram 负责人 Adam Mosseri 近日表示,未来一两年内,Meta 可能会开始限制员工使用 AI 的 Token 数量。他认为,优秀工程师的 AI Token 成本可能接近甚至达到其工资水平,因此公司可能需要设置使用上限。此言反映出 AI 计算成本正成为科技行业关注的焦点。
腾讯官宣:OpenAI前研究员田永龙入职,参与VLM研发
腾讯近期再从OpenAI引入人才,前研究员Yonglong Tian已加入腾讯大语言模型部,后续将参与VLM研发。这被视为腾讯再次“挖角”OpenAI。去年腾讯已升级大模型架构,并任命前OpenAI高级研究员姚顺雨担任首席AI科学家及相关部门负责人。
Claude、GLM、GPT谁更像真正的AI软件工程师?首个持续更新的Visual Spec-to-App Benchmark发布
随着 Claude Code、OpenAI Codex、Cursor、Gemini CLI 等工具的发展,大语言模型已能自主完成 Web 应用的编码、调试、运行与部署,“AI 软件工程师”正加速成形。为评估这类能力,University of Arizona、Zoom 和 Stony Brook University 团队提出了 VISTA(VIsual Spec-To-App Benchmark),这是首个面向 Visual Spec-to-Web-App Coding Agents 的端到端基准。
Karpathy再度出圈:RAG新思路,把笔记变成第二大脑
Karpathy 提出用大模型把知识库“编译”成持续生长的活 Wiki,取代传统 RAG 检索。他认为 RAG 只是搬运局部信息,难以理解全局,还容易在知识前后矛盾时产生“人格分裂”,输出逻辑混乱的结果。这一思路在 GitHub 上两个月已获得 5000+ star。
Hermes上线MoA功能,性能表现有多强?
Hermes Agent上线了MoA(Mixture of Agents)功能,支持将多种模型自由组合成虚拟模型使用。据Nous Research即将发布的基准测试,该混合模型评分已超过Opus 4.8和GPT-5.5。MoA并非新概念,早在2024年6月Together AI就发表过相关论文,核心思路是多层大模型逐层参考上一层输出并继续生成答案。
