清华团队正式开源 VeriLoop Coder-E1:循证螺旋驱动可验证的递归自我改进
近日,清华大学深圳国际研究生院智能机器人实验室刘厚德教授团队、由王立博博士后担任 AI 首席研究员的大模型项目,正式推出 **VeriLoop Coder-E1**。这是一款基于 **Qwen3.6-27B** 构建、面向**仓库级代码修复**与**智能体式软件工程任务**的开源垂类代码模型,定位于提升复杂工程场景下的自动化开发与修复能力。
在 Hugging Face 公布的四项软件工程 Benchmark 测试中,VeriLoop Coder-E1 分别取得 **SWE-bench Verified 85.20**、**SWE-bench Pro 62.38**、**Terminal-Bench 2.0 76.40** 和 **DeepSWE 33.63** 的成绩,展现出较强的工程级代码理解与修复表现。
相关快讯
中国产品包揽全球大模型调用量前五,国产AI加速崛起
OpenRouter最新周榜显示,全球大模型调用量前五全部由中国企业研发。小米MiMo-V2.5以10.5万亿Token居首,环比增12%;DeepSeek两款模型分列第二和第五,覆盖不同需求;腾讯混元3开源后快速上榜,周增幅超999%,增长最猛。
长三角(嘉兴)Token 运营中心启动,可选 DeepSeek、千问等 100 余款大模型
长三角(嘉兴)Token运营中心在浙江嘉兴正式启动并同步上线门户网站,面向企业提供AI规模化落地服务。平台具备统一API、Token计量、费用结算、政策抵扣和安全审计等能力,可接入DeepSeek、阿里千问等100余款大模型。依托嘉兴四个万卡级算力中心,已有20余家合作伙伴签约入驻。
银河证券:Kimi K3开源或推动大模型商业生态演进,建议关注国产超节点及产业链公司
银河证券指出,Kimi K3上线48小时即因请求量过大导致集群满载,随后暂停C端新用户会员订阅,体现其模型能力突出与算力供给紧张。国产开源模型能力逼近顶级闭源模型,将推动大模型厂商扩大训练规模、加快迭代,并持续提升推理算力需求。Kimi K3已实现与多家国产算力平台Day 0适配,有望带动国产超节点及服务器、交换机、光模块、液冷、电源等产业链需求,相关公司值得关注。
长三角(嘉兴)Token运营中心正式启航
长三角(嘉兴)Token运营中心发布会在嘉兴举行,门户网站同步上线,作为面向市场的统一服务窗口正式启用。平台被比作“大型数据模型超市”,企业无需再找代码、配环境、调参数,只需一次接入,就能按需调用DeepSeek、Qwen等100余款主流大模型。
美国部分企业开始采用中国大模型以降低成本
美国在算法大模型领域长期领先,但中国大模型近年迅速崛起,正冲击全球AI格局。月之暗面Kimi K3等开源模型引发资本市场关注,被称与DeepSeek当年的热潮相似,甚至获马斯克称赞。同时,Coinbase、爱彼迎等美国公司也开始转用中国模型,如Qwen,以降低成本。
降本压力下,部分美国企业转向中国大模型
美国在算法大模型领域曾凭借AlphaGo和ChatGPT建立先发优势,但中国大模型近年快速崛起,正在改变AI竞争格局。月之暗面开源模型Kimi K3发布后引发资本市场震动,被外媒比作DeepSeek带来的冲击;马斯克也称其“令人印象深刻”。与此同时,Coinbase和爱彼迎等公司开始转向采用中国AI模型,主要看重其较低成本和较高效率。