Kimi K2.6 正式发布:开源代码与Agent功能详解

4个月前更新 zmtzn
12 0 0

月之暗面发布并开源了 Kimi K2.6 模型,显著提升了其通用代理、代码生成视觉理解等综合能力。在多个基准测试中,Kimi K2.6 的表现优于或持平于闭源模型,如 GPT-5.4、Claude Opus 4.6 和 Gemini 3.1 Pro。该模型在长程编码能力上取得了显著突破,测试显示其可持续编码13小时,编写或修改超过4000行代码。同时,Agent 的自主执行能力也得到了大幅提升,由 K2.6 驱动的 Agent 集群架构实现了重大升级,支持300个子Agent并行完成多达4000个协作步骤,从而实现更大规模的并行化处理。

Kimi K2.6 正式发布:开源代码与Agent功能详解的封面图

相关快讯

DeepSeek发布新多模态模型

DeepSeek-V4-Flash-Vision-Exp已在DeepSeek API平台正式上线。官方称其纯文本能力与DeepSeek-V4-Flash正式版持平,而在视觉理解类Agent Benchmark上表现显著提升,多模态Agent能力已接近Opus-4.8。

Anthropic联合创始人承认:人工智能正遭遇信任危机

Anthropic首席执行官阿莫代伊否认自己应为公众对AI的末日担忧负责,但承认行业面临信任问题。他指出,当前关于AI治理存在非此即彼的误区:有人担心监管会导致权力集中,也有人认为开源和广泛分发模型才是降低风险的最佳方式。他强调法院等制度机构可实现权力去中心化,并表示Anthropic支持对前沿AI企业适度约束,同时为小型竞争者创造发展空间。

智谱正式发布GLM-5.3

智谱正式发布GLM-5.3。相比GLM-5.2,它基座不变,但通过更强的后训练Scaling显著提升智能上限,编程能力尤为突出。内部体感评测较GLM-5.2提升50%,并在Terminal Bench 3.0、Agents' Last Exam(CLI)等公开基准中取得开源第一。

小红书开源 dots3-note:IMO 42 分满分同系列模型来了

小红书 dots 实验室宣布开源 dots3-note preview,这是 dots3 系列首个开源版本。该模型承接此前 dots-note-3.0 在国际奥数竞赛中拿下官方认证满分 42 分的成绩,当前开源版本重点面向更贴近现实、评测更困难的长程任务,进一步延续了社区对其能力开放的关注。

xAI联创再创业:押注开源模型与个人AI,已融资11亿美元

8 月 11 日,xAI 联合创始人伊戈尔·巴布什金创办的 River AI 宣布完成 11 亿美元融资。此后,他加入 OpenAI,受 GPT-2、GPT-3 背后的 Scaling 路线吸引,并参与大模型训练。2023 年,他与马斯克共同创办 xAI,负责训练基础设施和模型研发,押注推理能力将快速提升,进而用 AI 解决物理、科学、医学和工程问题。

清华团队正式开源 VeriLoop Coder-E1:循证螺旋驱动可验证的递归自我改进

清华大学深圳国际研究生院智能机器人实验室团队发布开源垂类代码模型 VeriLoop Coder-E1,基于 Qwen3.6-27B,面向仓库级代码修复与智能体式软件工程任务。在 Hugging Face 四项软件工程基准中表现突出,SWE-bench Verified 达 85.20,SWE-bench Pro 为 62.38,Terminal-Bench 2.0 为 76.40,DeepSWE 为 33.63】【。

暂无评论

暂无评论...