Anthropic 研究团队近日发表论文《A global workspace in language models》,并借助名为 J 透镜的工具,在 Claude 内部识别出一个可观测、可干预且具备因果效力的神经活动区域——J-Space。这一进展之所以备受关注,在于研究者由此首次得以直观看到模型推理过程中的“内心独白”,也意味着可解释性研究正从过去对模型外部行为的解读,进一步推进到对其内部状态的实时观测。
J-Space 以认知神经科学中的全局工作空间理论作为解释框架,将语言模型的推理活动类比为人类意识层面的信息整合与处理过程。它不仅在方法论和认识论层面带来重要突破,也为 AI 安全研究打开了新的监控视角与分析维度。
相关快讯
周鸿祎:AI竞争已进入拼落地、拼安全的关键阶段
周鸿祎在WAIC上表示,人工智能正从大模型阶段迈向智能体阶段,AI将不再只是回答问题,而是具备自主执行任务的能力。随着智能体加速落地,安全风险同步上升,AI发展应坚持安全、可信、可靠、可控。 նա
Claude官方亲授:4种循环让AI自动干活,不用再写提示词
AI圈正流行“不再写提示词”,硅谷大佬开始转向“循环”式智能体协作:人类只与负责协调的AI对话,按轮次逐步下达指令、检查结果、再继续推进。若想减少反复,可把人工验收步骤写入`SKILL.md`,让AI自动完成自检。
Claude 进军 K12:AI 巨头开始抢学校市场了
Anthropic 发布 Claude for Teachers,向美国 K12 教师免费开放高级功能,支持备课、课程设计和学习分析;此前 OpenAI 也推出 ChatGPT for Teachers。两家公司正争夺教师日常教学工作入口,显示 AI 教育产品从面向学生转向深度支持教师,并加速从高校走向 K12。
Anthropic首次揭秘Claude“人格”:Opus更爱抬杠,Sonnet更会安慰人,中英文性格还不同
Anthropic 研究用 30 万条真实对话证明,Claude 不同版本和不同语言下会呈现稳定的表达风格、行为倾向与价值取向差异。也就是说,大模型不仅能力有别,“人格”也会随模型与语言环境切换。
Claude核心负责人离职,转投Cursor
Claude核心设计负责人 Jenny Wen 已跳槽至 Cursor,出任设计主管。她在 Anthropic 期间主导重做 Claude.ai,并亲自推动 PR 与增长,把 Claude 从单纯聊天框升级为“工作台”。随后又参与上线 Cowork 和 Claude Code 的 Dispatch,让 Claude 在用户离开电脑后继续执行任务。
Anthropic宣布向美国中小学教师免费开放Claude高级功能
Anthropic 推出面向美国 K-12 在职教师的 “Claude for Teachers”,经验证教师可免费使用 Claude 的高级功能。项目联合 Learning Commons 提供定制教学技能库,并对接覆盖美国 50 州学术标准的课程体系,帮助教师按州标准生成教案、学生材料,并按不同学生水平定制差异化教学方案。