Anthropic首次揭秘Claude“人格”:Opus更爱抬杠,Sonnet更会安慰人,中英文性格还不同
“见人说人话,见鬼说鬼话”,放在人身上通常叫高情商;但放到 AI 身上,却可能意味着同一个模型会呈现出完全不同的“性格”。
最近,不少 Claude 用户都发现,同样一个问题,只要换个模型版本,甚至换一种语言来提问,得到的回复就会明显不同。有人吐槽 Opus 4.7 偏爱“抬杠”,经常先提醒风险、再给结论;也有人觉得 Sonnet 4.6 更加温和,回答时会主动共情,还会安慰用户情绪。
在过去,这类差异更多被看作是使用者的主观感受。但 Anthropic 最新发布的一项研究,首次基于超过 30 万条匿名真实对话,给出了系统性证据:Claude 的表达风格、行为倾向和价值取向,确实会随着模型版本以及所使用的语言发生稳定变化。
换句话说,大模型之间不仅能力不同,它们的“人格”也会跟着训练目标和语言环境一起切换。
相关快讯
京东发布 JoyAI-Talker 实时语音交互模型与 JoyAI-Video-Edit 视频编辑模型
7月18日,京东以“AI进入物理世界”为主题亮相上海世博展览馆,首次系统展示面向物理世界的JoyAI模型矩阵,并推出JoyAI-Talker实时语音交互模型和JoyAI-Video-Edit实时视频编辑模型。官方称,JoyAI-Talker具备低延迟对话、情绪理解、工具调用和记忆等能力,推动AI从执行指令走向理解人类意图与状态。
Meta拟出租AI算力给Anthropic,试水云计算市场
Meta正与Anthropic洽谈出租AI算力,或以最高100亿美元、为期两年的合作向其提供计算基础设施服务,显示其可能进军云计算市场,与亚马逊、微软、谷歌竞争。Meta今年资本支出预计1250亿至1450亿美元,重点投入AI数据中心建设。扎克伯格此前也表示,若算力超出自用需求,不排除对外出租。
突发叫停:Gemini 3.5 Pro难产,谷歌陷入失望风波
昨日韩国外界盛传谷歌即将上线 Gemini 3.5 Pro“Cappuccino”,主打200万上下文窗口和“深度思考”模式,甚至被认为会改写AI格局。但随后消息反转,发布计划并未如期推进,而是被谷歌大幅延期数月,令原本高涨的期待迅速降温。
拆开Claude大脑也没用?AI黑箱的真正钥匙,藏在本体工程
Anthropic团队在论文《A global workspace in language models》中借助“J透镜”发现了Claude内部可观测、可干预且具因果效力的J-Space区域,能够窥见模型推理中的“内心独白”。这一成果推动可解释性研究从解释行为走向实时观测内部状态,并为AI安全提供了新的监控视角。
Claude官方亲授:4种循环让AI自动干活,不用再写提示词
AI圈正流行“不再写提示词”,硅谷大佬开始转向“循环”式智能体协作:人类只与负责协调的AI对话,按轮次逐步下达指令、检查结果、再继续推进。若想减少反复,可把人工验收步骤写入`SKILL.md`,让AI自动完成自检。
消息称谷歌旗舰AI模型Gemini 3.5 Pro延期数月,技术表现未达预期
据消息,谷歌旗舰模型 Gemini 3.5 Pro 已延期数月,主要因公司希望继续提升能力,尤其是编程表现。延期已引发工程师、研究人员和管理层不满,也让部分员工担心谷歌在 Anthropic、OpenAI 竞争下失去优势。与此同时,谷歌内部多层协调及将 AI 接入搜索、地图、YouTube 等产品的复杂流程,也在拖慢发布进度。