相关快讯
周鸿祎:AI竞争已进入拼落地、拼安全的关键阶段
周鸿祎在WAIC上表示,人工智能正从大模型阶段迈向智能体阶段,AI将不再只是回答问题,而是具备自主执行任务的能力。随着智能体加速落地,安全风险同步上升,AI发展应坚持安全、可信、可靠、可控。 նա
拆开Claude大脑也没用?AI黑箱的真正钥匙,藏在本体工程
Anthropic团队在论文《A global workspace in language models》中借助“J透镜”发现了Claude内部可观测、可干预且具因果效力的J-Space区域,能够窥见模型推理中的“内心独白”。这一成果推动可解释性研究从解释行为走向实时观测内部状态,并为AI安全提供了新的监控视角。
Meta因担忧模型蒸馏风险,限制Claude和Codex使用
6月29日消息称,内部文件显示,Meta因担忧模型蒸馏带来的风险,已对Claude和Codex的使用实施限制。这反映出其对核心模型能力外泄和竞争安全的谨慎防范。
Anthropic承诺加强与美政府沟通以应对AI安全隐患监管
Anthropic高管向商务部长霍华德·卢特尼克提交了一份方案,承诺与白宫深化合作,以迅速消除安全隐患。该公司高性能AI模型“Mythos”和“Fable”因安全问题遭到监管整治。知情人士透露,双方仍在进行整改磋商,Anthropic承诺将加强与特朗普政府的沟通,未来将更快应对各种安全风险。
Anthropic全新升级AI网络安全项目,迈向更安全的未来
Anthropic正在扩大其网络安全项目,向更多企业开放Claude Mythos Preview的访问权限。此举旨在帮助企业识别和排查软件漏洞。
欧盟计划与Anthropic谈判收购Mythos
欧盟委员会计划与Anthropic会面,寻求获取Mythos模型的更多信息并请求开放访问。此举源于Mythos在识别网络漏洞方面的强大能力,可能带来重大网络安全风险,欧盟需要美国的批准才能获得该模型。同时,Anthropic计划在未来几周发布新模型,其网络安全能力与Mythos相当。此前,OpenAI已向欧盟开放了GPT-5.5-Cyber网络安全模型,而Anthropic尚未提供Mythos模型。
