AISI实测揭示:Mythos能力以惊人速度冲击ASI,网络天花板被突破!

2个月前更新 zmtzn
9 0 0

英国AI安全研究所(AISI)昨日发布重磅消息:在模拟企业内网的32步渗透任务中,Anthropic的Mythos成功完成6次,而OpenAI的GPT-5.5仅完成3次。更值得注意的是,以前未被攻破的Cooling Tower靶场此次首次遭到攻陷。这场ASI决赛中,AI评测的表现已远超人类。实测结果显示,Anthropic的Mythos和OpenAI的GPT-5.5均被评估,其中Anthropic的前沿红队负责人Logan Graham强调,Claude Mythos预览版在自主网络安全能力上实现了显著的突破。

AISI实测揭示:Mythos能力以惊人速度冲击ASI,网络天花板被突破!的封面图

相关快讯

周鸿祎:AI竞争已进入拼落地、拼安全的关键阶段

周鸿祎在WAIC上表示,人工智能正从大模型阶段迈向智能体阶段,AI将不再只是回答问题,而是具备自主执行任务的能力。随着智能体加速落地,安全风险同步上升,AI发展应坚持安全、可信、可靠、可控。 նա

拆开Claude大脑也没用?AI黑箱的真正钥匙,藏在本体工程

Anthropic团队在论文《A global workspace in language models》中借助“J透镜”发现了Claude内部可观测、可干预且具因果效力的J-Space区域,能够窥见模型推理中的“内心独白”。这一成果推动可解释性研究从解释行为走向实时观测内部状态,并为AI安全提供了新的监控视角。

Meta因担忧模型蒸馏风险,限制Claude和Codex使用

6月29日消息称,内部文件显示,Meta因担忧模型蒸馏带来的风险,已对Claude和Codex的使用实施限制。这反映出其对核心模型能力外泄和竞争安全的谨慎防范。

Anthropic承诺加强与美政府沟通以应对AI安全隐患监管

Anthropic高管向商务部长霍华德·卢特尼克提交了一份方案,承诺与白宫深化合作,以迅速消除安全隐患。该公司高性能AI模型“Mythos”和“Fable”因安全问题遭到监管整治。知情人士透露,双方仍在进行整改磋商,Anthropic承诺将加强与特朗普政府的沟通,未来将更快应对各种安全风险。

Anthropic全新升级AI网络安全项目,迈向更安全的未来

Anthropic正在扩大其网络安全项目,向更多企业开放Claude Mythos Preview的访问权限。此举旨在帮助企业识别和排查软件漏洞。

欧盟计划与Anthropic谈判收购Mythos

欧盟委员会计划与Anthropic会面,寻求获取Mythos模型的更多信息并请求开放访问。此举源于Mythos在识别网络漏洞方面的强大能力,可能带来重大网络安全风险,欧盟需要美国的批准才能获得该模型。同时,Anthropic计划在未来几周发布新模型,其网络安全能力与Mythos相当。此前,OpenAI已向欧盟开放了GPT-5.5-Cyber网络安全模型,而Anthropic尚未提供Mythos模型。

暂无评论

暂无评论...