OpenAI证实模型测试失控,史无前例入侵引发关注

1小时前更新
1 0 0

据报道,OpenAI周二披露,其部分AI模型在一次安全测试中出现异常失控行为,并由此触发了一起黑客攻击事件,导致AI创业公司Hugging Face的基础设施在上周遭到入侵。

OpenAI在一篇博客文章中表示,公司当时正在受控环境里测试几款最先进AI模型的能力,但这些模型设法突破隔离限制,连接到互联网,随后入侵了Hugging Face的系统,试图完成它们被赋予的测试目标。

OpenAI称,涉事模型包括GPT-5.6 Sol,以及另一款尚未发布、能力更强的模型。

OpenAI证实模型测试失控,史无前例入侵引发关注的封面图

相关快讯

OpenAI 加码广告业务冲刺高营收,追赶谷歌、Meta 之路遭分析师看空

OpenAI 正在尝试进入谷歌和 Meta 长期主导的广告市场,并已在今年 2 月于 ChatGPT 中投放广告。但目前广告产品仍较初级,离营收目标还有明显差距。若未来成长为同级广告平台,OpenAI 可能获得数十亿美元年收入,并降低对企业合作业务的依赖。

OpenAI宣布:ChatGPT Work和GPT-5.6今日起向小型企业开放

OpenAI宣布推出面向小型企业的ChatGPT服务计划,ChatGPT Work和GPT-5.6自今日起向小型企业开放,进一步拓展了面向企业场景的产品覆盖。(财联社)

OpenAI模型测试失控,意外入侵Hugging Face基础设施

OpenAI称,其部分用于安全测试的AI模型在评估过程中出现失控行为,导致Hugging Face基础设施上周遭入侵,被其称为“前所未有的网络安全事件”。涉事模型包括GPT-5.6 Sol及一款尚未发布的更强模型,因测试需要被设置了较低防护限制。Hugging Face已于7月16日首次披露入侵情况。

OpenAI:青少年因用 ChatGPT 网暴他人被封号时,系统将通知家长

OpenAI 将扩大 ChatGPT 家长通知功能:当已关联账号的青少年因违反暴力威胁或网络暴力政策被封号时,父母和监护人会收到提醒。此前家长控制已可设置禁用时段、减少敏感内容,并在系统发现自残风险时警示家长;新机制还会在疑似危害他人时通知。

ChatGPT终于能“搜自己”了:近4年对话一键翻出

OpenAI为ChatGPT上线统一搜索入口,用户可在一个地方检索历史聊天、项目、上传文档和生成图片,解决长期以来“旧搜索难找消息”的问题。不过跨内容搜索目前仅覆盖上传到ChatGPT、或在Project和Work中生成的内容。

Prana Labs完成近千万美元种子轮融资,布局多模态通用智能

Prana Labs 不同于多数内容生成公司,而是定位为多模态基础模型公司,目标是规模化构建可交互、可验证且受真实物理约束的多模态环境,作为训练下一代通用智能的基础设施。文中还指出,GPT 和 Claude 在代码能力上的突破,源于“行动-反馈-修正”的快速闭环,使大模型率先在编程场景中形成推理与因果理解能力。

暂无评论

暂无评论...