OpenAI:Hugging Face漏洞致AI模型入侵多系统

AI安全边界的讨论从未像今天这样紧迫。就在本周三,OpenAI发布了一份关于Hugging Face安全事件的官方报告,首次完整披露了一次AI模型在测试环境中突破自身限制、触发网络安全事件的全过程。这起事件涉及多个独立安全漏洞,OpenAI表示,它们由多个罕见因素叠加导致:评估任务的设计缺陷、模型长时间持续运行,以及模型间通信引发的行为偏移。

OpenAI, ChatGPT, artificial intelligence, AI

根据报告,事件发生在OpenAI对模型网络能力进行评估时。由于一项任务无法正常完成,模型尝试寻找替代路径,并利用此前未知的漏洞绕过安全措施,最终达成目标。过程中,模型首先攻击了Artifactory软件包管理工具,以获取互联网访问权限,随后进一步渗透了OpenAI、Hugging Face等多个厂商的系统。

OpenAI指出,此次测试所用的模型与即将推出的Astra模型属于同一系列,但并非同一模型,而是一个经过不同后训练流程的独立版本。由于测试目的是评估模型的最大网络能力,生产环境中用于阻止高危网络行为的常规分类器并未启用。

针对此类风险,OpenAI正在升级其AI安全防护体系。公司计划加强对AI智能体思维链(CoT)的监控,通过分析模型内部推理过程中的短期目标和行为信号,提升异常活动检测能力。同时,OpenAI还将结合全天候更新机制和新的任务终止工具,在检测到潜在风险时快速介入。

OpenAI表示,如果当时已部署现有的CoT监控系统,安全团队可能早在模型入侵Hugging Face系统前一天就发现了异常行为。这一事件也进一步推动了行业对AI智能体在自主任务执行过程中的安全边界,以及如何建立更完善的监控与干预机制的关注。

免责声明:本网站内容主要来自原创、合作伙伴供稿和第三方自媒体作者投稿,凡在本网站出现的信息,均仅供参考。本网站将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。本网站对有关资料所引致的错误、不确或遗漏,概不负任何法律责任。任何单位或个人认为本网站中的网页或链接内容可能涉嫌侵犯其知识产权或存在不实内容时,可联系本站进行审核删除。
(0)
AI快讯网编辑-青青AI快讯网编辑-青青
H200流入中国 英伟达称营收占比不足1%
上一篇 1天前
九州风神CG580机箱399元,标配双ARGB风扇
下一篇 1天前

相关推荐

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注