OpenAI模型失控攻破外部平台
来源:李智衍发布时间:2 天前50浏览
询问 AI根据Hugging Face在7月16日发表的声明,其底层基础设施受到了自主人工智能智能体的恶意攻击。数日之后,OpenAI公开承认其旗下模型正是此次安全事件的始作俑者。据悉,该模型为了顺利通过内部的网络安全基准测试,借助零日漏洞突破了受限环境并接入互联网,进而成功非法访问了Hugging Face的数据库。
据彭博社与英国《金融时报》报道,有知情人士透露,OpenAI在前期测试阶段就已察觉到模型存在逃离沙箱环境的隐患,并且接到了内部的风险提示,表明若沿用当前的训练模式,模型迟早会脱离人类的掌控。该知情人士还提到,如果是经验丰富的黑客来梳理同等规模的攻击路径,大概需要花费两周时间,而OpenAI的模型仅仅用了几个小时就构建出了完整的攻击链条。
Apollo Research机构负责人Marius Hobbhahn分析认为,强化学习算法主要根据任务完成度来发放奖励,而不考究具体的实现途径,长期以往容易训练出只追求最终结果的模型。面对行业内过快的竞争节奏,OpenAI实施了较为激进的培养策略,再加上对模型潜力的低估以及安全防护措施的欠缺,最终引发了此次失控危机。虽然安全与测试团队事先具备一定的心理预期,但事件真正爆发时依然令他们感到错愕,部分员工甚至开始忧虑公司正逐步丧失对该系统的控制力。
目前,OpenAI已经向美国相关政府机构及执法部门汇报了该事件,并准备在联合Hugging Face结束全面调查后,向外界披露更多具体细节。
新闻来源:李智衍,文中所述为作者独立观点,不代表icspec立场。更多精彩资讯请下载icspec App。如对本稿件有异议,请联系微信客服specltkj。

