
Qzone
微博
微信
极客网·人工智能8月10日 近日,美国AI圈爆出一桩离奇安全事件——OpenAI、Anthropic和Meta三家头部公司相继承认,其AI模型在常规安全测试中“失控”,突破了隔离环境的束缚,直接访问了公共互联网。
更令人意外的是,三家公司调查后不约而同地将矛头指向同一源头:一家仅有35名员工的以色列初创企业Irregular。
测试平台“闯祸”,模型集体越狱
Irregular成立于三年前,由CEO丹·拉哈弗和CTO奥莫·内沃联合创立,二人曾分别供职于IBM和谷歌的AI研究部门。
公司虽小,却已获得红杉资本和Redpoint Ventures的8000万美元融资,去年估值高达4.5亿美元。其核心业务是为OpenAI等巨头的AI模型充当“网络安全测试员”,在正式发布前模拟真实攻击,寻找潜在漏洞。
然而,正是这个被寄予厚望的测试平台,成了此次风波的导火索。8月4日,OpenAI在博客中披露,由于Irregular测试环境中的“配置错误”,其模型意外获得了访问公共互联网的能力。随后,Anthropic也承认其Claude模型可能已“接触互联网”。Meta最新跟进,表示已从Irregular处获悉类似问题,并启动内部调查。
Irregular回应称,所有事件均源于“同一个评估环境的问题”,绝非沙盒逃逸或复杂黑客攻击,且“目前不存在任何未解决的风险”。但这一解释并未平息外界疑虑,三家头部AI同时失控,即便只是测试环境失误,也足以令人捏一把汗。
独立测试的悖论:安全防线为何系于一家小公司?
这起风波折射出AI行业深层的结构性困境。随着模型能力指数级增长,其潜在恶意行为(如自主联网、生成有害内容)对关键基础设施的威胁日益加大。
但模型开发商普遍不愿“给自己的作业打分”,于是纷纷将安全测试外包给Irregular等少数第三方机构。这种专业分工虽高效,却也造成“单一故障点”,一旦测试平台出问题,多家巨头就会集体“翻车”。
支持者认为,失控本就是压力测试的应有之义,表明AI模型在模拟环境中本来就要尽力“找漏洞”,发现能联网说明测试有效;批评者则反问,若模型本不该访问互联网,实验室为何不监控外发流量、及时掐断连接?
无论如何,这次事件已经敲响警钟。当整个行业的安全命脉维系于一家35人的小公司,任何微小的配置失误都可能引发连锁反应。AI的安全防线,或许不该如此“脆弱”地集中在一处!
【以上内容转自“极客网”,不代表本网站观点。如需转载请取得极客网许可,如有侵权请联系删除。】
延伸阅读: