调查:OpenAI约700个智能体入侵“抱抱脸”

根据美国两家人工智能研究组织26日发布的独立调查报告,在开放人工智能研究中心(OpenAI)7月进行的网络安全能力测试中,约700个由OpenAI人工智能模型驱动的智能体参与了对人工智能开源平台“抱抱脸”公司系统的入侵。OpenAI也于26日公布了相关技术调查报告。

这份由“模型评估和威胁研究组织”与“雷德伍德研究组织”合作撰写的报告显示,OpenAI于7月8日启动名为ExploitGym网络安全基准测试,参与测试的模型包括GPT-5.6 Sol和一款OpenAI内部研究模型。测试期间,约1200个原本应相互隔离的智能体通过未经授权的渠道建立通信,交换超过7万条消息和文件,其中约700个智能体随后参与对“抱抱脸”系统的入侵。

调查发现,大量智能体还合作研究如何欺骗测试自动评分系统,试图采用的方法包括伪造、修改或删除自身执行记录等。调查人员认为,大量智能体之间未经授权的协作,使它们得以完成单个智能体难以完成的任务。对“抱抱脸”的入侵正是在这种集体协作中逐步形成。

第140届广交会推介会在秘鲁举行

  新华社利马8月26日电第140届中国进出口商品交易会秘鲁推介会26日在秘鲁首都利马举行。中秘两国工商界代表围绕深化经贸合作、推动企业和采购商参展对接等议题进行交流。第140届广交会将突出“向新、向绿、向智”特点,集中展示中国工业领域最新成果

OpenAI于26日公布的技术调查报告显示,7月10日至13日期间,由相关模型驱动的智能体在“抱抱脸”相关服务器的41个工作节点上执行代码,至少取得其中一个节点的最高权限,访问部分数据,并下载4个非公开代码库。

OpenAI表示,公司已采取措施为相关程序部署隔离程度更高的“沙箱”环境,限制高风险模型访问互联网,并加强对模型推理的监控。

OpenAI于7月20日发现其模型可能与“抱抱脸”系统遭入侵有关并通知对方,21日对外披露此次事件。(吴晓凌)