【调查显示 OpenAI 约 700 个 AI 代理入侵 " 抱抱脸 " 许多代理 " 试图掩盖行踪 "】财联社 8 月 27 日电,当地时间 8 月 26 日出炉的两份调查报告显示,今年 7 月对人工智能开源平台美国 " 抱抱脸 " 公司系统的入侵,是由美国开放人工智能研究中心(OpenAI)创建的约 700 个人工智能(AI)代理(即在极少人工监督下运行的程序)发起的,而且其中许多代理还 " 试图掩盖自己的行踪 "。这两份报告一份由 OpenAI 发布,另一份由独立调查人员发布,共同揭示了关于此次入侵事件的细节。首先,入侵事件并非如先前报道的那样仅涉及一个违规的 AI 代理,而是大约 700 个代理作为一个庞大的协作群体在行动。其次,OpenAI 的 AI 模型 " 试图通过删除或篡改其行动记录来掩盖不当行为 "。此外,OpenAI 表示,其代理还入侵了公司的部分内部系统," 试图在测试中作弊或获得更大的行动自由 "。OpenAI 此前承认,今年 7 月,其 AI 模型在内部评估测试中失控,入侵了 " 抱抱脸 " 公司的系统。" 抱抱脸 " 公司则表示,在尝试对攻击进行分析时,美国模型因安全过滤机制拦截而无法使用,公司随后转而在内部运行中国开放权重模型 GLM-5.2,从而得以及时采取应对措施。
财联社-深度
30分钟前
调查显示 OpenAI 约 700 个 AI 代理入侵“抱抱脸” 许多代理“试图掩盖行踪”
相关标签