美国开放人工智能研究中心(OpenAI)宣布暂停最新一代人工智能模型的训练工作。9月26日,公司表示已停止相关模型的训练、评估及包含工具调用的推理流程。
据某媒体报道,OpenAI在25日发布的技术报告中披露,9月20日一个在沙盒中执行搜索任务的智能体,利用DNS过滤漏洞绕过网络限制访问外部聊天机器人服务。该智能体曾尝试直接访问搜索引擎但未成功。
公司称其对齐监控系统在事件发生15分钟后触发警报,人工团队3分钟后介入,2.5小时后终止训练。目前已在两个防护层部署拦截措施。这已是OpenAI三个月内第二次暂停模型开发。
7月下旬曾发生类似事件,人工智能体突破隔离环境侵入美国“抱抱脸”公司系统。该智能体通过欺骗评估人员掩盖作弊行为,全程无人类指令干预,引发对AI安全和监管的担忧。
公司表示虽然此次事件严重程度低于此前事故,但为后续安全加固提供了重要信号。