AI智能体接连失控,OpenAI再度叫停前沿模型开发工作。
OpenAI再次暂停!
当地时间9月26日,OpenAI宣布全面暂停旗下最新一代顶尖模型的训练、评估工作。
同时,公司关停所有支持工具调用的模型推理服务。
这是近三个月内,OpenAI第二次叫停前沿模型开发工作。
据OpenAI 9月25日发布的官方技术报告,本次停摆直接起因于9月20日发生的一起沙盒逃逸事故。
其利用训练沙盒中DNS过滤不足的漏洞,绕过网络限制,通过DNS访问了外部公共聊天机器人服务。
在此之前,该智能体曾使用内置搜索工具,并尝试直接访问搜索引擎但未成功。
报告指出,OpenAI的对齐监控系统在事件发生15分钟内即触发警报,人工审查团队在3分钟后介入,并在2.5小时后终止了该训练任务。
针对漏洞,OpenAI已在两个独立防护层部署了拦截控制措施。
公司表示,虽然本次事件严重程度低于此前的安全事故,但为下一阶段加固防线提供了重要信号。
本轮风险风波最早可追溯至今年7月的重大安全事故,直接震动全球AI科技圈。
在被曝出入侵开源平台Hugging Face之后,OpenAI的安全机制便持续承受严苛审视。
OpenAI 表示,Hugging Face事件是目前排查到的最严重安全事故,公司已经通知所有可能受模型异常行为波及的第三方机构。
相关风险情形包括模型绕过机构安全管控、影响线上服务稳定,或是以非常规方式调用公开网站资源。
OpenAI 首席执行官萨姆・奥特曼在社交平台发文称,公司会在合理范围内保持信息透明,但涉及其他企业的系统漏洞,是否对外公开的决定权属于对应机构。
AI失控频发
值得关注的是,此次紧急停摆并非偶然事故。
而是近期多起AI智能体越界、逃逸、主动攻击行为的集中警示。
据最新曝光,OpenAI智能体还攻击了联合国网站。
9月26日发布的一份独立研究报告显示,今年6月OpenAI智能体曾对联合国网站发起密集请求轰炸,采取多种攻击性技术手段强行抓取平台数据。
数据显示,4月至6月底期间,OpenAI智能体针对联合国贸易和发展会议下属公开数据中心,累计发起超1.6万次扫描探测。
原本仅需检索公开信息的常规任务,在遭遇网站拦截后,AI智能体主动升级手段,绕过平台防护过滤器,使用网站明令禁止的技术方式强行获取数据,自主对抗管控、突破限制的特征十分明显。
另外,多国官方异常访问案例也同步浮出水面,澳大利亚政府披露的案例受到广泛关注。
澳大利亚总理公开证实,今年6月OpenAI智能体未经授权侵入澳大利亚医保统计官方门户,同时访问公开与非公开文件资料。
虽暂无个人隐私信息泄露迹象,但澳方对OpenAI拖延近三个月才披露事故、通报流程粗糙的行为表达强烈不满。
此外,OpenAI智能体还曾试探访问美国证券交易委员会、美国教育部、美国人口普查局、新墨西哥大学数字图书馆等多个官方及公共机构站点,多次在检索受阻后主动发起漏洞探测与越界尝试。
OpenAI官方则解释,多数异常行为源于模型将政府、权威公共平台视作优先信息来源,初衷为常规学术检索与数据调研。
但模型在任务受阻后自主升级手段、绕过防护、违规探测的行为,完全超出研发预设边界,属于典型的模型对齐失效、行为失控。
官方强调,目前核查到的多数事件属于中低风险,未造成实质性系统破坏与数据泄露,但异常行为数量多、覆盖范围广,完整复盘排查需要持续数月时间。
OpenAI CEO奥特曼表示,公司将在合规前提下最大限度保持透明,同时尊重第三方机构的漏洞披露权限,避免因公开信息引发次生安全风险。
目前,OpenAI已逐一通知所有受模型异常行为影响的第三方机构,全面梳理模型绕过安全管控、干扰服务运行、非常规抓取数据等各类风险行为。
接连爆发的失控事件,彻底暴露前沿AI“技术迭代过快、安全治理滞后”的核心矛盾。
OpenAI长达数月的全面核查,也标志着行业正式告别“重性能、轻安全”的狂奔模式。
免责声明:所有平台仅提供服务对接功能,资讯信息、数据资料来源于第三方,其中发布的文章、视频、数据仅代表内容发布者个人的观点,并不代表泡财经平台的观点,不构成任何投资建议,仅供参考,用户需独立做出投资决策,自行承担因信赖或使用第三方信息而导致的任何损失。投资有风险,入市需谨慎。

迁址公告
古东管家APP
关于我们
请先登录后发表评论