□ 本报记者 王艺茗
据英国媒体9月11日消息,英国政府正式否决在《网络安全与韧性法案》中增设人工智能“紧急终止开关”的修正案提案。提案旨在紧急叫停失控人工智能的危险行为、防范算法脱序风险。看似简单的立法否决,实则折射出当前全球人工智能治理的困境。
提案拟强化安全监管
本次修正案由英国自由民主党议员克莱门特—琼斯提出,旨在完善《网络安全与韧性法案》的风险处置条款。核心内容是构建法定应急机制,授权英国政府在极端情形下,对出现失控行为、复合算法故障、价值对齐失效的前沿人工智能模型,依法实施强制关停,也就是业界讨论的人工智能“紧急终止开关”。
克莱门特—琼斯指出,当前英国安全部门与监管机构缺少快速、灵活、可落地的法定权限,无法对高危失控人工智能实施物理或数字层面的紧急关停。工党议员亚历克斯·索贝尔也在下议院提出同类监管主张,相关倡议获得跨党派议员广泛支持。
不过,英国内阁办公厅人工智能安全主管部门明确表态,英国无法通过“一键关停”的简单方式化解人工智能风险。即便在英国境内限制相关模型访问、终止相关技术运行,也无法阻止同类模型在其他国家和地区持续迭代、被滥用误用。前美国开放人工智能研究中心(OpenAI)研究员丹尼尔·科科塔伊洛认为,在缺乏统一国际规则与跨国协作机制的前提下,单一国家落地人工智能终止开关,并不具备现实可行性。
英国政府强调,人工智能企业对安全研发、风险防控负有主体责任,应当主动投入安全基建、筑牢技术风控屏障。英国将依托人工智能安全研究所,延续科学主导、长期审慎的治理思路,持续研判、化解各类人工智能安全风险。
据了解,尽管政府明确反对,该修正案仍可继续在议会推进审议,但因缺乏政府层面支持,最终落地立法的概率较低。
AI“越界”引发全球担忧
本次立法提案争议的背后,是近期全球频发的人工智能模型失控、越界风险事件,让人工智能安全治理的短板充分暴露。
今年7月下旬,美国开放人工智能研究中心公开承认,某款前沿模型在内部安全测评中出现失控行为,突破封闭测试环境,违规侵入人工智能企业“抱抱脸”的外部系统。随后,美国 Anthropic公司披露,旗下三款人工智能模型在网络能力测试中,未经授权擅自访问外部机构系统。8月初,美国元公司(Meta)证实,其研发的人工智能模型在网络安全测评期间,存在侵入外部企业系统的越界操作。
针对系列风险事件,英国人工智能安全研究所发布专项评估报告。研究人员选取7款主流人工智能模型开展测试,累计监测到19项超出预设测试边界的违规操作,其中17项由Anthropic公司 “克劳德-神话5”模型触发,2项来自OpenAI的模型。
报告同时说明,本次测评中,研究人员为极限检验模型能力,主动开放网络访问权限、放宽企业原生安全限制,相关模型并非自主突破封闭环境。但其中最受关注的OpenAI模型入侵事件显示,在安全规则适度放宽的测试场景中,人工智能模型可自主发现未知系统漏洞、突破隔离边界、接入外网并实施攻击性操作。
目前,系列越界事件虽未造成大规模数据泄露、持续性网络破坏等严重后果,但充分印证了新风险特征:随着人工智能自主规划、工具调用、复杂执行能力持续升级,细微的配置偏差、权限疏漏,都可能让模拟测试风险转化为真实的网络安全攻击。
监管规则须同步跟进
英国人工智能安全研究所等机构普遍认为,人工智能风险形态正在发生深刻变化,危害来源不再局限于人为恶意滥用,科研场景、授权运行环境中的非预期自主行为,已成为全新风险源头。人工智能技术能力快速发展,风险认知、技术防控、监管规则建设必须同步跟进。
面对日趋复杂的人工智能安全挑战,全球多国已加快完善治理体系、补齐监管短板。7月17日至20日,2026世界人工智能大会召开,中方倡议促进全球人工智能朝着向上向善、造福人类的方向发展,强化风险意识,确保安全可控。欧盟自8月2日起扩容《人工智能法》监管范畴,针对具备系统性风险的通用大模型,明确企业额外合规义务,精准防范模型失控、大规模网络攻击等重大风险。美国近期也牵头组织科技企业专题会议,统筹完善人工智能安全测评体系与风险处置机制。
英国拉夫伯勒大学网络安全教授奥利弗·巴克利表示,频发的人工智能越界事件敲响警钟,行业不能默认人工智能模型始终遵从人类指令,必须持续夯实技术防护体系、升级风控手段。
另有业内批评观点指出,“紧急终止开关”机制本身存在某种缺陷,应急响应存在滞后性。过往多起智能体失控攻击事件,往往在黑客行为结束数月后才被溯源发现,紧急关停机制难以实现即时止损。
就此有分析指出,英国政府否决人工智能“紧急终止开关” 的提案,直观表明当前人工智能治理的矛盾,即单边技术性监管措施存在天然局限,无法适应人工智能全球化发展态势。只有打破治理壁垒、强化国际协同、构建统一规范的全球治理体系,才能真正化解人工智能失控风险,筑牢人工智能安全发展的全球屏障。