当前位置: 首页>网络治理

从“共识”到“共治”,携手探索前沿AI安全协同治理

发布时间: 2026年07月19日 文章来源: 光明网

【人工智能安全治理·光明观察】

7月15日,由世界互联网大会人工智能专委会主办的“前沿人工智能安全风险的协同治理”研讨会在北京举行。研讨会围绕前沿人工智能安全风险的认知与研判、治理理念与路径、国际合作与协同应对等议题展开深入研讨,为构建更加开放、包容、有效的全球人工智能安全治理体系凝聚共识。

风险新态势:AI加速演进,挑战从“理论假设”走向“现实紧迫”

智能体自主决策、具身智能物理交互、AI跨界赋能等前沿方向不断刷新认知边界。曾经停留在学术讨论和未来推演中的安全隐患,正以深度伪造诈骗规模化爆发、模型后门漏洞真实存在、关键基础设施智能依赖加深等形式加速落地为现实威胁。AI风险已不再是遥远的“假设性命题”,而是需要即刻应对的“紧迫挑战”。

“过去被认为只是理论假设的担忧,现在正变得非常现实。”剑桥大学智能未来研究中心教授肖恩·欧·海格缇在视频演讲中坦言。他援引英国人工智能安全研究所的一项研究成果,使用前沿模型识别并修补英国政府数字基础设施的安全漏洞,竟一次性发现了407项安全问题,其中不乏认证绕过、数据暴露和远程代码执行等关键风险。

此前,世界互联网大会发布的相关研究报告将前沿AI技术风险系统归纳为五大类,包括滥用与犯罪风险、信息完整性风险、关键系统风险、社会认知与结构风险、灾难性与生存性风险。

360集团首席科学家、高级副总裁潘剑锋则从技术底层剖析了风险根源。他介绍说,“智能体具备自主性、协同性、演化性三大核心特征,而其安全风险的本质来自大模型的概率性计算机制。在输入完全相同、系统状态完全一致的情况下,智能体意图理解、推理过程都可能产生不同并且不可完全预知的结果。”这种不确定性如同双刃剑,既赋予AI开放创造的能力,也成为新型安全风险的本源。

治理新理念:从碎片化应对到全生命周期协同

面对日益严峻的安全挑战,传统以单点合规、事后补救为特征的碎片化治理模式,已难以适配技术快速迭代、风险跨域传导的复杂局面。唯有将安全治理嵌入研发、训练、部署、运营、迭代的每一个环节,打通技术、产业、政策、国际协作的多重维度,才能在AI加速演进的浪潮中构建起真正可靠的安全防线。

国际人工智能治理协会主席约翰·希金斯从务实执行的角度,提出了全球AI治理的互操作性命题。“全球不同的地区面临着一个分散化的AI治理现象”,他认为,真正建立一个全球统一的AI治理架构目前尚不现实,但可以从统一术语定义、采用基于风险的循序渐进方法、树立全生命周期管理理念、构建针对开发者和部署者的双重治理框架。

“AI是不断在变化的,人们可能会不断修改,因此我们需要从全生命周期的角度去进行AI的管理。所以不仅只是一个简单的测试就可以了,我们需要一个技术工程的态度去对待AI治理的全生命周期。”约翰·希金斯的这番话,阐明了治理思路从“产品安全”向“过程治理”转变的核心要义。

中国人民大学高瓴人工智能学院吴玉章讲席教授、北京前瞻人工智能安全与治理研究院院长曾毅则着眼于模型评估的全球协同。作为世界互联网大会人工智能专委会安全与治理推进计划牵头人,他带领团队开展了大量基础性研究。他展示的一组数据令人深思,对全球主流AI企业的安全评估中,表现最好的企业也仅获得C+等级(约65-70分)。而各国治理准备度的差异更为悬殊,风险监测预警与响应方面仅18%的国家开展了相关工作,技术安全与评测、验证与合规的占比也仅三成左右。

中国新实践:“承诺-验证-基线-标准”飞轮转动

在全球AI治理的探索中,中国实践正以其鲜明特色和扎实成效吸引着世界目光。从《人工智能治理与可持续发展》到《以普惠包容的人工智能治理赋能全球可持续发展》的体系构建,再到《全球人工智能标准发展报告》,中国正在走出一条“承诺引领方向、验证夯实能力、基线划定边界、标准凝聚共识”的递进式治理路径。

本次研讨会上,魏凯系统介绍了中国产业界“以人为本、智能向善”的治理实践,一个由承诺、验证、基线、标准构成的PDCA循环正在加速运转。2024年底,国内23家头部企业共同签署人工智能安全承诺,涵盖风险管理体系建设、模型安全测试、数据安全防护、基础设施安全、安全透明度提升、前沿安全研究等六大方面。这一承诺并非一成不变,随着智能体安全、生成式引擎优化、token服务安全等新风险涌现,承诺内容也在动态补充完善。

微博首席运营官、新浪移动首席执行官、新浪人工智能媒体研究院院长王巍则从平台视角分享了治理实践。他观察到,AI风险正沿着传播链条、决策链条和执行链条不断扩展,安全问题正在从单纯的技术问题转化为涉及多主体、多层次的治理问题。为此,微博构建了权威信源识别、风险内容审核、溯源响应处理、可信传播加权分发的四道防线,主动建立平台可信机制。

全球新共识:多方携手应对共同挑战

人工智能风险无国界,治理之道在于协同。前沿人工智能安全治理是一项全球性课题,需要各国、各利益相关方携手并进、共担责任。世界互联网大会秘书长任贤良表示,大会始终致力于搭建多方对话的桥梁,推动政府、国际组织、产业界、学术界等主体在人工智能治理领域加强交流、深化合作。今年,大会还将发布《前沿人工智能风险与协同治理旗舰报告》,汇聚全球产业、学术和政府实践智慧,为全球AI治理提供公共产品。

本次研讨会还专门设置圆桌对话环节,来自不同背景的专家就协同治理路径深入探讨。联合国人工智能高层顾问机构专家希梅娜·索菲亚·比维罗斯·阿尔瓦雷斯认为,各国立法必然存在差异,但可以在基础流程和机制层面寻求对齐,“评估基准、核验达成一致,能力响应机制、互操作性,这些功能层面的标准比具体法律条文更重要”。

经合组织人工智能未来专家组成员、AI Safety Connect创始人塞勒斯·霍兹则表示,“未来应持续依托世界互联网大会等平台,落地跨国AI攻防演练、安全评测方法共享、风险预警联动机制,让各国、各机构在统一协作框架下,同步跟进前沿AI技术迭代节奏,共同抵御AI衍生的全球性风险”。

实际上,世界互联网人工智能专委会自2024年乌镇峰会期间成立以来,便高度关注人工智能发展与治理议题,依托安全与治理推进计划,聚焦“全球人工智能安全与治理体系设计”“人工智能赋能可持续发展”等议题持续开展联合研究、组织专题研讨、发布公共产品,形成了一定的国际共识与阶段性成果。而此次“前沿人工智能安全风险的协同治理”研讨会,正是专委会搭建对话平台、推动协同治理的又一重要举措。(撰文:丁瑜)

(编辑:边珍)