9月21日,芬兰政府网站公布了一份《控制前沿AI模型的倡议》。20个国家和欧盟委员会联署,美国和中国不在其中。
这份倡议的核心内容是三个方面:
一是要求企业制定透明的安全规程,包括强制性的部署前测试和独立评估,并向具备资质的评估人员提供充分的访问权限,使其能够对相关风险进行评估。
二是各国政府和区域组织进一步制定并协调共同标准,加强透明度,包括共享严重安全事件的报告;同时确保世界各地区的国家都能够获得必要的科学能力、专业知识以及可信赖的评估能力。
三是,联合国会员国在现有国际机制的基础上继续推进合作,并探索建立一个国际机构。该机构应能够制定标准、支持核验,并在人工智能能力跨越特定门槛时召集各国进行磋商。
这件事是芬兰总统Alexander Stubb和挪威首相Jonas Gahr Støre发起的,很多国家签署了,包括加拿大总理Mark Carney、澳大利亚总理Anthony Albanese、德国总理Friedrich Merz、西班牙首相Pedro Sánchez、新加坡总理Lawrence Wong,以及欧盟委员会主席Ursula von der Leyen。
芬兰比较特殊,总统Stubb和总理Petteri Orpo都签了,所以最后是20个国家、欧盟委员会,一共22个签署方。里面也有一些外交部长,不全是国家元首或者政府首脑。
美国和中国都没有签,英国、法国、日本和印度也不在第一批名单里。不过,这份声明仍然开放加入。
Støre当天接受挪威媒体VG采访时说,这份《控制前沿AI模型的倡议》的背景之一是,AI企业自己也越来越担心技术发展带来的风险。倡议大约一周前才形成,随后就带到了联合国大会期间推动。Støre还说,他已经和联合国秘书长古特雷斯谈过,古特雷斯欢迎这项倡议。
过去两天中美在纽约的会谈,根据美方说法,是双方同意建立AI安全事件通报机制(类似冷战时期的“red phone”热线),一旦发生可能涉及国家安全的重大AI事件,双方可以通过这条热线直接通报和沟通。这项安排还将提交特朗普,由他决定是否在本周重要会晤前签署。但中方目前只确认双方讨论了AI问题,没有提到这条热线的情况。按照美方说法,中美还会在11月份在深圳讨论AI智能体失控、非国家行为体利用AI实施网络攻击或生化攻击等风险,统一对风险的认识和后续治理规程。
这20多个国家专门选择在中美AI对话的间隙发布这个倡议,恐怕不无深意。
世界上拥有前沿模型公司的国家主要是中美,其他国家大部分是使用方。使用方最怕的是,模型提供方背着他们把什么模型算安全的、对不安全的模型怎么治理等等,都给定了。更何况,这些国家没有模型能力,却有市场,自然不愿意放手让中美甩开自己去定规则。
值得注意的是,芬兰政府公布的倡议联署国名单里,除了欧洲国家,还有肯尼亚、南非、哈萨克斯坦、巴林、阿联酋、新加坡、加拿大和澳大利亚。参与范围已经超出了欧美内部协调。无论各国加入时有什么具体考虑,这种多边安排都为中美之外的国家提供了一个参与AI安全规则讨论的渠道。
倡议提出的建立“国际核验机构”的设想,实际上也是希望以国际机制来替代中美机制,避免AI安全规则制定权被中美垄断。其具体思路是,联合国成员国利用现有机制,研究建立一个能够制定标准、支持核验,并且在模型跨越某些能力门槛时召集各国进行协调的机构。这个机构要有制定标准、支持核验,并具有在人工智能能力跨越特定门槛时召集各国进行磋商的权限。
但是国际核验和事件通报可不是一个level的事情。企业说自己履行了安全承诺,需要有办法确认,不能只凭它自己的说明。企业要提供什么证据,检查人员能看到多少内部资料,将来有没有可能进入实验室,都需要具体安排,而且往往是极其难啃的骨头。涉及中美最先进模型的研发时,商业秘密和国家安全问题也很难绕开。要建立国际核验机制,谈何容易。
斯特勒在VG采访中提到了国际原子能机构,让人联想到前些年常说的“AI版IAEA”。这不是个新想法,是OpenAI早在2023年5月就提出来的,当时也是说未来可能需要一个类似IAEA的国际机构,对超过一定能力门槛的系统开展检查、审计和安全核查。但这样的机构至今没有建立,关于“AI版IAEA”,感觉大家说的也越来越少了。
值得注意的是,同样在9月21日,OpenAI发表了另一份国际标准建议。这次它更强调由美国牵头,依托各国AI安全研究机构的合作,统一能力测量、风险评估和事故报告等技术标准。它还特意说明,这些标准本身不构成许可证制度、强制发布前审查或模型批准要求;要不要把标准写进法律,由各国决定。
随着各国、各方纷纷提出AI监管的建议和主张,AI治理的国际博弈从现在起算是真正进入了深水区。
来源:“东不压桥研究院”微信公众号
原文链接:https://mp.weixin.qq.com/s/hO4vP1AyC_hK5ILcoKr6fg?scene=25&sessionid=#wechat_redirect
