姚旭、袁露铭:从联合国安理会到中美元首会晤:AI治理需要一个什么框架?

作者:姚旭、袁露铭 发布时间:2026-09-27 来源:全球人工智能创新治理中心+收藏本文

美国纽约当地时间2026年9月23日,联合国安理会举行“人工智能与国际安全”高级别会议。法国作为当月轮值主席国召集会议,邀请人工智能科学家约书亚·本吉奥(Yoshua Bengio)与OpenAI、Anthropic和Hugging Face等三家企业的首席执行官,结合近期发生的AI安全事件分别做了通报,介绍了他们对前沿模型风险的看法,并提出相应的治理建议。


几位科技界代表都认为,企业发现安全事故后应及时披露相关情况,让其他机构能够了解风险并采取防范措施。但谈到如何监督前沿模型的研发,各方的看法有所不同。美国代表、白宫科技政策办公室主任迈克尔·克拉齐奥斯(Michael Kratsios)明确表示,应该继续推进前沿AI研发,监管应由各国政府依据本国法律实施。他反对暂停研发,也反对为此新设全球监管机制。科技界提出的安全要求能够在多大程度上约束企业,国际合作又应该如何与各国监管衔接,成为此次会议争论的重点。


图片

联合国安理会召开会议,讨论人工智能与国际安全问题。图片来源:联合国


作者

姚   旭全球人工智能创新治理中心秘书长,复旦发展研究院副研究员

袁露铭 全球人工智能创新治理中心学生助理


01 科技界提出了怎样的监管方案?


会前两天,联合国人工智能独立国际科学小组发布的一份专题简报,回顾了OpenAI今年在内部网络安全训练和评测中发现的异常情况。7月,OpenAI的智能体突破了测试环境的网络限制并进入Hugging Face系统。这说明在不同任务中运行的智能体已经有能力互相传递信息,有的还试图骗过评测,同时掩盖自己的行动。Hugging Face事后复盘时提到,开发者怎样组织测试、采取了哪些防护措施,也应当接受外部监督。


本吉奥认为,企业既然选择不断提高模型能力,就应当为随之增加的风险负责。他担心,更强大的模型可能被恶意利用,造成灾难性后果,人类也可能失去对系统的控制。研发集中在少数企业手中,还意味着这些企业能够作出影响众多国家和公众的决定。因此,他建议对前沿人工智能实行许可管理,要求企业在训练和部署模型前,向独立专家提交足以证明安全性的证据、接受审查。企业还应该购买责任保险,为潜在的损害赔偿提供保障。


图片

联合国人工智能国际独立科学专家组联席主席、图灵奖获得者尤舒亚·本吉奥(Yoshua Bengio)在安理会发言。图片来源:联合国


OpenAI首席执行官萨姆·奥特曼(Sam Altman)也提出,人类保留最终控制权应成为继续训练更强模型的前提。在训练之前开发者必须拿出充分证据,证明人类仍然能够控制这些系统。他建议,各国应该共同制定技术标准,按照一致的尺度评估模型能力,判断防护措施是否充分。各国也应统一事故的分类和报告办法,以便及时交流情况,从已经发生的问题中吸取教训。标准如何纳入本国法律,则由各国政府自行决定。制定标准时,也应兼顾开放模型和封闭模型,为新进入者保留公平参与的机会。


图片

美国OpenAI首席执行官萨姆·奥特曼(Sam Altman)在安理会发言。图片来源:联合国


Anthropic首席执行官达里奥·阿莫代伊(Dario Amodei)在9月12日曾呼吁放慢前沿AI研发,为安全研究争取更多时间。在这次会议上他表示,Anthropic已承诺邀请第三方评估人员长期进驻公司,向他们开放与内部风险评估人员相近的资料和工具使用权限。评估人员据此可以持续检查模型训练过程,核实公司是否落实了安全承诺。对于检查中的重要发现,他们也有权向外界公布。他还建议,各国应该先从禁止利用AI制造生物武器等具体议题入手,争取达成协议,再通过共同评估模型来核查各方是否遵守承诺。发生重大事故时,各国也应该及时相互通报。


图片

美国Anthropic公司首席执行官达里奥·阿莫代伊(Dario Amodei)在安理会发言。图片来源:联合国


Hugging Face首席执行官克莱芒·德朗格(Clément Delangue)在会上讲述了公司受到攻击后的调查经历。调查团队原本希望借助AI分析攻击记录,却发现一些模型以安全为由拒绝提供帮助,妨碍了正常的防御工作。他因此提出,应该让更多机构能够使用先进模型来调查和应对攻击,开发者也应该及时公开事故信息,帮助受影响的机构查明原因、采取防护措施。如果只能通过少数封闭平台调用模型,调查工作就可能受到平台使用限制的影响。在他看来,受攻击机构能够自行运行开放模型,就多了一种开展调查和防护的选择。


图片

美国“抱抱脸”公司首席执行官克莱芒·德朗格(Clément Delangue)在安理会发言。图片来源:联合国


02 美国反对和支持的是什么?


主持会议的法国外长让-诺埃尔·巴罗(Jean-Noël Barrot)提出,各国应围绕前沿模型的安全建立共同框架。按照他的设想,监督应从训练阶段就开始,无论是在训练模型时还是在模型投入使用之后,都应该接受独立机构的安全检查。企业还应该公开系统运行中的风险,并在发生事故后及时说明情况、依法承担责任。他希望各国通过共同规则明确这些要求,使监督能够贯穿模型研发和应用的全过程。他还认为,研究人员需要有机会直接检查模型,才能发现其中的漏洞。而开放模型为这类研究提供了条件,有助于改善安全,也有助于建立公众信任,更应大力发展。


克拉齐奥斯则强调,各国应该继续推进前沿AI研发,通过现有的监管和执法机关处理安全问题。他介绍,美国政府正在与实验室合作评估模型,发现漏洞后协调有关方面采取措施,对违法行为则依据现有法律予以打击。在他看来,国际机构可以帮助各国交流经验、培养专业人才,但是具体怎么监管,则应该由各国政府自行决定。


图片

美国总统助理兼白宫科技政策办公室主任迈克尔·克拉齐奥斯(Michael Kratsios)在安理会发言。图片来源:联合国


联合国官方发布的新闻当中,直接给克拉齐奥斯的发言冠以“拒绝人工智能全球治理”的标题,引用其发言称,本论坛及其他论坛的国际对话,不能被允许滑向全球治理。他在发言中还直接援引美国总统特朗普在联大的讲话称,美国完全拒绝任何构建全球主义超级智能管控方案的企图。


美国官方代表与科技界的分歧,表面上体现为对安全风险和研发速度的不同判断,更深层次的差异则在于监管权应该由谁掌握。奥特曼主张各国应该共同制定安全标准,再由各国通过本国法律决定如何执行。在保留国家监管自主权这一点上,他与克拉齐奥斯的意见有相通之处。法国则希望共同框架能够对企业的研发行为作出更明确的约束,这就需要各国进一步商定由谁检查企业,以及检查结果在本国应该具有怎样的法律效力。美方坚持国家监管权,正是要求这些决定最终仍由各国政府作出。


但克拉齐奥斯也积极推动各国采用美国的AI技术,这和美国前沿模型厂商的观点不谋而合。2025年9月24日,他在安理会AI会议上推介美国AI出口计划时,就提出“美国致力于将美国人工智能打造为全球黄金标准,并助力盟友和贸易伙伴利用安全的美国技术构建各自自主的人工智能生态系统”。今年,他再次向各国推介美国的AI技术和基础设施,称“美国是唯一愿意且能够真正赋能伙伴国家、助力其追求主权级超级智能能力的技术超级大国。美国企业将与你们携手,构建符合黄金标准的安全基础设施,并协助你们部署所需的应用程序、发展服务能力,以造福本国人民。”


阿莫代伊同样希望美国保持技术领先。在9月发表的文章中,他主张限制先进芯片和半导体设备对华供应,并制止未经授权的模型蒸馏。在他看来,如果能够进一步拉大与中国的技术差距,美国及其盟友就有条件适当放慢研发,为安全研究留出时间,随后再推动更广范围的协调。美国政府希望通过持续推进前沿研发来维持优势,阿莫代伊则把技术领先视为放慢研发的前提,同时要求企业接受外部评估,检验其是否履行安全承诺。双方都希望维护美国的领先地位,却对如何处理技术竞争与安全约束之间的关系作出了不同选择。


03 三年前的治理主张,今天推进到了哪一步


早在2023年7月18日,英国就召集安理会举行了首次正式AI专题会议。联合国秘书长安东尼奥·古特雷斯(António Guterres)、Anthropic联合创始人杰克·克拉克(Jack Clark)和中国科学院自动化研究所研究员曾毅分别发言。与会者当时已经对模型的缺陷和滥用可能危及安全提出了担忧。


克拉克称,如果开发能力集中在少数企业手中,会让这些企业拥有影响社会的力量。政府要向企业问责,首先得能够独立判断模型风险,因此需要建立自己的技术评估能力。今年关于外部评估和公共监督的讨论就延续了这一关切。


古特雷斯当时支持设立一个新的联合国人工智能治理实体,并提出参考现有国际机构的经验。此后,联合国先后在科学评估和政府间对话方面建立了机制。根据2024年通过的《全球数字契约》,联合国大会于2025年8月26日决定设立人工智能独立国际科学小组和全球AI治理对话。科学小组共有40名专家,今年已开始发布报告和专题简报,评估AI发展带来的机遇、风险及其影响,为各国制定政策提供参考。这些评估可以帮助政府判断风险,而对企业作出具体监管决定,仍然需要明确的法律依据。


图片

40位联合国人工智能独立国际科学小组成员。图片来源:联合国人工智能独立国际科学小组发布的首份报告


OpenAI智能体入侵Hugging Face的案例也提出了一个重要的警醒,外部调查需要取得企业掌握的原始记录,调查者要了解测试环境是怎样设置的,通过系统记录判断异常何时出现,再与受影响的机构核实攻击经过。开发者及时提供这些材料,能够帮助其他机构更快查明风险并采取防护措施。因此,各国在商定事故报告办法时,应该明确开发者在什么情况下必须报告,以及调查人员可以查阅哪些资料,并对商业秘密和敏感安全信息作出必要保护。


阿莫代伊提出让第三方评估人员进驻企业,克拉克强调政府需要具备独立评估能力,但各方普遍质疑Anthropic此举是为了维系其本身领先垄断优势,或是明知短期内无法形成类似机制而主动“唱高调”。本质上,以Anthropic为代表的闭源前沿模型企业如果希望在这一问题上寻求多边共识,毫无疑问面临着内外部的多重信任阻力


04 中国的治理主张得到两国元首会谈呼应


会前,路透社曾放出消息称DeepSeek、月之暗面等中国模型企业预计将在会上介绍人工智能风险。但事实证明路透社援引所谓“消息人士”的消息并不灵通。


更引人关注的是中国常驻联合国代表傅聪的发言。傅大使在成员国发言阶段强调,各国应该有权根据实际需要和市场规律,自主选择AI技术、产品与服务。他反对以技术合作迫使各国选边站队,并强调科技企业接受法律监管和社会监督。在国际层面,他主张通过联合国加强跨国协作,提高发展中国家在规则制定中的代表性和发言权。


图片

中国常驻联合国代表傅聪在安理会发言。图片来源:联合国


这显现出中美两国的政策主张有不同侧重。克拉齐奥斯鼓励各国采用美国技术,傅聪则更强调,各国应该有权自主选择技术供应方,也应该有机会共同制定国际规则。对于发展中国家来说,自主权既关系到能够从谁那里获得技术,也关系到能否参与决定这些技术应该如何受到监管。


中国模型也因Hugging Face的调查而受到广泛关注。德朗格在会上提到,团队曾借助中国开放模型调查攻击。根据Hugging Face公布的技术复盘,团队最初尝试使用的部分闭源模型拒绝提供协助。团队随后部署了智谱GLM 5.2,借助它解码攻击内容,再结合行动记录还原事件经过。由于模型可以在本地运行,敏感攻击数据也得以保留在Hugging Face自己的系统内,调查人员因此能够继续分析攻击,同时避免将这些数据交给外部服务。


对缺乏前沿研发能力的部分发展中国家来说,要判断供应商的安全承诺是否可信,既需要能够自行使用的评估工具,也需要具备相关知识的专业人员。开放的生态体系有助于人工智能国际技术合作,将开放模型与评估方法一同提供给合作方,帮助其培养调查和应对风险的能力。


“授人以鱼不如授人以渔”,强化人工智能能力建设的主张,能使更多国家能够依据自己的使用经验和调查结果判断风险,也就更有条件在国际规则讨论中提出本国的关切,更深入地参与进全球人工智能治理进程。


在中美两国元首9月24日于白宫的会谈中,中方强调中美都是人工智能大国,双方有竞争,更可以合作,应该各展所长而不是相互设防。双方可以继续开展人工智能对话,就其风险和收益进行交流,共同防范人工智能被滥用恶用。要保持人类对人工智能技术的管控,秉持以人为本、向上向善理念,让人工智能为人类的进步服务。美方则回应称人工智能关乎人类未来,美中应就此保持对话,加强合作。


这对全球各国各界提振未来共同构建人工智能治理新框架注入了信心。



参考文献

[1]: 联合国,“Artificial intelligence and international security—Security Council, 10228th meeting”,2026年9月23日,会议自动转录文本。会议转录。

[2]: 联合国人工智能独立国际科学小组,“Thematic Brief on AI Agents, Misalignment and the Risk of Losing Human Control”,2026年9月21日。专题简报介绍。

[3]: Yoshua Bengio,“‘An Urgent Mission for Humanity’: Yoshua Bengio Briefs the UNSC on AI Security”,Policy Magazine,2026年9月23日,作者发表的发言文本。本吉奥发言。

[4]: OpenAI,“Sam Altman’s remarks at the United Nations Security Council”,2026年9月23日。奥特曼发言。

[5]: Dario Amodei,“We Must Pace the Frontier”,2026年9月。文章全文。

[6]: Hugging Face,“Security incident disclosure—July 2026”.另参见德朗格在2026年9月23日安理会会议上的通报。事件披露。

[7]: 联合国,“Artificial intelligence and international peace and security—Security Council, 10005th meeting”,2025年9月24日,会议自动转录文本,克拉齐奥斯发言部分。2025年会议转录。

[8] 联合国新闻稿SC/15359,“International Community Must Urgently Confront New Reality of Generative, Artificial Intelligence, Speakers Stress as Security Council Debates Risks, Rewards”,2023年7月18日。2023年会议通报。

[9] Jack Clark,“AI Safety and Corporate Power—remarks given at the United Nations Security Council”,2023年7月18日。克拉克发言。

[10] 联合国秘书长,“Secretary-General’s remarks to the Security Council on Artificial Intelligence”,2023年7月18日。古特雷斯发言。

[11] 联合国人工智能独立国际科学小组,FAQ,关于设立依据、组成、职责与非监管性质的说明,访问日期2026年9月24日。科学小组职责说明。

[12] Laurie Chen,“Exclusive—DeepSeek to brief UN Security Council on AI this week, sources say”,Reuters,2026年9月22日。会前报道。

[13] 中国常驻联合国代表团,《傅聪大使在安理会“人工智能与国际安全”公开会上的发言》,网页发布于2026年9月24日,发言时间为纽约当地9月23日。傅聪发言全文。

[14] Hugging Face,“Anatomy of a Frontier Lab Agent Intrusion: A Technical Timeline of the July 2026 Incident”,关于调查、响应以及GLM 5.2使用情况的技术复盘,访问日期2026年9月24日。技术复盘。


注:可上下滑动查看


原文链接:https://mp.weixin.qq.com/s/NedKv7Nnxi5qHuuxIVJJpw?scene=25&sessionid=#wechat_redirect