文章总结: 本报告探讨将人工智能安全视为全球公共产品的概念,指出三个关键协调挑战:平衡集体责任与针对性问责、安全与能力纠缠、发展公平问题。报告提出AI安全的三个层面(技术、知识、制度)和三种治理框架(集聚力量、最薄弱环节、单一最佳方案),强调国际合作与渐进式治理策略的重要性,以应对AI带来的全球性风险并促进可持续发展。
综合评分: 86
文章分类: AI安全,政策法规,安全建设,网络安全,解决方案
安远AI联合发布《人工智能安全作为全球公共产品:影响、挑战与研究重点》报告
安全进化论
2025年5月10日 19:02
广东
导读
随着人工智能系统的能力不断增强并深入融入社会,人工智能的安全开发已经成为一项关键的治理挑战。习近平主席在中共中央政治局第二十次集体学习时强调,人工智能可以是造福人类的国际公共产品。
具体到人工智能安全领域,《人工智能安全作为全球公共产品:影响、挑战与研究重点》(Examining AI Safety as a Global Public Good: Implications, Challenges, and Research Priorities) 由安远AI、牛津马丁人工智能治理倡议和卡内基国际和平研究院共同主导,该报告借鉴气候变化、核安全和全球健康治理的经验教训,探讨了将人工智能安全视为”公共产品”是否能帮助应对这些挑战。分析确定了三个关键的协调挑战:
- 平衡集体责任,同时追究在人工智能开发中拥有不成比例权力的利益相关者的责任
- 管理共享人工智能安全最佳实践与限制潜在危险能力传播之间的张力
- 确保安全要求不会限制人工智能对可持续发展的潜力或延续全球不平等
上海交通大学国际与公共事务学院长聘副教授贾开、清华大学公共管理学院长聘副教授赵静、安远AI国际人工智能治理主管吴君仪、安远AI创始人谢旻希,与来自世界各地的12位学者共同撰写了这份报告。
报告执行摘要
随着人工智能系统变得越来越强大并融入日常生活和全球基础设施,确保其安全开发和部署已成为我们这个时代最紧迫的治理挑战之一。虽然当前的狭义人工智能系统已经在社会特定领域产生了重大影响,但先进的人工智能系统可能通过其递归自我改进和通用问题解决能力的潜力从根本上改变人类生活,使其开发和治理成为人类未来独特的关键挑战。本分析借鉴气候变化、核安全和全球健康治理的经验教训,探讨了将”公共产品”框架应用于理解和应对先进人工智能系统带来的挑战是否可行以及如何实现。”公共产品”是指可供所有人使用,且在使用过程中不会减少其对他人可用性的商品。本文分析了全球公共产品文献框架和人工智能治理中的新兴挑战。我们的分析揭示了克服协调问题的几个关键挑战:
- 平衡集体责任与针对性问责:人工智能安全需要广泛合作,但这不应减轻领先人工智能开发者和拥有不成比例的权力和影响力的国家在确保安全发展方面的责任。然而,开发前沿人工智能的国家与主要应用他国创建的人工智能的国家之间存在巨大差距,促成了国际合作的复杂动态,例如将全球安全措施合作限制在少数关键决策者手中。
- 安全-能力纠缠:采取某些关键人工智能安全措施可能也涉及人工智能能力提高;反之,某些关键的人工智能安全措施甚至可能需要先进的人工智能能力才能实施。这一现象在共享安全进展(促进安全技术的普及)和限制 人工智能能力扩散(防止人工智能技术被用于安全或军事风险领域)之间形成了紧张关系。
- 发展公平: 确保对于人工智能的安全要求不会过度限制人工智能参与实现减贫等全球和可持续发展目标中的策略,也不会延续全球系统中长期存在的不平等现象,这一点很重要。本分析并不主张具体的政策措施,而旨在推进我们对集体行动机制如何有效解决人工智能安全挑战的理解,同时促进公平并明确责任界限。此外,我们还提供了进一步研究全球公共产品框架在人工智能安全应用方面的途径。
本分析并非倡导具体的政策措施,而是增进我们对集体行动机制如何有效应对人工智能安全挑战的理解,同时促进公平并维持明确的责任界限。此外,我们还提供了进一步研究全球公共产品框架在人工智能安全应用方面的途径。
近期国际发展
**人工智能安全作为全球公共产品的概念在国际论坛中获得了显著关注:
2024年7月《人工智能安全作为全球公共产品》研究报告(中文版)**
- 《人工智能安全作为全球公共产品》研究报告于2024年7月在上海世界人工智能大会上发布。它承认多边和多利益相关方行动在推进人工智能安全方面的积极且重要的作用,同时也认识到潜在的改进领域。
- 安远AI国际人工智能治理主管吴君仪、安远AI创始人谢旻希参与了该报告的英文翻译。
2024年9月 联合国人工智能高级别咨询机构《为人类治理人工智能》
- 发布了关于全球推动负责任和安全的人工智能治理的建议,包括设立国际人工智能科学小组、人工智能标准交流、能力发展网络,以及全球人工智能基金,以缓解日益扩大的”人工智能鸿沟”。
- 报告还指出:”在全球层面汇集科学知识是最有效的方式,它能够促进对全球公共产品的共同投资,并实现公共利益合作,避免分散和重复努力。”
2024年9月《关于人工智能包容性全球科学理解的曼哈顿宣言》
- 由21位有影响力的人工智能研究人员和政策专业人士在2024年9月的联合国大会上签署,该宣言旨在将人工智能作为”全球公共产品”进行推广,并鼓励采用包容性和全球性的方法来理解人工智能的能力、机遇和风险。来自中国的参会者和签署人包括阿里云创始人王坚,联合国人工智能高层顾问机构专家、中国科学院研究员曾毅和安远AI创始人谢旻希。
- 宣言声明:”我们重申致力于开发对人类有益的人工智能系统,并承认它们在实现全球可持续发展目标(如改善健康和教育)方面的关键作用。我们强调,人工智能系统的整个生命周期,包括设计、开发和部署,必须与核心原则保持一致,保障所有人的人权、隐私、公平和尊严。”
2024年9月 国际人工智能安全对话
- 一系列会议汇集了中国和西方顶尖人工智能科学家,包括图灵奖获得者Yoshua Bengio、姚期智和Geoffrey Hinton。他们最近在威尼斯举行的会议产生了一份共识声明,强调了全球合作解决人工智能安全问题的紧迫性,并提出了具体建议,如建立应急准备协议和机构、制定安全保障框架,以及通过设立基金促进独立的全球人工智能安全和验证研究。
- 声明的结论指出:”人工智能带来的风险具有全球性,这使得有必要将人工智能安全视为全球公共产品,并致力于对这些风险进行全球治理。我们必须共同准备,以避免可能随时到来的灾难性风险。”
对公共产品分析的启示
**与先进人工智能相关的公共产品和工具包含多个相互关联的层面,而非单一类比:
- 技术层面:人工智能系统的基本安全性和可靠性是基础性公共产品,类似于清洁空气或稳定气候。开源评估工具可广泛共享,但需主动维护。安全技术措施常与增强能力措施交织,在国际竞争环境下可能影响其非竞争性和非排他性特征。
- 知识层面:科学理解和治理能力构成另一层公共产品,类似于公共卫生中的医学知识。随参与度增加而增值,但面临获取和公平挑战,相关专业知识集中在特定机构和地区。
- 制度层面:治理框架和能力发展基础设施形成第三层,类似于国际和平或疾病预防框架。安全治理最佳实践具公共产品特征,可跨环境实施,但所需专业知识和制度能力可能具竞争性和暂时排他性。
从这些见解中产生三个潜在框架:
- 人类能动性作为普遍价值:在人工智能时代,维护人类选择和控制权是普遍价值,一旦受损将影响全人类。
- 安全知识作为共享资源:人工智能安全的集体理解可作为非竞争性资源,随共享增值,支持以人类福祉为中心的核心公共产品。
- 治理能力作为共同基础设施:人工智能共享治理能力可提供普遍利益,并随更广泛实施而改进。
没有任何单一框架能够完美捕捉人工智能安全作为全球公共产品的方方面面,但结合多种视角可以帮助为集体行动建立明确的焦点。本分析并非旨在给出关于哪种框架最佳的最终意见,而是为了激发讨论并促进进一步研究。**
**### 对安全治理政策的启示
尽管先进人工智能系统最终可能带来跨国界的风险,但许多紧迫的安全挑战首先在地方或区域层面显现,如基础设施可靠性或系统测试标准。应对这些局部风险的措施往往能缓解更广泛的全球风险,表明国家和区域安全框架可作为国际治理的基础组件。这种渐进方法与技术治理的历史模式一致,公共产品框架常常先在国家和区域层面证明有效,才扩展至全球协调。
在人工智能安全领域,渐进式的公共产品供给策略能有效缩小技术鸿沟——既帮助拥有强大人工智能开发能力的国家,也兼顾那些主要关注人工智能应用影响的国家,同时在各个治理层面保持清晰的安全责任边界。
以下分类框架有助于我们理解人工智能安全领域的不同组成部分如何作为整体战略的有机组成相互配合,从而实现更全面、更有效的安全治理:
**1. 集聚力量(Aggregate Efforts): 这需要各利益相关方协调一致、共同努力,方能达成靠累积工作才能实现的广泛而深入的目标。在人工智能安全领域,这可以体现为协作制定安全评估标准,类似于气溶胶/反氯氟烃的监管需要生产国和消费国全面参与。为确保此方法成功,政策制定者必须确立明确的标准,并确保在标准的制定与实施过程中各方广泛参与,尤其要避免“监管套利”现象,即人工智能开发者将活动转移至监管较宽松的地区。
- 最薄弱环节(Weakest Link): 此框架侧重于解决全球系统中最薄弱环节的脆弱性。对人工智能安全而言,这意味着应在所有进行人工智能开发或部署的司法管辖区优先发展基础安全能力和监测系统。这种方法认识到,任何地方不安全的人工智能开发都可能给所有人带来风险,正如疾病控制需要全面的全球监测,因为疾病可能在某地出现,但会跨越国界传播。
- 单一最佳方案(Single Best-Shot): 该模型侧重于突破性解决方案,一旦开发成功,就能使所有利益相关方受益。在人工智能安全领域,这可能适用于形式化验证方法或稳健性技术等领域的基础性进展,这些进展一旦被发现,就能得到广泛应用。这种方法表明,我们应将资源集中于关键技术挑战,同时确保解决方案在全球范围内得以推广。
在选择和组合方法时,应兼顾技术现实和政治可行性。这种循序渐进的方法有助于积累动力,同时保持明确的责任和问责机制。****
报告图表
- 全球公共产品对比框架
* 人工智能和全球公共产品的替代性框架
点击“阅读原文”,获取报告全文
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:安全进化论 《安远AI联合发布《人工智能安全作为全球公共产品:影响、挑战与研究重点》报告》