文章总结: 文章提出健全人工智能重大安全风险防控体系,针对大模型与智能体应用带来的系统性风险,从完善法律法规、健全分类分级监管、厘清安全责任、构建全生命周期技术监测、强化风险预警研判及完善应急响应机制等方面提出治理框架,强调多主体协同与动态调整,以平衡安全管控与创新发展。
综合评分: 85
文章分类: AI安全,政策法规,安全建设,解决方案
观点 | 健全人工智能重大安全风险防控体系
刘密霞
刘密霞
中国信息安全
2026年9月28日 18:09
北京
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
人工智能作为引领新一轮科技革命和产业变革的战略性技术,其影响随着大模型及智能体在经济社会各领域的深度应用而显著增强。在此过程中,人工智能安全风险正由数据泄露、算法偏差、内容失真等孤立性风险,向自主决策失误、技术滥用、关键基础设施扰动及跨领域风险耦合等系统性、复合型风险演进。近年来,我国围绕算法推荐、深度合成、生成式人工智能服务等制定了一系列管理规定,人工智能安全评估、算法备案、内容治理和技术标准建设持续推进,初步形成了以法律法规为基础、以部门规章和技术标准为支撑的治理框架。随着人工智能从内容生成工具加速进入生产制造、金融医疗、公共治理和智能终端等领域,人工智能安全治理的重点正在由单一环节规范转向全生命周期防控、由一般合规管理转向重大风险治理。
完善法律法规体系,
筑牢重大安全风险防控的制度根基
大模型与智能体正加速渗透至金融、电力、通信、交通、医疗及政务等关键领域,当前在重大安全风险界定、跨域风险协同防控、智能体行为责任归属以及安全事件应急处置等方面,仍存在制度供给不足的问题。
加快构建层级清晰、衔接有序的人工智能法律规范体系。立足人工智能技术迭代迅速、应用场景广泛、风险不确定性高等特征,强化基础性立法的研究与论证,明确人工智能研发、提供、部署及使用环节的基本准则。同时,需做好人工智能相关制度与网络安全、数据安全、个人信息保护、科技伦理、产品质量及公共安全等既有法律制度的有机衔接,有效规避监管规则交叉、责任重叠或治理空白等现象。针对重要领域的应用场景,行业主管部门应结合具体场景特征制定配套规则与监管指引,逐步形成以基础规则为统领、专项规定为支撑、行业规范为细化、技术标准为配套的制度体系。
健全以风险为导向的分类分级监管机制。人工智能的安全风险不仅取决于模型自身的技术能力,更与其应用场景、权限范围、服务规模及潜在损害后果密切相关。应综合考量模型的通用性、自主性、工具调用能力、用户覆盖规模、行业重要程度以及风险扩散范围,科学划分一般应用、高风险应用及可能产生重大安全影响的应用类别。基于技术能力演进与风险形态变化,动态调整风险目录、监管标准及合规要求,从而提升制度体系的适应性与前瞻性。
进一步厘清人工智能产业全生命周期的安全责任边界。应依据其在模型研发、服务提供、系统集成和场景应用中的功能定位及对风险的实际控制能力,合理配置安全责任。重点压实人工智能服务提供者的主体责任,督促模型开发者强化模型测试与安全评估,明确部署应用单位在权限配置、运行监测、人工监督及事件报告等方面的职责,并引导使用者依法规范使用人工智能服务,构建多方协同、责任明晰的安全治理格局。
完善技术监测体系,
提升重大安全风险动态感知能力
人工智能系统具有内部机理复杂、运行状态动态演化及风险表现隐蔽等特征,部分安全隐患在研发测试阶段往往难以显现,却可能在模型迭代更新、外部工具接入、用户交互深化及规模化应用过程中逐步暴露。因此,需进一步构建覆盖模型状态、能力变化、异常行为和系统依赖的动态风险感知体系。
建立覆盖人工智能全生命周期的技术监测机制。依据人工智能风险在数据、模型、部署及应用等不同阶段的异质性表现,科学界定监测对象与重点范畴。数据环节重点强化对训练数据来源合法性、数据质量可靠性、敏感信息泄露隐患及数据投毒风险的监测。模型环节着重评估模型运行的可靠性、安全护栏的有效性、危险能力的演变趋势及异常行为倾向。部署环节重点监控系统权限配置、外部工具接入安全、模型更新流程及供应链韧性。应用环节重点关注智能体越权操作、异常高频调用、生成内容传播路径以及对关键业务系统的潜在冲击,实现全流程闭环管理。
健全多层次、协同化的安全监测网络。推动人工智能企业与应用主体建立与其模型能力、服务规模及风险等级相匹配的内部监测机制,确保能够及时发现并上报重大模型缺陷与异常运行状况。充分发挥专业测评机构、科研院所及行业组织的职能作用,逐步构建起企业自主监测、第三方独立测评、行业专业监测与政府综合监测相互支撑、协同联动的工作格局,形成监管合力。
加强人工智能安全监测能力建设。依托现有网络安全、数据安全及算法治理的制度基础与技术积淀,全面提升对人工智能产品漏洞、模型运行异常及安全事件的监测预警能力。严格落实人工智能生成内容标识、算法备案变更管理及日志留存等制度要求,增强风险源头追溯及传播过程的可审计性。在切实保障国家秘密、商业秘密和个人信息安全的前提下,积极探索政府部门、模型企业、应用单位及专业机构间必要的风险信息通报与共享机制,为风险研判、预警处置及精准治理提供坚实支撑。
强化风险预警体系,
提升重大安全风险研判与处置效能
人工智能系统运行数据规模庞大、异常形态复杂,若缺乏科学的研判机制与分级预警,既可能因预警滞后而错失处置窗口,亦可能因预警泛化而干扰正常的研发与应用进程。因此,需加快构建指标明确、分级科学、机制健全、流转顺畅的人工智能重大安全风险预警体系。
构建人工智能重大安全风险预警指标体系与分级标准。应综合考量模型能力、应用场景、影响范围、扩散速率及损害后果等多维因素,科学设定预警指标。推动定性判断与定量指标的深度融合,将复杂的技术风险转化为可识别、可比对、可追踪的预警信号。依据风险发生概率、影响广度、损害程度及可控性,合理划分预警等级并明确启动条件。同时,建立预警等级的动态调整机制,根据模型迭代、应用规模扩张及风险形态演变适时修正阈值,防止因技术发展导致原有标准失效。
完善多部门、多主体协同的风险研判与信息发布机制。人工智能重大安全风险往往涉及网络安全、数据安全、公共安全及行业安全等多个领域,单一主体难以独立准确评估其整体影响。应建立由行业主管部门、人工智能企业、应用单位及专业机构共同参与的会商研判机制,通过整合技术监测数据、行业运行信息、用户反馈及第三方评测结果,对异常信号进行交叉验证。此外,需依据风险的专业属性、敏感程度及影响范围,明确预警信息的发布主体、报送流程、传递对象及公开方式,确保信息传递的规范性与时效性。
实现风险预警与防控措施、应急响应的无缝联动。依据预警等级,预先制定包括加强监测、限制高风险功能、缩减服务范围、暂停模型接口、收回智能体权限及启动人工接管等差异化处置措施。对于风险等级持续攀升、常规手段难以控制或可能引发重大公共安全事件的情形,应及时由风险预警状态转入应急响应状态。在风险解除后,组织开展事后评估,动态调整预警等级或终止预警,并将处置过程中发现的新风险、新情景及新指标纳入预警体系,形成风险识别、预警研判、响应处置与复盘改进的闭环管理。
构建应急响应体系,
提升重大安全事件协同处置能力
应急响应是防范人工智能重大安全风险转化为现实损害、遏制风险扩散及降低事故后果的关键防线,人工智能安全事件相较于传统网络安全事件,呈现出技术机理复杂、演化速率极快、影响辐射面广以及责任主体多元等显著特征,必须统筹常态监管与应急处突,既要依托日常监管机制及时清除风险隐患,更要针对可能引发重大公共安全危机的异常情形,构建起统一协调、分级负责、快速反应且协同高效的应急响应体系,提升风险防控的系统性。
完善人工智能安全事件的分类标准与应急预案体系。研究制定科学严谨的人工智能安全事件认定标准,精准界定模型运行故障、数据安全泄露、算法失控、智能体越权操作、生成内容恶意传播以及人工智能赋能网络攻击等差异化类型。面向大模型安全护栏失效、智能体异常自主行动、关键行业系统运行中断、大规模深度伪造信息传播等典型高危场景,制定专项应急预案,细化从发现报告、研判决策、响应启动、现场处置到信息发布及响应终止的全流程环节,切实增强预案的针对性、实操性与闭环管理能力。
健全跨部门、跨行业的应急指挥协调机制。依据事件性质及其影响领域,明确牵头部门、协同部门、属地政府及涉事企业的职责边界,构建统一指挥、专业支撑、行业协同与属地配合的高效响应机制。完善重大安全事件快速报告与信息共享制度,督促模型研发企业、应用单位及关键基础设施运营主体及时报送事件性质、影响范围、处置进展及风险演变态势。在应对跨行业、跨区域重大突发事件时,应及时组织联合会商,统一风险研判与处置行动步调,避免因信息碎片化或指令冲突而贻误最佳处置时机。
完善与风险等级相匹配的分级应急处置措施。基于事件类型、风险程度及影响范围的动态评估,分类实施风险告知、强化监测、功能限制、权限降级、接口暂停、系统隔离、人工接管及服务终止等差异化措施。实施紧急干预措施应严格遵循必要性与适度性原则,在有效阻断风险扩散路径的同时,最大限度减少对正常研发创新、应用推广及生产经营活动的负面冲击,实现安全管控与发展活力的动态平衡。
(来源:学习时报)
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:中国信息安全 刘密霞
刘密霞《观点 | 健全人工智能重大安全风险防控体系》