文章总结: 长三角安全人工智能安徽省实验室在CCSC2026大会上发布三大AI安全治理方案,覆盖大模型内容安全、智能体应用安全与AIGC内容可信传播,构建全链路防护体系。方案已落地25个私有化项目,云端日调用量破亿次,并获多项权威认证,为AI安全治理提供了可操作的实践范本。
综合评分: 78
文章分类: AI安全,解决方案,产品介绍,安全建设
长三角安全人工智能安徽省实验室发布三大治理方案,AI安全迎来新解法
中国信息安全
2026年9月21日 19:03
北京
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
近日,以“智启新程、安领未来”为主题的第一届中国网络空间安全大会(CCSC 2026)在安徽合肥召开,大会邀约8位院士进行主旨报告,并举办了40场高水平专题论坛,汇集200余位知名专家分享前沿科技进展。
9月19日,大会人工智能安全与应用治理专题论坛正式举办,作为专题论坛承办方之一的长三角安全人工智能安徽省实验室在现场发布了三大AI安全解决方案,覆盖大模型内容安全、智能体应用安全与AIGC生成内容传播可信;实验室主任刘俊华发表《AI安全治理技术进展与应用实践》主题演讲,分享了实验室在AI安全领域的最新技术进展和产业实践。
长三角安全人工智能实验室是由安徽省人民政府批准,依托安徽星盾智能科技有限公司建设的高能级科创平台,致力于构建人工智能安全治理和防护能力,积极探索有效风险防护和治理路径,护航人工智能技术和产业发展,目前实验室已收获了多项AI安全领域的权威奖项、认证和评测竞赛冠军。三大AI安全产品的集体亮相为业界带来了可信、可行的现成解决方案,展示出中国AI安全技术的最新实力和成果,以及为AI产业护航的坚定决心。
AI安全风险从何而来?
AI技术的发展已进入白热化阶段,新算法、新模型、新能力不断涌现,AI技术的持续突破也使得应用落地的场景和方式也在呈现跨越式增长。
但AI的持续发展和广泛应用,也让AI安全问题愈发严峻。近日,中央网信办总结了当前AI面临的五大安全风险挑战:一是技术先天脆弱性难以根除,影响输出稳定性与可靠性;二是模型能力跃迁颠覆传统安全范式,极端失控风险显现;三是应用形态快速演进,安全风险形态加速迭代;四是误用滥用恶用风险凸显,冲击社会秩序与伦理边界;五是全球AI领域面临技术霸权风险。
由于神经网络的不可解释和概率建模的脆弱性,以及训练数据分布偏差导致污染和完整性的覆盖,更加之智能体盛行后本身链式传导、权限扩散使得自主规划具备不可预测性,重重根因导致了各类安全风险频发。目前,AI安全治理正直面数据和供应链、模型内生安全、智能体安全、应用分类分级、滥用域可信等挑战。
三大方案构建AI安全治理全链路能力
在人工智能安全与应用治理专题论坛现场,中国工程院院士吴世忠,科大讯飞联合创始人、技术委员会主任胡国平,中国科学技术大学教授、长三角安全人工智能安徽省实验室首席科学家俞能海,长三角安全人工智能安徽省实验室主任刘俊华现场发布三大AI安全方案。方案凝聚了技术成果和产业实践经验,面向大模型、智能体和AIGC构建起完善的AI安全治理和防护产品体系。
三大AI安全方案分别为大模型内容安全治理解决方案“星界”、智能体应用安全解决方案“星驭”、AIGC内容可信传播治理方案“星鉴”。
大模型内容安全治理解决方案——星界
星界面向大模型全生命周期,提供覆盖数据构建、模型训练、应用上线与持续运营的一体化内容安全治理能力。该大模型内容安全治理解决方案从源头通过训练数据清洗、安全价值对齐与模型安全增强,降低内生风险;在应用运行中通过内容安全护栏,实时识别与处置提示词攻击、违法违规内容等风险;持续运营中通过风险监测与人工研判发现问题、快速干预与闭环优化。同时安全评测会贯穿全过程,持续验证和驱动安全能力提升。
星界实现了内生安全与外层防护协同,同时还基于“以模治模”理念进行多级协同防护。值得一提的是,面向不同行业、用户和业务需求,星界可实施分级分类方案,如在教育场景构建未成年人专项防护模型,进行分龄分级精细化管控。星界还支持自动化评测,评测效率提升85%以上。
星界可应用于教育、医疗、汽车等行业大模型中,支持开源与闭源模型,兼容云端及私有化部署,满足差异化内容安全治理需求。
智能体应用安全解决方案——星驭
星驭面向各类智能体应用,构建覆盖全生命周期的攻防一体化安全治理方案。该方案以身份与权限管理为底座,为智能体分配独立可信身份、“持证上岗”,明确智能体执行主体、授权关系与操作边界。在智能体上线前,星驭通过Skill安全检测扫描识别供应链风险,并在安全靶场中通过自动化红队测试验证真实执行风险,红队测试具备动态演进、可复现复核的特点。运行中覆盖“输入—规划—执行”全过程,创新采用状态追踪与风险判别双模型协同架构,对提示词注入、工具滥用、越权操作、敏感信息泄露及任务失控等风险进行监测与分级处置。事后,通过日志回放与全链路审计支撑复盘溯源,保障智能体安全运行并兼顾业务可用性。
在智能体快速发展的当下,星驭可应用于智能办公、金融及政务等智能体应用场景,围绕数据防泄漏、权限管控、工具调用与行为审计提供安全保障;同时支持Skill市场准入审核、企业Skill仓库治理及开发阶段安全自检。
AIGC内容可信传播治理方案——星鉴
星鉴面向AIGC内容传播与治理,构建覆盖文本、图像、音频、视频四大模态的一体化可信传播治理方案。
星鉴为AI内容嵌入可验证的隐式数字身份,并提高了内容经过编辑和传播后的水印可检测性和信息提取稳定性,支撑来源验证与传播溯源。同时,针对来源不明的内容,星鉴结合AI生成检测与有害内容识别,采用“跨模态统一检测+多维证据互证”技术,融合生成痕迹、模型指纹、篡改特征及一致性分析,综合判断内容是否由AI生成、是否存在深度伪造风险,贯通内容标识、检测核验与来源追溯,提升内容传播的可信度与可追溯性。
对于AIGC创作、内容平台、新闻媒体及社交传播等场景来说,星鉴可有效支撑AI内容标识、生成与深度伪造检测、有害内容识别及来源追溯,为版权保护与来源核验提供技术依据。
面对层出不穷的大模型、智能体和AIGC相关应用和产品,此次发布的三大解决方案直击当前AI安全发展的关键挑战与核心难点,完整覆盖了可能出现的AI风险环节,牢筑AI安全防线,为业界提供了新解决范本。
已关注
关注
重播 分享 赞
关闭
观看更多
更多
退出全屏
切换到竖屏全屏退出全屏
中国信息安全已关注
分享视频
,时长03:36
0/0
00:00/03:36
切换到横屏模式
继续播放
[ ]
进度条,百分之0
播放
00:00
/
03:36
03:36
倍速
全屏
倍速播放中
0.5倍0.75倍1.0倍1.5倍2.0倍
超清流畅
继续观看
长三角安全人工智能安徽省实验室发布三大治理方案,AI安全迎来新解法
观看更多
转载
,
长三角安全人工智能安徽省实验室发布三大治理方案,AI安全迎来新解法
中国信息安全已关注
分享点赞在看
已同步到看一看写下你的评论
视频详情
以实力护航AI安全发展
据了解,长三角安全人工智能安徽省实验室此次发布的三大AI安全解决方案已在应用实践中多次锤炼,取得了实打实的成绩:2023年以来持续为讯飞星火大模型升级防护方案、进行行业策略制定,实现了“分级分类”的安全防护,大模型安全防护平台支持多个开源大模型和央国企行业大模型的接入,当前已落地25个私有化项目,云端每日调用次数突破数亿次;推动智能体Skill扫描上线相关产品平台、护航业务安全;积极推进隐式水印和AIGC生成检测,承建了工信部首个AIGC生成检测处置平台。
这背后,也离不开AI安全核心技术领域的硬实力提升。近两年来,该实验室在国内外十余项权威顶级相关赛事中获得冠军,在首届“AI领航杯”全国“人工智能+”应用与技能大赛中凭借“以模治模”的创新技术,荣获“AI+安全”赛道一等奖及全国总决赛“技术创新奖”,基于研发成果的相关产品不仅首批通过中国信通院“云上大模型内容安全防护产品能力评估”,还成为首批获得《人工智能安全国家标准符合性自评估证书》的单位之一。
面向未来,AI安全风险还将动态演进。从内生安全、智能体安全、网络安全,进一步延展到具身智能安全、CBRN(化学、生物、放射性、核)、AI自主性等更多领域和场景。刘俊华在分论坛演讲中表示,长三角安全实验室愿与各方开源开放、协同创新,真正助力AI安全治理生态构建,为AI产业发展更好护航。
业务与产品咨询可联系:
电话:15955167126
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:中国信息安全 《长三角安全人工智能安徽省实验室发布三大治理方案,AI安全迎来新解法》