文章总结: 文档聚焦金融智能体安全边界重构,指出AI从内容风险升级为行为风险,监管政策如GB/T45654-2025与8号文推动合规建设。网易智企与华为联合发布解决方案,提供大模型安全围栏与Agent安全治理体系,覆盖设计态、运行态、管理态,助力金融机构规模化落地AI。建议机构对照32项要求构建安全架构,选择具备内容安全积累的治理伙伴。
综合评分: 82
文章分类: 安全建设,解决方案,应用安全,安全运营,其他
当AI不只”说错话”,还会”做错事”|金融智能体安全边界重构
原创
网易智企-易盾
网易智企-易盾
网易智企-易盾
2026年9月22日 18:00
浙江
在小说阅读器读本章
去阅读
在公众号小说中沉浸阅读
智能客服说了不该说的话,可以删掉、道歉、优化语料——过去的AI风险,事后还能补救。
现在不同了。
当AI拥有增删改查的能力,能调接口、查账户、执行交易,一次错误的输出不再只是舆情问题,而可能是一笔真实的业务损失,或者一条无法回退的合规红线。
这就是”说错话”和”做错事”之间的本质差距,也是今天金融AI安全建设面临的核心命题。
上周,华为全联接大会2026·金融AI安全专场在上海举行,作为华为“全球金融伙伴融海计划”成员,网易智企连续两日参与:
9月16日,行业解决方案总监曹刚在”金融AI安全与治理圆桌会议”带来主题分享《从”说错话”到”做错事”:智能体时代的安全边界重构》;
9月17日,网易智企与华为数字金融军团联合解决方案正式发布,双方将共建金融AI安全生态,推动金融AI从试点走向规模化落地。
规模化生成式AI的挑战
今年自主智能体架构兴起后,各行各业的AI应用开始井喷。但从试点到规模化之间,隔着一条沟。
谷歌与云安全联盟(CSA)联合发布的调研报告调研了大量企业CIO,问了他们同一个问题:推进规模化生成式AI,最大的挑战是什么?
合计 79%的技术领导者将AI的安全、治理与运营(MLOps)列为规模化最显著的阻碍。
让金融机构慢下来的,不是模型不够聪明,而是”不敢放手”——没有合规底座,规模化就是在裸奔。
金融机构的AI建设,从来不是自由发挥。两个明确的监管政策,正在重新定义”安全建设”的优先级。
1
GB/T 45654-2025
2025年11月1日,GB/T 45654-2025《网络安全技术生成式人工智能服务安全基本要求》正式执行。
从这一天起,大模型安全建设从”可选项”变成”必答题”。中国金融领域,率先采购大模型安全围栏的是中国工商银行,此后立项、招标、POC在各家机构陆续展开。
2
8号文
2026年6月18日,国家金融监督管理总局发布”8号文”——《关于银行业保险业人工智能安全开发应用的指导意见》。
4大原则、7大维度,共计32项具体工作要求,文件出台后,行业随即迎来金融AI招投标最为集中的窗口期。
两个政策叠加的结果:中国六大行、12家股份制银行及万亿城商行中,50%的机构已经有了明确的立项、招投标、POC或正式上线行动。
曹刚在圆桌分享中提出一个值得关注的观点:
“8号文写得非常高质量。金融AI的边界,监管已经替行业写清楚了——企业要做的不是猜测,而是对照32项要求,构建自己的AI架构。”
8号文的六条硬约束,也是金融AI架构的设计前提:
还有一个细节值得关注:网易智企是GB/T 45654-2025国家标准的核心参编单位之一,参与了标准从起草到执行的全程。
网易智企三板斧
1
网易智企 AgentOS
当AI从单点问答走向多工具调用、多系统协同,谁来管控身份、权限、执行和审计?
网易智企 AgentOS 的架构逻辑可以参考,让 AI 像资深业务专家一样思考与执行。
整个架构覆盖设计态、运行态、管理态:统一编排,统一管控,统一治理。
2
网易智企·易盾 Agent 安全治理体系
解决Agent安全的前提:让资产先看得见。
网易智企·易盾的思路是像做数据治理一样做Agent治理,通过四层能力构成完整治理闭环:
配套7×24舆情监控,重点舆情10分钟级获取,T+0落实监管要求——政策一变,围栏策略随之联动更新。
3
大模型安全围栏一站式服务
对已有面向互联网应用(手机银行、智能客服)的机构,安全围栏是合规的起点。训练期与运营期,每一次模型输入与输出都经过实时检测,覆盖涉黄、涉恐、涉暴、违反社会主义核心价值观等类型的判别、阻断与安全代答。
落地能力与合规能力,一次配齐
9月17日,华为数字金融军团与网易智企联合打造的解决方案正式发布,这也成为推动金融 AI 规模化落地的关键举措。
金融生产级智能体走向规模化,需要两条腿:
一条:让AI真正能干活的生产级平台 → 华为金融启元AgenticAI解决方案,其底层平台openJiuwen聚焦AI Agent通用能力,致力于构建易用、灵活且稳定的开源智能体框架,目前已覆盖金融、制造、政务等10余个行业。
另一条:让机构敢于放手的安全合规体系 → 网易智企,以大模型安全围栏 + Agent安全治理,为每一次输入输出、每一步执行兜底。
目前,两套能力已完成集成验证,并在客户侧完成首例交付。大会现场同步提供实时Demo,可直观体验融合后的完整效果。
对正在对照8号文搭建AI架构的机构,这套联合方案意味着:落地能力与合规能力,可以在同一个架构里一次配齐。
如何选择AI安全治理伙伴?
传统网络安全厂商正在密集入局大模型安全领域——但内容安全的核心判别能力,不是短期能补上的。
判断标准之一就是,看它是否服务基础大模型厂商。
大模型厂商代表着最高并发、最大用户量、最高频次的检验场景——Kimi、MiniMax、阶跃星辰、生数科技等国内头部大模型厂商背后,都有网易智企·易盾的技术支撑。
网易从1997年起积累内容安全能力,几十年、万亿级数据的判别沉淀,构成了网易智企·易盾安全围栏的核心壁垒。
中国工商银行、中国邮储银行、华泰证券、平安证券、易方达基金等头部机构和美团、知乎、小米、小天才等互联网企业,都是网易智企·易盾的深度客户。这些企业的共性是:用户量大、内容高频、容错率极低,是行业里对安全能力要求最严苛的一批。他们选择网易智企·易盾,则是各自经过验证后的结果。
从”说错话”到”做错事”,AI的能力边界在扩展;安全,也要从防内容走向管行为。
治理成熟的机构,正在更有信心地加速AI落地;缺乏安全底座的机构,正在慢慢掉队。
活动推荐
作为网易旗下一站式企业 AI 应用服务提供商,网易智企倾力打造企业 AI 实战栏目——「AI 实战派」,聚焦 AI 在真实业务中的落地应用,通过实战教学、案例拆解、研讨交流等多元形式,将前沿的 AI 技术转化为真实的业务动能,为企业管理者、业务决策者和一线实践者提供可迁移、可复用的实战方法论与深度洞察。
关于我们
免费下载干货资料
免责声明:
本文所载程序、技术方法仅面向合法合规的安全研究与教学场景,旨在提升网络安全防护能力,具有明确的技术研究属性。
任何单位或个人未经授权,将本文内容用于攻击、破坏等非法用途的,由此引发的全部法律责任、民事赔偿及连带责任,均由行为人独立承担,本站不承担任何连带责任。
本站内容均为技术交流与知识分享目的发布,若存在版权侵权或其他异议,请通过邮件联系处理,具体联系方式可点击页面上方的联系我。
本文转载自:网易智企-易盾 网易智企-易盾
网易智企-易盾《当AI不只”说错话”,还会”做错事”|金融智能体安全边界重构》