💡 近日,国金认证公布金融业人工智能安全工具首批征集名单。“网易智企-易盾大模型安全评测” 入选 AI安全测试类,“网易智企-易盾大模型安全围栏” 入选 AI安全防护类,覆盖大模型应用上线前安全评估与运行中实时防护两大关键环节。
此次入选,体现了网易智企在人工智能安全治理、大模型风险评测、内容安全防护、模型安全防护等方向的技术积累与场景落地能力,也标志着网易智企-易盾面向金融行业 AI 安全建设的综合能力获得权威认可。
STRATEGY
战略引领,金融 AI 安全进入体系化建设新阶段
当前,人工智能正加速融入金融服务、风险控制、运营管理、客户交互、智能办公等核心场景,成为推动金融数字化转型和服务效率提升的重要力量。与此同时,大模型幻觉、提示词攻击、越权访问、敏感信息泄露、违规内容生成、模型滥用等新型风险也随之显现,对金融机构的安全治理、合规管理和风险防控能力提出更高要求。
国家“十五五”规划明确提出,推动建立人工智能全生命周期风险管理制度,健全覆盖安全监测、风险预警、应急响应的风险防控体系。《关于“人工智能+金融”的实施意见》也提出,要强化应急处置和风险防控,筑牢“人工智能+金融”安全屏障。
在政策、监管与产业需求共同推动下,人工智能安全已从技术选项升级为金融行业智能化发展的基础工程。构建可信、可控、可审计的大模型安全体系,正在成为金融机构推进 AI 应用落地的前置条件和长期能力。
RECOGNITION
双项入选,覆盖大模型安全评测与防护关键链路
此次网易智企-易盾入选的两项能力,分别面向 AI 应用落地前的安全测试与上线后的持续防护,形成覆盖“评测、识别、防护、处置、优化”的大模型安全治理闭环。
其中,网易智企-易盾大模型安全评测面向大模型应用上线前、迭代中及运营期的风险识别需求,围绕内容安全、指令安全等重点能力域,对模型输出、交互链路和业务场景进行系统化评估,帮助金融机构提前发现潜在安全隐患,提升 AI 应用的可控性、可靠性与合规性。
网易智企-易盾大模型安全围栏则面向大模型应用运行过程中的实时防护需求,覆盖内容安全防护、模型安全防护等场景,提供风险识别、策略拦截、动态处置与持续优化能力,帮助金融机构有效应对提示注入、敏感信息泄露、违规内容生成、恶意诱导等风险,为大模型应用构筑安全边界。
通过“评测+防护”双轮驱动,易盾能够助力金融机构在大模型应用建设过程中实现事前风险识别、事中动态防护、事后审计优化,支撑 AI 应用从“可用”走向“可信”。
THE END
深耕安全,打造可信 AI 时代的安全基础设施
作为长期深耕内容安全、业务安全、数据安全与人工智能安全的技术服务商,易盾持续服务互联网、金融、政企、传媒、电商、游戏等多个行业,在复杂业务场景和高强度安全对抗中积累了成熟的技术能力与实践经验。
面对大模型带来的安全治理新命题,易盾将多年内容风控、攻防对抗、风险识别与策略运营能力延伸至 AI 安全领域,围绕大模型生成内容安全、指令攻击防护、模型输出合规、敏感信息保护、应用安全评测等方向持续完善产品体系,助力行业构建面向人工智能时代的安全底座。
此次入选金融业人工智能安全工具首批征集名单,不仅是对易盾 AI 安全技术能力的认可,也体现了其在金融 AI 安全治理场景中的实践价值。
未来,易盾将继续围绕人工智能全生命周期风险管理,深化大模型安全评测、安全防护与合规治理能力建设,助力金融机构在安全、可信、可控的基础上释放人工智能创新价值,为“人工智能+金融”高质量发展筑牢安全屏障。
活动推荐
作为网易旗下一站式企业 AI 应用服务提供商,网易智企倾力打造企业 AI 实战栏目——「AI 实战派」,聚焦 AI 在真实业务中的落地应用,通过实战教学、案例拆解、研讨交流等多元形式,将前沿的 AI 技术转化为真实的业务动能,为企业管理者、业务决策者和一线实践者提供可迁移、可复用的实战方法论与深度洞察。
关于我们
IM即时通讯
实时对话智能体
智能硬件开发套件
音视频通话
短信
信令
直播
点播
互动白板
七鱼AI客服
客服类Agent
在线客服
科学策略中心
智能外呼
营销类Agent
问卷调研
文本检测
图片检测
音频检测
视频检测
智能审核平台
风控引擎
行为式验证码
实名核验
人脸核验
隐私合规检测
网易知数
有数BI
大数据基础平台
数据开发治理平台
指标平台
数据中台
研发智能化
智能页面生成
平台私有化定制
企业级RAG知识库
自主智能体
智能协作中枢
AI应用搭建
游戏行业
全生命周期解决方案
游戏安全解决方案
游戏AI智能体
娱乐社交
多人语音聊天室
游戏语音
娱乐社交出海
社交场景反欺诈
内容安全合规
大型直播活动
AI应用
AI应用开发
医疗行业
区域医疗
智慧医院
药店运营
教育行业
在线教育
绿色清朗课堂
课后服务
金融行业
泛金融
全链路数据风控
运营增长
存量用户促活
营销留资转化
企微客服
企微导流

