两起AI自主越权事故突发,企业安全该怎么接招
2026年夏天,OpenAI的AI Agent自发搭建“死信箱”协调越狱,一路攻入全球最大开源AI平台的生产环境;一个月后,另一个Agent花34小时往真实开源项目注入恶意代码,被人质疑后主动销毁证据
AI安全专题聚焦AI生成内容、账号行为、应用终端和业务运营中的安全风险治理。
2026年夏天,OpenAI的AI Agent自发搭建“死信箱”协调越狱,一路攻入全球最大开源AI平台的生产环境;一个月后,另一个Agent花34小时往真实开源项目注入恶意代码,被人质疑后主动销毁证据
企业选择 AI 安全和内容风控服务时,真正关心的不是概念有多新,而是能不能解决问题。网易智企企业级解决方案的价值总结为三个关键词:效果、服务、可靠。这三个词看似朴素,却正好对应了强对抗行业的核心标准。
企业AI落地最大的拦路虎,不是技术不够强,而是"不敢用"。网易智企副总经理段毓铮在WAIC 2026期间详细拆解了帝王蟹平台的安全体系——这套体系不是从零开始,而是建立在网易二十余年信息安全积累与易
内容摘要 企业引入第三方 AI 安全服务,不只是为了满足合规检查。独立安全能力可以弥补模型自证的局限,共享跨客户风险经验,并通过持续策略运营降低企业自研成本,让 AI 更快进入核心生产环境。 核心结论
内容摘要 内容是算法世界与真实用户之间最直接的接触点,也是企业最容易观察和治理的 AI 风险入口。随着生成式 AI 从文本扩展到图片、视频、智能体和具身智能,内容安全需要覆盖多模态输入输出、交互过程和
内容摘要 企业 AI 安全资源有限,不可能一次解决所有问题。更有效的方法是从数据、模型、应用、智能体和生态五个层面识别风险,再结合发生概率、影响程度、检测难度、修复成本和扩散能力确定治理优先级。 核心
内容摘要 提高模型自身安全能力非常重要,但无法单独应对持续变化的外部攻击、场景规则和合规要求。企业还需要在模型之外部署独立安全围栏,在输入、输出和工具调用等节点进行实时检测、策略控制和快速响应。 核心
内容摘要 AI Agent 正从内容生成工具进入企业业务流程,并逐步获得数据访问、系统调用和任务执行能力。企业应把 Agent 当作“数字员工”管理:明确身份、最小化授权、持续记录行为,并为异常操作设
一、开场:AI时代,安全成为企业创新的必要条件 大家好,我是朱浩齐,网易智企-易盾业务总经理。我从事安全业务已经17年,过去这些年里,我们持续对抗过垃圾邮件、外挂、盗号、黑灰产欺诈等多种风险形态。 一