
简介
该用户还未填写简介
擅长的技术栈
可提供的服务
暂无可提供的服务
近日,沙丘智库正式对外发布《2025年中国 “大模型+安全” 主流厂商全景图》,网易易盾凭借在大模型安全领域的全栈布局与卓越实践,成功入选三大核心领域主流厂商。今年9月的网络安全宣传周上,监管部门与各企业代表着重讨论人工智能发展及安全,并更新发布了《人工智能安全治理框架》2.0 版,为规范人工智能发展,推动网络生态健康与技术良性进步安全发展指明了新方向。同期,多部门联合发布的《人工智能生成合成内容

过去两年,大模型技术的发展速度远超预期。从最初的能力展示与试点应用,到如今在智能客服、内容生成、知识问答、业务辅助等场景中的持续落地,大模型正在从“前沿技术”转变为企业数字化体系中的重要基础能力。越来越多的业务开始直接依赖模型输出,其影响范围也从局部实验扩展到核心流程。与此同时,大模型的使用环境也在发生变化。一方面,模型交互逐渐从单一文本走向图像、语音等多模态形态,应用链路更加复杂;

近日,由云计算与大数据研究所组织开展的结果正式公布。网易易盾联合国家网络安全人才与创新基地(简称国家网安基地)开展的成功入选,成为政务大模型安全治理方向的典型实践案例之一。作为国家网络安全战略布局中的重要组成部分,国家网安基地是中央网络安全和信息化委员会办公室指导下推进建设的重要国家级平台。基地聚焦网络安全关键技术攻关、高端人才培养与产业协同创新,致力于推动前沿技术成果在真实场景中的验证与落地应用

报告认为,新一代内容风控能力需要覆盖准确性、时效性、稳定性、可解释性、成本可控、多模态融合、深度伪造识别、AIGC识别与溯源、动态对抗与自适应进化等多个维度。未来,易盾将持续围绕AI内容安全、AI业务安全、CMA治理智能体、大模型安全围栏、Agent安全等方向,帮助企业构建面向AI时代的全链路安全防护体系。,覆盖大模型合规备案、内容安全检测、输入输出安全、提示词攻击防护、黑产识别、大模型安全测评、

内生安全从训练数据、模型能力和安全对齐入手,降低风险进入模型并被模型学习的可能;即使经过训练数据治理和模型安全对齐,大模型进入开放业务环境后,仍会面对不可预知的用户输入和复杂上下文,因此还需要一套独立、实时且可配置的外部安全围栏。内生安全的核心,不是简单为模型设置“禁止回答”的规则,而是将安全能力融入数据治理、模型评测和能力构建过程,让模型自身具备更加稳定的风险判断能力。攻击者可能通过提示词注入、

2026年7月15日起,《人工智能拟人化互动服务管理暂行办法》正式施行,AI陪伴、虚拟伴侣、情感互动类智能体等产品,自此有了首部专门针对AI拟人化互动服务的部门规章作为监管依据。对相关企业来说,合规并不是"做完一项备案"就结束:算法备案、大模型备案(生成式AI备案)与拟人化互动服务安全评估,构成三层叠加的合规架构,缺一不可。这篇文章讲清楚三者的定义、区别与关系。

作为长期深耕内容安全、业务安全、数据安全与人工智能安全的技术服务商,易盾持续服务互联网、金融、政企、传媒、电商、游戏等多个行业,在复杂业务场景和高强度安全对抗中积累了成熟的技术能力与实践经验。面对大模型带来的安全治理新命题,易盾将多年内容风控、攻防对抗、风险识别与策略运营能力延伸至 AI 安全领域,围绕大模型生成内容安全、指令攻击防护、模型输出合规、敏感信息保护、应用安全评测等方向持续完善产品体系

2026 年,AI 已经不再只是写文案、做总结、生成图片的效率工具。它正在进入客服、投研、教育、办公、内容生产、代码开发、智能终端、业务运营等真实场景,开始读取企业知识库、调用 API、操作工具、生成代码、触发流程,甚至以 Agent 形态自主拆解任务、连续执行动作。换句话说,AI 正从“会回答问题的工具”,变成“能连接业务系统的数字操作者”。但问题也随之而来:当一个 AI 不只会“说错话”,还可

今年7月,某电商平台针对「AI批量套图」开展专项治理。来源:IT之家报道平台发现,部分商家以同一张底图为基础,批量生成高度雷同的商品图片,造成商品展示失真,并引发消费者投诉。根据报道,平台会根据问题严重程度采取扣分、在搜索和推荐场域降权或屏蔽等措施。这件事并不难理解。

今年7月,某电商平台针对「AI批量套图」开展专项治理。来源:IT之家报道平台发现,部分商家以同一张底图为基础,批量生成高度雷同的商品图片,造成商品展示失真,并引发消费者投诉。根据报道,平台会根据问题严重程度采取扣分、在搜索和推荐场域降权或屏蔽等措施。这件事并不难理解。









