
简介
该用户还未填写简介
擅长的技术栈
未填写擅长的技术栈
可提供的服务
暂无可提供的服务
LLM 越狱技术分类 + AI 红队(Garak/PyRIT) + Prompt Injection 防御体系详解 | 大模型安全面试
本文系统梳理。一条贯穿全文的主线:LLM 的安全对齐是「统计倾向」而非硬性规则,攻击面在语义空间而非代码空间——这也是它和 SQL 注入「像」但又「治不彻底」的根本原因。文章按组织,附可运行的检测/防御代码、Garak/PyRIT 命令与示例。适合:准备大模型安全 / AI 安全 / 红队岗面试,或需要落地 LLM 应用安全防护的同学。
到底了







