logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

LLM 越狱技术分类 + AI 红队(Garak/PyRIT) + Prompt Injection 防御体系详解 | 大模型安全面试

本文系统梳理。一条贯穿全文的主线:LLM 的安全对齐是「统计倾向」而非硬性规则,攻击面在语义空间而非代码空间——这也是它和 SQL 注入「像」但又「治不彻底」的根本原因。文章按组织,附可运行的检测/防御代码、Garak/PyRIT 命令与示例。适合:准备大模型安全 / AI 安全 / 红队岗面试,或需要落地 LLM 应用安全防护的同学。

#人工智能#web安全#面试
到底了