提示与内容层攻击¶ 覆盖 Prompt Injection、Jailbreak、系统提示泄漏的技术分类,以及模型输出侧的处理规范与密钥外泄防护。架构级防御模式(Dual LLM、权限最小化、执行隔离)见 Agent 安全,本模块聚焦分类学与输出侧的补充内容,不重复展开。 章节¶ 第二章:Prompt Injection、Jailbreak 与系统提示泄漏 第三章:输出处理与 Secret Exfiltration 返回 AI 安全与治理。