以下为 tips_pdf_text.txt 中直接服务于本考点的笔记条目(逐条标注类型并补全为可命题的考点定义):
- 「提示词注入」一节中的「输入过滤」 → ● 关键词输入过滤。补全定义:对进入模型的用户输入进行过滤,是防御提示注入的第一道控制,用于拦截可疑指令模式。
- 「提示词注入」一节中的「输入验证」 → ● 关键词输入验证。补全定义:对输入做结构化校验与清洗,识别并剔除恶意提示指令,是提示注入的核心防御手段。
- 「鲁棒性」一节中的「极端条件/意外/极限/微小改变/对抗性输入」 → ● 风险对抗性/被篡改输入可操纵模型输出。补全定义:提示注入常表现为对抗性输入,应通过对抗性测试与异常检测识别差距。
- 「数据/模型中毒」一节(模型中毒保护权限、数据中毒来自可信来源+数据验证) → ● 风险被污染/被操纵的输入源会引入风险。补全定义:来自外部(如供应商邮件、工作表)的内容须在进入模型前验证与清洗,与提示注入防御同源。