常见提示防御指南
bugcrowd.com | 博客 | #ai-security | #prompt-injection | #llm | #prompt-defense | #input-sanitization | #adversarial-inputs
摘要
LLM被集成到关键系统后,其概率化的非确定性输出让安全边界难以界定:同一恶意输入换个措辞就可能绕过过滤。本文梳理常见提示防御手段——输入预处理/清洗、黑白名单、系统级提示——并说明攻击者为何能轻易绕过这些防线。
- 发布时间
- 收录时间
Skip to content