破解人类 vs 破解 LLM
josephthacker.com | 博客 | #ai-security | #cloud | #social-engineering | #jailbreak | #llm | #prompt-engineering | #context-window
摘要
作者认为对 LLM 的越狱(jailbreak)本质上与对人类的社会工程攻击相似:两者都只聚焦最近的输入而缺乏全局上下文。他预测当模型获得接近无限的上下文窗口、能理解整个系统背景时,越狱攻击将变得困难得多。
- 发布时间
- 收录时间
Skip to content