非影资讯
面向安全从业者的中英双语安全研究与漏洞情报精选。

Balancing Security and Usability of Large Language Models: An LLM Benchmarking Framework

摘要

NetSPI 发布开放式 LLM 安全基准测试框架,通过对抗性测试评估各大语言模型抵御越狱攻击的能力,并量化安全强度与可用性之间的权衡,帮助企业在部署生成式 AI 时找到平衡点。
发布时间
收录时间

原文 ↗