非影资讯
面向安全从业者的中英双语安全研究与漏洞情报精选。

Anthropic扩展其模型安全漏洞赏金计划

摘要

Anthropic 扩展其托管于 HackerOne 的模型安全赏金计划,针对可普遍绕过 AI 安全护栏的 universal jailbreak 攻击提供最高 15,000 美元奖励,重点覆盖 CBRN 与网络安全等高风险领域。
发布时间
收录时间

原文 ↗

相关内容

返回