1. CyberKimi 基准:CVE-2024-6100 的自主利用轨迹 github.com | 研究 | 2026-08-09 15:35 | 原文 ↗ | #ai-security | #rce | #benchmark | #github 开源基准与原始审计证据:展示 CyberKimi 在 CVE-2024-6100 等目标上的自主漏洞利用能力。 为什么值得关注: 首次以全链路可审计的交互轨迹和评分证据,证实了大语言模型能够在 ASLR 与动态内存随机化防护下自主完成高复杂度的浏览器引擎端到端漏洞利用。