1. 我们燃烧了 117 亿枚代币来寻找最好的网络人工智能模型 博客 | 2026-08-21 00:00 | aikido.dev | 原文 ↗ | #ai-security | #open-source | #benchmark
2. Grok 4.5 有望接管 AI 安全市场的中间地带 博客 | 2026-07-10 18:09 | xbow.com | 原文 ↗ | #ai-security | #pentesting | #benchmark
3. 经济型模型的崛起:GLM 和 Muse Spark 在网络安全领域的对比 博客 | 2026-07-09 20:07 | xbow.com | 原文 ↗ | #ai-security | #pentesting | #benchmark
4. Full Fathom Five:Anthropic Mythos 级模型公开发布背景分析 博客 | 2026-06-13 00:00 | aikido.dev | 原文 ↗ | #ai-security | #vulnerability-management | #ai-safety
5. GPT-5.5 vs Claude Opus 4.7 vs Sonnet 4.6:前沿网络模型在漏洞验证上的对决 研究 | 2026-05-06 13:19 | hackerone.com | 原文 ↗ | #ai-security | #vulnerability-management | #benchmark
6. 化整为零,成效更丰:我们在攻防工作流中运行 Opus 4.7 的收获 博客 | 2026-04-16 14:00 | xbow.com | 原文 ↗ | #ai-security | #benchmark | #offensive-security