我们燃烧了 117 亿枚代币来寻找最好的网络人工智能模型
aikido.dev | 博客 | #ai-security | #open-source | #benchmark | #aikido | #llm-security | #vulnerability-discovery | #ai-models | #deepseek
摘要
Aikido 燃烧 117 亿 token、让 10 个 AI 模型三次重找 32 个新披露漏洞:DeepSeek V4 Pro 三轮合并找出 28 个居首,开源模型已能与闭源前沿模型抗衡,且「多跑几轮」可弥补单轮召回不足;代价是误报噪音更多。
为什么值得关注
这篇内容为安全团队开展监测、验证和修复提供最新背景。
- 发布时间
- 收录时间
Skip to content