Skip to content
P
非影
精选
最新
漏洞
研究
工具
主题
来源
搜索
搜索
🌓
English
面向安全从业者的中英双语安全研究与漏洞情报精选。
为什么 Mythos 对我们并不重要
hacktron.ai
| 博客 |
#mythos
|
#llm-benchmark
|
#cost-efficiency
|
#scanning-pipeline
|
#smaller-models
摘要
对 Hacktron 扫描管线的基准测试显示:对大多数应用而言,用较小的模型反复运行即可超越单次前沿模型调用——成本与收益的新平衡。
发布时间
2026-04-29 00:00
收录时间
2026-09-20 03:20
原文 ↗
← 上一篇
17 万美元赏金:Vercel React2Shell 挑战赛
下一篇 →
Hacktron Review 正式发布
相关内容
博客
·
tenzai.com
GLM-5.2 是我们测试过性价比最高的网络安全模型,但它并不是第一名
Tenzai 对 GLM-5.2、GPT-5.5 和 Opus-4.8 在真实漏洞利用任务上做基准测试:GLM-5.2 以每条线索 $1.13 的成本利用 67% 的预埋漏洞,是性价比最高的配置;GPT-5.5 与 Opus-4.8 召回率更高,但仅在价格 2-3 倍的高推理档成立。
博客
·
hacktron.ai
实测 GPT-5.6 Sol Ultra 编写 Chrome 漏洞利用
对 GPT-5.6 Sol Medium、Sol Ultra 与 Grok 4.5 在漏洞利用开发能力上的基准测试:消耗 20.96 亿 token 后,仅 Sol Ultra 完成了完整的 Chrome 漏洞利用链。
博客
·
hacktron.ai
GLM 与 DeepSeek 在漏洞发现能力上正逼近前沿模型
对 GLM、DeepSeek、Kimi、MiniMax 与 GPT、Claude、Gemini、Opus 在 15 个真实漏洞上的基准对比:开源与国产模型在漏洞发现上正快速逼近前沿水平。
博客
·
xbow.com
Grok 4.5 有望接管 AI 安全市场的中间地带
XBOW 将 Grok 4.5 与 Mythos、GPT-5.5、GLM 对比评测:固定迭代下可解约 93% 的基准漏洞,在 1–10 美元成本区间内解决率最优。
博客
·
xbow.com
经济型模型的崛起:GLM 和 Muse Spark 在网络安全领域的对比
XBOW 在真实漏洞应用上对比低成本模型 GLM、Muse Spark 1.1 与 Mythos、GPT-5.5,指出'最佳'模型取决于预算与任务本身。
博客
·
xbow.com
Mythos 与 GPT-5.5 会发现大量漏洞,但这够吗?
XBOW 追问:Mythos、GPT-5.5 等前沿模型能发现大量漏洞,但对防御远远不够——覆盖率、验证、安全与治理才是企业级攻防安全的关键。
返回