Skip to content
P
非影
精选
最新
漏洞
研究
工具
主题
来源
搜索
搜索
🌓
English
面向安全从业者的中英双语安全研究与漏洞情报精选。
实测 GPT-5.6 Sol Ultra 编写 Chrome 漏洞利用
hacktron.ai
| 博客 |
#v8
|
#llm-benchmark
|
#exploit-development
|
#grok
|
#chrome-exploit
|
#gpt-5-6
摘要
对 GPT-5.6 Sol Medium、Sol Ultra 与 Grok 4.5 在漏洞利用开发能力上的基准测试:消耗 20.96 亿 token 后,仅 Sol Ultra 完成了完整的 Chrome 漏洞利用链。
发布时间
2026-07-14 00:00
收录时间
2026-09-20 03:14
原文 ↗
← 上一篇
打入 PostHog 生产数据库
下一篇 →
GLM 与 DeepSeek 在漏洞发现能力上正逼近前沿模型
相关内容
博客
·
hacktron.ai
我让 Claude Opus 写一个 Chrome 漏洞利用:下一代模型(Mythos?)赢了
研究人员让 Claude Opus 针对 Discord 内置的 Chrome 138(落后上游九个大版本)编写完整 V8 漏洞利用链:历时一周、消耗 23 亿 token、花费 2,283 美元 API 成本后成功弹出计算器。
研究
·
starlabs.sg
[CVE-2026-0899] CHECK 被移除、上下文遭混淆,一步将死
2026 年 1 月 Chrome 发布公告修复多个组件漏洞,其中 V8 的越界内存访问漏洞 CVE-2026-0899(由 @p1nky4745 发现)引起我们注意。在漏洞仍处受限、无公开 PoC 的情况下,我们逆向补丁定位根因,并构造出触发 PoC。
博客
·
hacktron.ai
GLM 与 DeepSeek 在漏洞发现能力上正逼近前沿模型
对 GLM、DeepSeek、Kimi、MiniMax 与 GPT、Claude、Gemini、Opus 在 15 个真实漏洞上的基准对比:开源与国产模型在漏洞发现上正快速逼近前沿水平。
博客
·
hacktron.ai
为什么 Mythos 对我们并不重要
对 Hacktron 扫描管线的基准测试显示:对大多数应用而言,用较小的模型反复运行即可超越单次前沿模型调用——成本与收益的新平衡。
博客
·
blog.trailofbits.com
颠覆代码完整性检查:在 Signal、1Password 等应用中植入本地后门
Trail of Bits 披露 Electron 漏洞 CVE-2025-55305:覆写代码完整性校验范围之外的 V8 堆快照文件,可在 Signal、1Password、Slack 等基于 Chromium 的应用中植入本地后门并使签名验证依旧通过。
博客
·
xbow.com
Grok 4.5 很强大,而让它安全的是其周围的系统
XBOW 评估 Grok 4.5 在自主攻防安全平台中的表现:该模型会频繁触及命令安全护栏,但被系统干预后愿意接受纠正并重新规划,因此可作为强力且可控的组件使用,但不能单独视为安全。
返回