Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.017 — 2026-07-21
NEWS HN 352 约 4 分钟

25美元的GPT,挖出50万美元漏洞

Searchlight Cyber 称用25美元模型成本挖出 WordPress 漏洞链,低成本 AI 或将改写安全攻防。

IMAGE — Hacker News 高分帖(24h+ 滚动窗口)

如果检查一座大楼的安全,传统做法是让专家逐间排查门锁、窗户和管道。Searchlight Cyber 的研究人员换了一种方式:把 WordPress 源代码交给 AI,让最多 4 个 agents——可并行探索不同路线的模型代理——连续研究至少 6 小时。该机构称,GPT5.6 Sol Ultra 最终找到了一条无需登录即可远程执行代码的漏洞链,模型花费为 25 美元。

这件事值得关注,不只因为漏洞严重,更因为成本反差惊人。不过,目前全部信息都来自 Searchlight Cyber 的单篇文章,且正文材料在关键技术细节处截断。25 美元包含哪些费用、漏洞是否真值 50 万美元,都不能从现有材料中确认。

不是找一个洞,而是拼出一条路

WordPress 是广泛使用的网站内容管理系统,核心程序和插件共同组成庞大的软件供应链。一处高影响漏洞可能同时波及许多网站。

研究者寻找的是“预认证 RCE”:攻击者不用先登录,就能让远端服务器执行任意指令。RCE 是 Remote Code Execution,即远程代码执行,也是网站漏洞中后果最严重的类别之一。

现实攻击往往不是撞开一扇门,而是连续利用几处弱点。研究者因此要求模型找出完整“漏洞利用链”:先突破一道限制,再利用下一处缺陷,最终取得执行代码的能力。文章披露的运行输出显示,模型曾声称发现预认证 SQL 注入——一种通过恶意数据库指令影响系统的漏洞;但截断材料没有给出它如何继续组成完整链条。

关键可能不只在模型

研究者没有简单地说“帮我找漏洞”。提示词要求模型同时维持多条差异明显的调查路线,覆盖输入解析、文件上传、缓存、竞态条件和序列化等方向;某条路线停滞后先标记为受阻,除非出现新机制,否则不再反复消耗时间。具体发现还要由对抗性代理复查。

这更像组织一支小型研究团队:有人分别查门窗,有人质疑初步发现,负责人不断汇总并重新分工。模型最多可同时使用 4 个 agents,而且即使第一轮没有结果,也要继续发起新一轮搜索。

研究者还删掉了代码仓库的 Git 历史,并限制模型通过互联网寻找补丁线索,希望它直接分析代码,而不是从新旧版本差异中猜答案。WordPress 依赖的 PHP、MySQL 等底层库也被纳入检查范围。文章称,这套提示词改编自 OpenAI 为 Cycle Double Cover conjecture 使用并公开的提示词;该数学成果及模型信息在现有材料中同样没有第二来源印证。

25 美元真正改变了什么?

按照 Searchlight Cyber 的说法,Calif 和 Hacktron 在其他 PoC 出现在 GitHub 前,分别复现了完整漏洞链。PoC,即概念验证,是证明漏洞确实可以触发的最小代码或操作步骤。但核查材料没有提供两人的独立报告,因此这仍属于原作者的单一信源陈述。

文章还称,漏洞利用经纪商会为 WordPress RCE 支付 50 万美元。这里说的是报价,不是这条漏洞的成交价,也不知道适用条件。更稳妥的结论是:一次标称 25 美元的模型运行,被用于发现一种可能具有高价值的漏洞。若这种方式能够稳定复现,安全研究的门槛会下降;防守方可以扩大代码审计,攻击者也可能获得同样的低成本工具,漏洞发现因而更像一场速度竞赛。

局限与未知

  • 25 美元没有披露 token 用量,也不清楚是否包含人工分析、运行环境和后续验证成本。
  • 材料未给出受影响版本、CVE、完整技术链、补丁或 WordPress 官方公告;推迟到周末后披露,是研究者称为用户预留升级时间,不等于官方修复已经得到确认。
  • Searchlight Cyber 称检测工具已部署在 wp2shell.com,但现有单一信源不足以独立验证漏洞及复现结论。

供稿材料 SOURCES — 1

← 返回 2026-07-21 · 科技板块