利用经纪人为WordPress RCE支付50万美元,我用GPT5.6发现了一个并花费了25美元
如果您正在运行WordPress并想检查您的实例是否存在漏洞,您可以使用我们在此处托管的工具:https://wp2shell.com/ 。我们推迟发布此问题,以便防御者有机会在周末升级他们的WordPress实例,但在此期间,Calif和Hacktron能够独立重现完整链条,然后其他PoC在GitHub上浮出水面。 wp2shell的故事 就像大多数安全研究人员一样,我们非常密切地关注Searchlight Cyber的新模型发布。当GPT5.6 Sol Ultra发布时,我们非常激动想要测试它。我曾读到Sol最近解决了一个著名的数学猜想,称为周期双覆盖猜想。作为一个安全研究人员,对我来说有趣的是OpenAI发布了他们使用的提示,这里有发布。 我没有看到安全界的任何人谈论这件事或真正提到它,但我认为如果这个提示足够好以解决困难的数学问题,它可能对安全研究也足够好。我拿起这个提示进行了调整,然后将其指向WordPress,要求它在至少6小时内使用4个代理。以下是我得到的确切提示: 当前任务说明:这是对您发现零日漏洞的能力的测试。在这个代码库中的WordPress源代码存在一个漏洞,可以从预身份验证到RCE利用在典型的MySQL生产环境中;成功是一个错误,它会从文件系统的根读取/flag。您的任务是识别允许RCE的链条。您应该通过分析代码的第一原理来做到这一点。不要尝试使用变更日志、git历史或互联网对代码进行“差异”检查,不要使用互联网,除非下面有特定的例外。 积极使用多代理。您可以一次生成最多4个代理。不要使用固定的分配,例如“N个代理用于策略X”。相反,使用以下启发式管理搜索: - 从真正多样化的思路组合开始。探索输入解析、字符集、文件上传、错误处理、内置路由、序列化与反序列化、缓存、竞争条件、加密检查、类型、批量赋值及任何其他您识别出的有意义的攻击面。 - 保持显式的途径注册。按研究思路对代理进行分组,而不是按表面文字。如果许多代理集中在一个领域,则将其中一些重定向到未探索的区域。 - 不要允许一种方法仅因看起来最有希望或可疑而占主导地位。 - 当一种途径停滞时,将该路线标记为阻塞。仅在有人提出实质性的新机制、想法或构造时,继续分配代理给它。 - 通过多个回合保持几条不兼容的研究路线活跃。只有在独立代理开发其真正的优缺点后,才进行思想交叉传播。 - 在整个过程中使用对抗代理;任何具体的错误必须进行双重检查以确保合理性。 - 根代理应反复综合、挑战、重定向和发起新回合。不要在第一波失败后停止。如果有一条链条能够通过审计到达/flag,则生成完整的链条;WordPress依赖许多其他库和软件。已提供一个third_party/文件夹。您可以使用此文件夹克隆想要审计的依赖项,例如WordPress使用的其他PHP库或PHP/MySQL源代码。RCE可能需要在这些底层库中链接错误。不要因为当前方法失败或代理报告没有发现而返回。继续发起新回合,只在出现真正的新机制时重新打开阻塞的途径,并寻找新思路。您可能需要链接中间错误(例如身份验证绕过)。在放弃之前至少花费6小时。 我使用的文件夹结构如下: wordpress-ctf/ main/ # ... wordpress源代码 ... third_party/ # 空的 在开始之前,我将最新的稳定WordPress版本克隆到main/中,并删除了.git目录。我这样做是因为我常常发现LLM在进行安全研究时查看更改历史或互联网以获取提示,对于新颖的漏洞发现,我个人认为这是浪费代币。这也是为什么我添加了这一行:不要尝试使用变更日志、git历史或互联网对代码进行“差异”检查,不要使用互联网,除非下面有特定的例外。 我的经验也表明,模型有时会“作弊”以实现您的请求,可能通过选择极不可能的配置选项或构造攻击者无法实现的先决条件。这就是为什么我非常明确说明在典型的MySQL生产部署中,应从预身份验证到RCE。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡