← 返回拾句全部内容

用自研红队AI挑战我的付费网站,竟然查不出漏洞?

YouTube2026-06-21

摘要

用自动化红队AI攻防,16次尝试都没攻破我的付费MD文件防护。

“The agent reads what has been tried before to solve our problem, picks a new attack, and tries to improve.”

深度解读

用自研红队AI挑战我的付费网站,竟然查不出漏洞?

一句话总结:用自动化红队AI攻防,16次尝试都没攻破我的付费MD文件防护。


内容概览

  • 主题:自动化红队,网站安全测试,Claude模型,攻击评估,浏览器自动化
  • 适合人群:AI安全研究者、Web开发者、自动化测试爱好者、对AI辅助攻防感兴趣的人

核心观点

  1. 用自动化AI红队持续攻击,能自动进化攻击手段
    AI黑客通过不断尝试、评分、筛选和改进攻击脚本,理论上可以“自我学习”更高效的攻击方法。

  2. 实际测试中,关键MD文件的防护表现良好,未被攻破
    经过多轮高达16次实验,红队AI未能绕过付费墙直接拿到敏感文件。

  3. 利用Codeex进一步挖掘攻击点,实现攻击方案迭代
    在已有结果基础上,借助Codeex生成的新实验,提高检测覆盖面,增加挖掘潜力。


深度解读

自动红队攻防:不是科幻,而是可以落地的实验

这次实验用到的框架,源自Carpathy的AutoResearch项目,核心是让AI扮演红队渗透测试者,针对一个真实网站展开攻防。

我的目标很简单:测试藏在付费墙后的MD文件能否被攻破。

红队AI的有趣点在于它不是盲测,而是带有反馈循环的自我改进。每次攻击执行后,系统根据得分(0到100)判断本轮攻击效果,保留更优解,淘汰无效方法。

就像一个小孩学走路,摔了几次,逐渐找到更稳的姿势。这样,理论上AI应该越来越聪明,攻击效率越来越高。

如何兵分两路,人工+自动?

操作界面是Claude模型结合浏览器自动化技术。攻击脚本发动请求、模拟用户行为,测试各种路径:Headers、API接口、支付流程、Token验证等等。

特别说明,我还设置了“技能树”:网络侦察、请求分析、攻击面映射,甚至模拟聊天机器人漏洞红队,确保覆盖多角度。

一轮攻击最长5分钟,比之前2分钟更有时间“钻研”,一共安排30轮实验,足够探索很多角落。

每当AI写出新攻击脚本,上传代码,执行,反馈结果,再接再厉。不奏效的脚本就被“踢出队伍”,奏效的则留用。

实验结果:没发现能直接偷MD文件的漏洞

11轮攻击后,AI没找到任何关键漏洞。它扫描了各种路径,包括Stripe支付接口、缓存、Webhook、目录穿越、Race Token等。

几乎全方位摸排,唯一收获是几个“非标准响应”,但没打通核心内容访问。

继续跑到13轮,扫描覆盖全部12大类,成绩让人放心。最高分只有30分,没有获得付费文件内容。

随后借助Codeex帮助“反思”之前的测试结果,它给出了“优先级最高”的新测试清单。重新导入云端,继续尝试,依然保持网站安全。

小心翼翼测试下载链接防护细节

付费MD文件有三个下载次数限制,链接有效期10分钟。用AI模拟验证功能正常:下载次数受限制,Token有效。

这就意味着,即便有人买了链接私下分享,最多只有3次,时限10分钟。虽然有分享可能,但风险有限。

跨域检查、防盗链也都没出现异常。整个防护机制结构稳定,将风险控制在可接受范围内。

真实案例反哺开发者:同类网站曾被找出漏洞

我还测试过其他Vibecoded网站,发现他们之前没有做好防护,一些漏洞被挖掘出来了。

我告诉对方,他们同意我帮忙试试。结果确实发现问题。

这验证了自动红队AI的实际使用价值,也说明防范意识还有提升空间。

这套工具适合的姿势和警告

别拿它做坏事——这是给自己做防守用的白帽利器。

Claude模型设计时也有过滤机制,会阻止明显恶意攻击指令。

通过设置自动化红队,给网站做全面演练,摸清可能引发数据泄露的死角,提前堵上漏洞,这才是正道。


值得记住的话

“The agent reads what has been tried before to solve our problem, picks a new attack, and tries to improve.”

“After 16 experiments, getting the MD files without token is not possible with the current attack surface.”

“I don't really care about token link sharing; the three-download limit makes that low risk.”


标签

AI 安全 自动化测试 红队 Web

更多值得记住的话

“After 16 experiments, getting the MD files without token is not possible with the current attack surface.”
“I don't really care about token link sharing; the three-download limit makes that low risk.”