花 1500 美元,让 AI“黑”自己的 App:GPT-5.5 成功率 70%,部分模型 0 分交卷
中文摘要
研究员测试大模型自主渗透能力,GPT-5.5 以 70% 成功率领先,而部分模型因安全策略得零分,揭示了 AI 安全表现的巨大差异。
English Summary
Researcher Kasra Rahjerdi's experiment showed "GPT-5.5" leading with a 70% success rate in penetration testing, while other models failed due to safety restrictions.
原文节选
📌 一句话摘要 安全研究员 Kasra Rahjerdi 花费超 1500 美元,让十余款主流大模型对存在真实 Bug 的移动应用进行自主渗透测试,结果显示 GPT-5.5 以 70% 成功率领先,而部分模型因安全策略或路径依赖得零分。 📝 详细摘要 本文报道了一项由安全研究员 Kasra Rahjerdi 发起的实验:他构建了一个名为 BookNook 的 React Native 移动应用,并故意埋入安全漏洞,随后...