返回首页
RadarAI··论文与技术

从 3632 个漏洞看 AI 时代的评测基准重构!VulnGym 基准发布

中文摘要

腾讯发布 VulnGym 基准,基于 3632 个真实漏洞,针对 AI 时代业务逻辑漏洞上升趋势,提供项目级、白盒及路径级漏洞检测能力评测方案。

English Summary

Tencent released VulnGym, a benchmark using 3,632 real vulnerabilities to evaluate AI's ability to detect rising business logic flaws via project-level and white-box methods.

原文节选

📌 一句话摘要 腾讯悟空安全团队联合多所高校发布 VulnGym 评测基准,基于 3632 个真实漏洞数据,聚焦 AI 时代业务逻辑漏洞占比上升趋势,提供项目级、白盒、路径级标注的漏洞检测能力评测方案。 📝 详细摘要 文章基于对 2025 年 1 月至 2026 年 4 月期间 3632 条 GitHub Advisory 高危/严重漏洞的统计分析,揭示了 AI 编码时代漏洞形态正在发生结构性变化:业务逻辑漏洞占比持续...