资讯
蚂蚁集团AI安全实验室登顶CyberGym榜单,漏洞验证成功率达98.5%
📋总体概括
9月11日,AI安全评测基准CyberGym更新榜单,蚂蚁集团AI安全实验室的天工Cyber模型与天工Harness以98.5%漏洞验证成功率登顶全球第一。天工Harness融合自研天工Cyber模型及DeepSeek V4 Pro、Qwen 3.8 Max等国产大模型能力,可端到端完成漏洞分析、PoC构造和结果验证,覆盖复杂软件漏洞验证全流程,标志着国产大模型在AI安全实战化能力上的突破。
⚡关键信息
- ▸蚂蚁集团AI安全实验室以98.5%漏洞验证成功率登顶CyberGym全球榜单
- ▸登顶方案为天工Cyber模型与天工Harness组合,于9月11日榜单更新中位列第一
- ▸天工Harness融合了DeepSeek V4 Pro、Qwen 3.8 Max等国产大模型能力
- ▸该系统可完成漏洞分析、PoC构造和结果验证的端到端流程
- ▸评测聚焦复杂软件漏洞验证场景,属AI安全实战能力基准测试
🔥犀利点评
安全赛道的AI评测和性能跑分一样,榜单第一不等于实战第一,但98.5%的验证成功率至少说明蚂蚁不是来刷存在感的。值得玩味的是天工Harness直接调用DeepSeek和Qwen的能力——所谓自研更像是一套编排框架加验证闭环,工程整合确实是真功夫,但核心模型护城河有多深要打个问号。漏洞验证自动化一旦成熟,价值在甲方安全预算里,蚂蚁瞄准的显然是企业安全市场这块蛋糕。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 36氪快讯 阅读全文 →