Artificial Analysis 推出 Cyber Index,对企业漏洞防御的 AI 模型进行基准测试
核心要点
- 新指数使用与行业合作伙伴开发的三个专门基准来评估人工智能系统发现、验证和修补安全漏洞的能力。
- 该组织于 9 月 25 日推出了网络指数 (v1),评估人工智能模型如何有效地执行查找和修复企业系统漏洞的工作。
- 该指数评估模型的依据是其帮助企业先发制人地管理漏洞的能力,而不是其闯入系统的能力。
来源 CryptoBriefing作者 Diego Almada Lopez发布于 1 小时前

新指数使用与行业合作伙伴开发的三个专门基准来评估人工智能系统发现、验证和修补安全漏洞的能力。
独立的人工智能基准测试平台Artificial Analysis正在扩展到网络安全领域。该组织于 9 月 25 日推出了网络指数 (v1),评估人工智能模型如何有效地执行查找和修复企业系统漏洞的工作。
三个基准,一个综合分数
Cyber Index 建立在三个不同基准的综合之上,每个基准均由行业合作伙伴贡献:CWE-Bench-AA、DeepsecBench-AA 和 CyberGym-E2E-AA。它们共同涵盖了企业漏洞管理的整个生命周期,从发现到验证再到修补。
CWE-Bench-AA 似乎面向常见弱点枚举类别,这是对软件和硬件漏洞类型进行分类的标准化分类系统。 DeepsecBench-AA 专注于更深入的安全分析任务。 CyberGym-E2E-AA 通过端到端评估场景完善了三重奏,测试人工智能代理是否可以从头到尾导航现实的攻击面。
防守,而非进攻
一项深思熟虑的设计选择脱颖而出:网络指数完全关注防御性网络安全。该指数评估模型的依据是其帮助企业先发制人地管理漏洞的能力,而不是其闯入系统的能力。
人工智能、科技及其所推动的市场——每日简报。日常的。自由的。加入加密货币、金融和政策领域 34,000 多名读者的行列。电子邮件地址 免费订阅 我们尊重您的隐私。随时取消订阅。
建立标杆帝国
网络指数并不是人工分析首次涉足专业领域评估。该平台由 Micah Hill-Smith 联合创立,此前已推出涵盖金融、法律、医疗保健等领域的能力指数。其通用智能指数已达到4.3.2版本,汇总了主要实验室使用的数百个人工智能模型的10个独立评估。
