OpenAI与Paradigm发布EVMbench:以太坊AI安全基准

OpenAI与Paradigm发布EVMbench,基于120个真实漏洞,测试AI在以太坊智能合约安全中的检测、修复和利用能力,推动区块链安全自动化。

OpenAI与Paradigm联合推出了EVMbench,这是一套专为评估AI代理在以太坊虚拟机(EVM)智能合约安全领域能力而设计的基准测试系统。EVMbench基于40份公开审计报告中的120个真实漏洞,为AI模型提供了严格且真实的测试环境。 该工具支持检测、修复和利用三种操作模式,模拟现实中的安全工作流程。初步测试结果显示,GPT-5.3-Codex在漏洞利用方面的成功率高达72.2%,展现出AI在识别和利用漏洞上的显著进步。然而,目前AI模型在攻击方面表现优于全面审计和修复,仍存在“利用差距”。 EVMbench还涵盖了以支付为重点的Layer 1协议场景,并得益于Paradigm的行业经验。OpenAI计划开放相关任务和工具,并承诺提供1000万美元API额度以支持防御性安全研究。尽管EVMbench是智能合约安全自动化的重要进展,但OpenAI也指出其未能覆盖现实世界安全的全部复杂性。

相關新聞