Hugging Face 每日论文·· 2 天前AI 评分51
CheckerBench:长程Agent能否合成静态分析检查器
CheckerBench: Can Long-Horizon Agents Synthesize Static-Analysis Checkers?
AI 导读
论文提出CheckerBench,一个包含300个任务的可执行基准,任务源自167个仓库中的297个CVE,覆盖85种CWE和5种语言生态,每个任务提供存在漏洞与修复后的版本、固定的分析环境和检查器脚手架。
来源:Hugging Face 每日论文 · huggingface.co