跳到正文
Hugging Face 每日论文·· 2 天前AI 评分51

CheckerBench:长程Agent能否合成静态分析检查器

CheckerBench: Can Long-Horizon Agents Synthesize Static-Analysis Checkers?

AI 导读

论文提出CheckerBench,一个包含300个任务的可执行基准,任务源自167个仓库中的297个CVE,覆盖85种CWE和5种语言生态,每个任务提供存在漏洞与修复后的版本、固定的分析环境和检查器脚手架。

来源:Hugging Face 每日论文 · huggingface.co