Evaluating Agentic Code Repair Capabilities in Distributed Systems
分布式系统bug修复遇上AI智能体,DDBench双条件评测揭示其真实能力边界。
arXiv:2608.14863v1 Announce Type: cross Abstract: LLM-based coding agents have advanced rapidly on single-process SWE tasks, with frontier models now …