1
SCHEDBench: A Benchmark for Evaluating LLM Constraint Faithfulness in Natural-Language Combinatorial Scheduling
全新基准SCHEDBench,专测大模型在自然语言组合调度中的约束遵循能力。
arXiv:2608.00991v1 Announce Type: new Abstract: This paper introduces SCHEDBench, a natural-language benchmark for evaluating combinatorial scheduling…