1
Data Analysis in the Wild: Benchmarking Large Language Models Against Real-World Data Complexities
用真实世界数据复杂性考验大模型数据分析能力,揭示LLM在杂乱数据下的表现与局限
arXiv:2607.06482v1 Announce Type: cross Abstract: Current benchmarks for evaluating Large Language Models (LLMs) in data analysis often fail to reflec…