1
DiCoBench: Benchmarking Multi-Image Fine-Grained Perception via Differential and Commonality Visual Cues
新基准DiCoBench专攻多图像细粒度感知,用差异与共性视觉线索考验模型隐含理解力。
arXiv:2606.26602v1 Announce Type: new Abstract: Recent advancements in Multimodal Large Language Models (MLLMs) have demonstrated impressive fine-grai…