Online Reasoning Calibration: Test-Time Training Enables Generalizable Conformal LLM Reasoning
用测试时训练校准大模型推理置信度,让 conformal 方法在分布变化下依然可靠,COLM 2026 新思路值得关注。
arXiv:2604.01170v2 Announce Type: replace-cross Abstract: While test-time scaling has enabled large language models to solve highly difficult tasks, s…