1
DRIFT: Refining Instruction Data via On-Policy Data Attribution
新方法DRIFT通过on-policy数据归因,精准优化SFT训练数据分布,助力突破大模型能力上限。
arXiv:2606.18307v1 Announce Type: new Abstract: Optimizing the training data distribution for Supervised Fine-Tuning (SFT) dictates the capability of …