1
Reward-Aware Population Scaling of Evolutionary Strategies in LLM Fine-Tuning
新方法通过奖励感知群体缩放优化进化策略,显著提升LLM微调效率,已被ICML 2026 workshop收录。
arXiv:2607.19408v1 Announce Type: new Abstract: Using Evolutionary Strategies (ES) for fine-tuning large language models is attractive because it is m…