GEAR: Guided End-to-End AutoRegression for Image Synthesis
GEAR 打破两阶段训练,用端到端自回归协同优化图像生成,让 tokenizer 与生成器无缝配合,产出的图像更真实。
arXiv:2606.32039v1 Announce Type: new Abstract: Visual generative models are typically trained in two stages. A tokenizer is first trained for reconst…