SIFT: Self-Imagination Fine-Tuning for Physically Plausible Motion in Video Diffusion Models
让视频扩散模型学会“自我想象”物理规律,生成动作更符合真实世界。
arXiv:2606.27741v1 Announce Type: new Abstract: Recent advances in video diffusion models have greatly improved visual fidelity, yet their generated m…