Self-Play Fine-Tuning of Diffusion Models for Text-to-Image Generation
介绍了一种名为扩散模型自博弈微调的创新技术,其中扩散模型与其早期版本展开竞争,从而促进迭代式自我改进过程。
Loading...
介绍了一种名为扩散模型自博弈微调的创新技术,其中扩散模型与其早期版本展开竞争,从而促进迭代式自我改进过程。

刚开始读的时候觉得自进化的过程很像GAN,一个裁判一个对手,但是读到后面感觉更像ODE,生成模型自成一个分布,GT自成一个分布,整个自我对弈的过程,动态地来看,就是模型在微调自己的 ODE 积分轨迹。它不仅受到真实分布的吸引,还受到旧有模型分布的排斥。很复杂的数学推导就不看了。