返回
Dynamic frequency modulation for controllable text-driven image generation
DOI:10.1016/j.patcog.2026.114880.png)
摘要
En 中文
• 低频成分在早期生成阶段建立结构框架。
• 高频成分在后期阶段主导合成精细纹理。
• 我们提出了一种无需训练且具有动态衰减的频率调制方法。
• 直接操作噪声潜在变量避免了经验性特征图选择。
• 我们的方法在多样化的生成场景中优于当前最优方法。
Keyword:
Diffusion model
Image generation
Frequency spectrum
Structure framework

