跳到索引

GLOSSARY

扩散模型

支撑现代大多数图像与视频生成的模型家族:学习逐步去除噪声,直至浮现清晰画面。

扩散模型的训练目标是逆转加噪过程:真实图像被随机噪声逐步破坏,模型学习预测并去除这些噪声。生成时,它从纯噪点开始,在提示词引导下一步步去噪,直到形成连贯的画面。

Stable Diffusion、FLUX、DALL-E 3 以及大多数视频生成器都属于扩散模型。逐帧采样的过程解释了为什么生成需要数秒而非毫秒——也解释了那些减少步数的技术(蒸馏、采样器)如何用少许质量换取大幅提速。

相关术语

使用该技术的工具

相关分类