2025年stable-diffusion | v1-5-pruned.ckpt和v1-5-pruned-emaonly.ckpt的区别

stable-diffusion | v1-5-pruned.ckpt和v1-5-pruned-emaonly.ckpt的区别对于日常生成 我们只要了解这样一个事实就行了 如果只是生成 EMA 模型和标准模型的效果是一样的

在这里插入图片描述

https://github.com/runwayml/stable-diffusion?tab=readme-ov-file#reference-sampling-script

在这里插入图片描述
对于 1.5 模型,其中可能包括四部分:标准模型、文本编码器、VAE模型、EMA模型。

标准模型:生成图片的核心模块,潜空间中的前向扩散和反向扩散就是通过它做的,对应到图中左侧的 U-Net。

文本编码器:将文本提示词转换为数学向量,然后用作生成图片的引导条件。全称是 Text Encoder,对应到图中的TE。

VAE模型:用于图像在像素空间和潜在空间的映射,生成图片时将图像从潜在空间转换为像素图片,目前大部分模型都自带VAE。

EMA模型:EMA是一种算法,用来稳定模型效果的。对于日常生成,我们只要了解这样一个事实就行了:如果只是生成,EMA模型和标准模型的效果是一样的。如果你要做二次训练,并且显卡够好,选择带EMA的模型可能更好,因为所有数据都在;当然选择去EMA的模型也能做二次训练。

https://mp.weixin.qq.com/s/Ka5lnzcyFv2zdifo-Q81HQ

编程小号
上一篇 2025-01-24 12:06
下一篇 2025-01-29 18:27

相关推荐

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌侵权/违法违规的内容, 请发送邮件至 举报,一经查实,本站将立刻删除。
如需转载请保留出处:https://bianchenghao.cn/bian-cheng-ji-chu/105750.html