盛世宏图 发表于 2024-7-22 12:50:48

stable-diffusion | v1-5-pruned.ckpt和v1-5-pruned-emaonly.ckpt的区别

https://img-blog.csdnimg.cn/direct/a87cda065ae449ef8dc9e545d660f70d.png
   https://github.com/runwayml/stable-diffusion?tab=readme-ov-file#reference-sampling-script
https://img-blog.csdnimg.cn/direct/6a18f5f75def409d8eb9114e9cda14fb.png
对于 1.5 模型,其中可能包括四部门:标准模型、文本编码器、VAE模型、EMA模型。
标准模型:天生图片的核心模块,潜空间中的前向扩散和反向扩散就是通过它做的,对应到图中左侧的 U-Net。
文本编码器:将文本提示词转换为数学向量,然后用作天生图片的引导条件。全称是 Text Encoder,对应到图中的TE。
VAE模型:用于图像在像素空间和潜在空间的映射,天生图片时将图像从潜在空间转换为像素图片,如今大部门模型都自带VAE。
EMA模型:EMA是一种算法,用来稳定模型效果的。对于日常天生,我们只要相识如许一个究竟就行了:如果只是天生,EMA模型和标准模型的效果是一样的。如果你要做二次练习,并且显卡够好,选择带EMA的模型可能更好,因为全部数据都在;当然选择去EMA的模型也能做二次练习。
   https://mp.weixin.qq.com/s/Ka5lnzcyFv2zdifo-Q81HQ

免责声明:如果侵犯了您的权益,请联系站长,我们会及时删除侵权内容,谢谢合作!更多信息从访问主页:qidao123.com:ToB企服之家,中国第一个企服评测及商务社交产业平台。
页: [1]
查看完整版本: stable-diffusion | v1-5-pruned.ckpt和v1-5-pruned-emaonly.ckpt的区别