stabilityai
/

sd-vae-ft-mse-original

Text-to-Image

stable-diffusion

stable-diffusion-diffusers

Model card Files Files and versions

xet

Community

multimodalart HF Staff commited on Oct 14, 2022

Commit

d17ff5f

1 Parent(s): 833c4f1

Update README.md

Browse files

Files changed (1) hide show

README.md +9 -20

README.md CHANGED Viewed

@@ -9,7 +9,8 @@ inference: false
 # Improved Autoencoders
 ## Utilizing
-These weights are intended to be used with the original [CompVis Stable Diffusion codebase](https://github.com/CompVis/stable-diffusion). If you are looking for the model to use with the D🧨iffusers library, [come here](https://huggingface.co/CompVis/stabilityai/sd-vae-ft-mse).
 ## Decoder Finetuning
 We publish two kl-f8 autoencoder versions, finetuned from the original [kl-f8 autoencoder](https://github.com/CompVis/latent-diffusion#pretrained-autoencoding-models).
 The first, _ft-EMA_, was resumed from the original checkpoint, trained for 313198 steps and uses EMA weights.
@@ -44,41 +45,29 @@ _Visualization of reconstructions on  256x256 images from the COCO2017 validatio
 <p align="center">
   <br>
   <b>
-256x256: ft-MSE (top), ft-EMA (middle), original (right)</b>
 </p>
 <p align="center">
-<img src="https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-mse/00025.png" />
-<img src="https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-ema/00025.png" />
-<img src="https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/original/00025.png" />
 </p>
 <p align="center">
-<img src="https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-mse/00011.png" />
-<img src="https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-ema/00011.png" />
-<img src="https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/original/00011.png" />
 </p>
 <p align="center">
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-mse/00037.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-ema/00037.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/original/00037.png />
 </p>
 <p align="center">
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-mse/00043.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-ema/00043.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/original/00043.png />
 </p>
 <p align="center">
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-mse/00053.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-ema/00053.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/original/00053.png />
 </p>
 <p align="center">
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-mse/00029.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/ft-ema/00029.png />
-<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/original/00029.png />
 </p>

 # Improved Autoencoders
 ## Utilizing
+These weights are intended to be used with the original [CompVis Stable Diffusion codebase](https://github.com/CompVis/stable-diffusion). If you are looking for the model to use with the 🧨 diffusers library, [come here](https://huggingface.co/CompVis/stabilityai/sd-vae-ft-ema).
 ## Decoder Finetuning
 We publish two kl-f8 autoencoder versions, finetuned from the original [kl-f8 autoencoder](https://github.com/CompVis/latent-diffusion#pretrained-autoencoding-models).
 The first, _ft-EMA_, was resumed from the original checkpoint, trained for 313198 steps and uses EMA weights.
 <p align="center">
   <br>
   <b>
+256x256: ft-EMA (left), ft-MSE (middle), original (right)</b>
 </p>
 <p align="center">
+<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/merged/00025_merged.png />
 </p>
 <p align="center">
+<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/merged/00011_merged.png />
 </p>
 <p align="center">
+<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/merged/00037_merged.png />
 </p>
 <p align="center">
+<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/merged/00043_merged.png />
 </p>
 <p align="center">
+<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/merged/00053_merged.png />
 </p>
 <p align="center">
+<img src=https://huggingface.co/stabilityai/stable-diffusion-decoder-finetune/resolve/main/eval/ae-decoder-tuning-reconstructions/merged/00029_merged.png />
 </p>