Instructions to use mally-2000/saii-vae with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use mally-2000/saii-vae with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("mally-2000/saii-vae", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Notebooks
- Google Colab
- Kaggle
| { | |
| "source_checkpoint": "/root/use_model_param/old_vqgan/epoch=000325-step=000401865.ckpt", | |
| "official_config": { | |
| "in_channels": 1, | |
| "out_channels": 1, | |
| "down_block_types": [ | |
| "DownEncoderBlock2D", | |
| "DownEncoderBlock2D", | |
| "DownEncoderBlock2D" | |
| ], | |
| "up_block_types": [ | |
| "UpDecoderBlock2D", | |
| "UpDecoderBlock2D", | |
| "UpDecoderBlock2D" | |
| ], | |
| "block_out_channels": [ | |
| 128, | |
| 256, | |
| 512 | |
| ], | |
| "layers_per_block": 2, | |
| "latent_channels": 3, | |
| "sample_size": 256, | |
| "num_vq_embeddings": 32768, | |
| "vq_embed_dim": 1, | |
| "norm_num_groups": 32, | |
| "mid_block_add_attention": true, | |
| "scaling_factor": 1.0 | |
| }, | |
| "source_total_keys": 260, | |
| "ignored_loss_keys_count": 55, | |
| "ignored_loss_keys_preview": [ | |
| "loss.perceptual_loss.scaling_layer.shift", | |
| "loss.perceptual_loss.scaling_layer.scale", | |
| "loss.perceptual_loss.net.slice1.0.weight", | |
| "loss.perceptual_loss.net.slice1.0.bias", | |
| "loss.perceptual_loss.net.slice1.2.weight", | |
| "loss.perceptual_loss.net.slice1.2.bias", | |
| "loss.perceptual_loss.net.slice2.5.weight", | |
| "loss.perceptual_loss.net.slice2.5.bias", | |
| "loss.perceptual_loss.net.slice2.7.weight", | |
| "loss.perceptual_loss.net.slice2.7.bias", | |
| "loss.perceptual_loss.net.slice3.10.weight", | |
| "loss.perceptual_loss.net.slice3.10.bias", | |
| "loss.perceptual_loss.net.slice3.12.weight", | |
| "loss.perceptual_loss.net.slice3.12.bias", | |
| "loss.perceptual_loss.net.slice3.14.weight", | |
| "loss.perceptual_loss.net.slice3.14.bias", | |
| "loss.perceptual_loss.net.slice4.17.weight", | |
| "loss.perceptual_loss.net.slice4.17.bias", | |
| "loss.perceptual_loss.net.slice4.19.weight", | |
| "loss.perceptual_loss.net.slice4.19.bias" | |
| ], | |
| "mapped_keys_count": 205, | |
| "missing_keys_count": 0, | |
| "missing_keys": [], | |
| "unexpected_keys_count": 0, | |
| "unexpected_keys": [], | |
| "extra_mapped_keys_preview": [], | |
| "load_state_dict_missing_keys_count": 0, | |
| "load_state_dict_missing_keys": [], | |
| "load_state_dict_unexpected_keys_count": 0, | |
| "load_state_dict_unexpected_keys": [], | |
| "target_output_dir": "/root/use_model_param/old_vqgan_diffusers_vqmodel" | |
| } |