{ "_class_name": "AutoencoderKLQwenImage21", "_diffusers_version": "0.41.0.dev0", "attn_scales": [], "base_dim": 8, "decoder_base_dim": 8, "dim_mult": [ 1, 1, 1, 1, 1 ], "dropout": 0.0, "in_channels": 4, "is_residual": true, "latents_mean": [ 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0, 0.0 ], "latents_std": [ 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0, 1.0 ], "num_res_blocks": 1, "out_channels": 4, "patch_size": null, "scale_factor_spatial": 8, "scale_factor_temporal": 8, "temperal_downsample": [ false, true, true, true ], "z_dim": 16 }