Image-Text-to-Video
Diffusers
Safetensors
text-to-video
image-to-video
video-to-video
text-to-audio-video
image-to-audio-video
image-text-to-audio-video
video-to-audio-video
audio-to-audio-video
audio-video-generation
multimodal
synchronized-audio-video
reference-to-audio-video
Instructions to use MiniMaxAI/MiniMax-H3 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use MiniMaxAI/MiniMax-H3 with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("MiniMaxAI/MiniMax-H3", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Notebooks
- Google Colab
- Kaggle
Point component loading specs at this repository
Browse files- modular_model_index.json +9 -9
modular_model_index.json
CHANGED
|
@@ -10,7 +10,7 @@
|
|
| 10 |
"transformers",
|
| 11 |
"Qwen3VLForConditionalGeneration"
|
| 12 |
],
|
| 13 |
-
"pretrained_model_name_or_path": "
|
| 14 |
"subfolder": "text_encoder",
|
| 15 |
"variant": null,
|
| 16 |
"revision": null
|
|
@@ -24,7 +24,7 @@
|
|
| 24 |
"transformers",
|
| 25 |
"Qwen2TokenizerFast"
|
| 26 |
],
|
| 27 |
-
"pretrained_model_name_or_path": "
|
| 28 |
"subfolder": "tokenizer",
|
| 29 |
"variant": null,
|
| 30 |
"revision": null
|
|
@@ -38,7 +38,7 @@
|
|
| 38 |
"transformers",
|
| 39 |
"Qwen3VLProcessor"
|
| 40 |
],
|
| 41 |
-
"pretrained_model_name_or_path": "
|
| 42 |
"subfolder": "processor",
|
| 43 |
"variant": null,
|
| 44 |
"revision": null
|
|
@@ -52,7 +52,7 @@
|
|
| 52 |
"diffusers",
|
| 53 |
"AutoencoderKLMiniMaxH3"
|
| 54 |
],
|
| 55 |
-
"pretrained_model_name_or_path": "
|
| 56 |
"subfolder": "vae",
|
| 57 |
"variant": null,
|
| 58 |
"revision": null
|
|
@@ -66,7 +66,7 @@
|
|
| 66 |
"diffusers",
|
| 67 |
"AutoencoderKLMiniMaxH3Audio"
|
| 68 |
],
|
| 69 |
-
"pretrained_model_name_or_path": "
|
| 70 |
"subfolder": "audio_vae",
|
| 71 |
"variant": null,
|
| 72 |
"revision": null
|
|
@@ -80,7 +80,7 @@
|
|
| 80 |
"diffusers",
|
| 81 |
"MiniMaxH3Transformer3DModel"
|
| 82 |
],
|
| 83 |
-
"pretrained_model_name_or_path": "
|
| 84 |
"subfolder": "transformer",
|
| 85 |
"variant": null,
|
| 86 |
"revision": null
|
|
@@ -94,7 +94,7 @@
|
|
| 94 |
"diffusers",
|
| 95 |
"MiniMaxH3Transformer3DModel"
|
| 96 |
],
|
| 97 |
-
"pretrained_model_name_or_path": "
|
| 98 |
"subfolder": "transformer_ref",
|
| 99 |
"variant": null,
|
| 100 |
"revision": null
|
|
@@ -108,7 +108,7 @@
|
|
| 108 |
"diffusers",
|
| 109 |
"MiniMaxH3Scheduler"
|
| 110 |
],
|
| 111 |
-
"pretrained_model_name_or_path": "
|
| 112 |
"subfolder": "scheduler",
|
| 113 |
"variant": null,
|
| 114 |
"revision": null
|
|
@@ -122,7 +122,7 @@
|
|
| 122 |
"diffusers",
|
| 123 |
"MiniMaxH3Scheduler"
|
| 124 |
],
|
| 125 |
-
"pretrained_model_name_or_path": "
|
| 126 |
"subfolder": "audio_scheduler",
|
| 127 |
"variant": null,
|
| 128 |
"revision": null
|
|
|
|
| 10 |
"transformers",
|
| 11 |
"Qwen3VLForConditionalGeneration"
|
| 12 |
],
|
| 13 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 14 |
"subfolder": "text_encoder",
|
| 15 |
"variant": null,
|
| 16 |
"revision": null
|
|
|
|
| 24 |
"transformers",
|
| 25 |
"Qwen2TokenizerFast"
|
| 26 |
],
|
| 27 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 28 |
"subfolder": "tokenizer",
|
| 29 |
"variant": null,
|
| 30 |
"revision": null
|
|
|
|
| 38 |
"transformers",
|
| 39 |
"Qwen3VLProcessor"
|
| 40 |
],
|
| 41 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 42 |
"subfolder": "processor",
|
| 43 |
"variant": null,
|
| 44 |
"revision": null
|
|
|
|
| 52 |
"diffusers",
|
| 53 |
"AutoencoderKLMiniMaxH3"
|
| 54 |
],
|
| 55 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 56 |
"subfolder": "vae",
|
| 57 |
"variant": null,
|
| 58 |
"revision": null
|
|
|
|
| 66 |
"diffusers",
|
| 67 |
"AutoencoderKLMiniMaxH3Audio"
|
| 68 |
],
|
| 69 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 70 |
"subfolder": "audio_vae",
|
| 71 |
"variant": null,
|
| 72 |
"revision": null
|
|
|
|
| 80 |
"diffusers",
|
| 81 |
"MiniMaxH3Transformer3DModel"
|
| 82 |
],
|
| 83 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 84 |
"subfolder": "transformer",
|
| 85 |
"variant": null,
|
| 86 |
"revision": null
|
|
|
|
| 94 |
"diffusers",
|
| 95 |
"MiniMaxH3Transformer3DModel"
|
| 96 |
],
|
| 97 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 98 |
"subfolder": "transformer_ref",
|
| 99 |
"variant": null,
|
| 100 |
"revision": null
|
|
|
|
| 108 |
"diffusers",
|
| 109 |
"MiniMaxH3Scheduler"
|
| 110 |
],
|
| 111 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 112 |
"subfolder": "scheduler",
|
| 113 |
"variant": null,
|
| 114 |
"revision": null
|
|
|
|
| 122 |
"diffusers",
|
| 123 |
"MiniMaxH3Scheduler"
|
| 124 |
],
|
| 125 |
+
"pretrained_model_name_or_path": "MiniMaxAI/MiniMax-H3",
|
| 126 |
"subfolder": "audio_scheduler",
|
| 127 |
"variant": null,
|
| 128 |
"revision": null
|