Image-Text-to-Video
Diffusers
Safetensors
text-to-video
image-to-video
video-to-video
text-to-audio-video
image-to-audio-video
image-text-to-audio-video
video-to-audio-video
audio-to-audio-video
audio-video-generation
multimodal
synchronized-audio-video
reference-to-audio-video
Instructions to use MiniMaxAI/MiniMax-H3 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use MiniMaxAI/MiniMax-H3 with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("MiniMaxAI/MiniMax-H3", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Notebooks
- Google Colab
- Kaggle
File size: 764 Bytes
5d9b308 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 | # SPDX-License-Identifier: Apache-2.0
# Module helpers for the MiniMax H3 visual VAE (inference-only bundle).
def apply_spatial_parallel(module, enabled, chunk_dim=-1):
from .conv import SpatialParallelConv3d
from .norm import FusedGroupNorm3D, SpatialParallelGroupNorm
if hasattr(module, "set_spatial_parallel"):
module.set_spatial_parallel(enabled)
for m in module.modules():
if enabled and isinstance(m, FusedGroupNorm3D):
raise NotImplementedError("FusedGroupNorm3D is incompatible with SP")
if isinstance(m, SpatialParallelGroupNorm):
m.spatial_parallel = enabled
elif isinstance(m, SpatialParallelConv3d):
m.spatial_parallel = enabled
m.chunk_dim = chunk_dim
|