L2P - Z-Image 6B Pixel-Space
🎨
64
End-to-end pixel-space 6B diffusion via L2P
FireRed-Image-Edit × Qwen-Image-Edit-Rapid (Transformers)
High-quality voice cloning TTS for 600+ languages
Run {1, 1.58}-bit Bonsai LLMs on GPUs
Text-to-video with Reward Forcing
Portrait animation & lipsync with LTX 2.3
VFig converts any diagram image into editable SVG code.
Transcribe audio clips to text in multiple languages
Generate speech from text using voice design, cloning or presets
PaddleOCR-VL-1.5_Online_Demo
Generate images from text prompts or edit photos with AI