stabilityai/stable-audio-3-optimized
Text-to-Audio • Updated • 21.2k • 51
Our vibrant communities consist of experts, leaders and partners across the globe. They are developing cutting-edge open AI models for Image, Language, Audio, Video, 3D and Biology.
4Director: Controlling Video World Models with Rigid 3D Geometry
SemanTok: Predictable Semantic Tokens for Efficient Autoregressive Video Generation