Rethinking Automated Voice Similarity by Shifting from EER to Embedding Geometry
Paper • 2609.33999 • Published • 6
None defined yet.
Rethinking Automated Voice Similarity by Shifting from EER to Embedding Geometry
FdAudio: MeanFlow-Anchored Fréchet-Distance Post-Training for One-Step Text-to-Audio Generation