Overview of Amphion Toolkit
mainAmphion is an open-source toolkit designed for Audio, Music, and Speech Generation research and development. It aims to provide a platform for converting various inputs into audio and supports reproducible research through model visualizations.
Key supported generation tasks include:
- TTS: Text to Speech
- SVS: Singing Voice Synthesis
- VC: Voice Conversion
- AC: Accent Conversion
- SVC: Singing Voice Conversion
- TTA: Text to Audio
- TTM: Text to Music (currently under development)
The toolkit also provides vocoders for high-quality audio signal production and evaluation metrics for consistent performance measurement in generation tasks.