X-Voice-Dataset-Train
- Type
- dataset
- Venue
- XRXRX
- Year
- 2026
- Source
- huggingface
- Access
- free
- Language
- bg, cs, da, de, el, en, es, et, fr, fi, hu, hr, id, it, ja, ko, lt, lv, mt, nl, pl, pt, ro, ru, sk, sl, sv, th, vi, zh
- Added
- 2026-07-17T20:02:31.863859+00:00
- Verified
- 2026-07-17T20:02:31.863859+00:00
Summary
The X-Voice training dataset is a **large-scale multilingual speech corpus** curated for high-performance speech models. It provides a robust foundation for cross-lingual phonetic and prosodic modeling.
Keywords
hf-dataset speech---tts · -speech---asr webdataset audio text datasets mlcroissant
Topics
Speech / TTS, Speech / ASR
Research notes
- downloads=32962; likes=10