← Back to explorer

X-Voice-Dataset-Train

Type
dataset
Venue
XRXRX
Year
2026
Source
huggingface
Access
free
Language
bg, cs, da, de, el, en, es, et, fr, fi, hu, hr, id, it, ja, ko, lt, lv, mt, nl, pl, pt, ro, ru, sk, sl, sv, th, vi, zh
Added
2026-07-17T20:02:31.863859+00:00
Verified
2026-07-17T20:02:31.863859+00:00

Summary

The X-Voice training dataset is a **large-scale multilingual speech corpus** curated for high-performance speech models. It provides a robust foundation for cross-lingual phonetic and prosodic modeling.

Keywords

hf-dataset speech---tts · -speech---asr webdataset audio text datasets mlcroissant

Topics

Speech / TTS, Speech / ASR

Research notes

  • downloads=32962; likes=10