This is a collection of Tunisian dialect textual documents for Language Modeling.
It was used to train the Linto ASR in Tunisian dialect with code-switching capabilities linagora/linto-asr-ar-tn-0.1.
Dataset Summary
Dataset composition
Sources
Data Table
Data sources
Content Types
Languages and Dialects
Example use (python)
License
Citations
Dataset Summary