We create speech datasets including transcripts for machine learning purposes. Our service is used for technologies looking to create or improve existing automatic speech recognition models (ASR) using natural language processing (NLP) for select languages and various domains.
Each dataset can be created according to dialect, demographics, domain or any other required conditions.
Speech datasets for select languages and industries are available, or bespoke speech collection projects available on request.