Google research veröffentlichte WAXAL, einen Open Source Datensatz für 27 afrikanische Sprachen, wodurch jetzt Trainingsdaten für entsprechende KI-Sprachmodelle zur Verfügung stehen. Der Datensatz enthält über 565 Stunden hochwertiges, phonetisch ausgewogenes Audiomaterial und kann so automatische Spracherkennung (Automated Speech Recognition, ASR) und Text-to-Speech (TTS) für afrikanische Sprachen durch entsprechend trainierte KI-Sprachmodelle ermöglichen.
Laut Google wurde der Datensatz in Kooperation mit verschiedenen afrikanischen Universitäten entwickelt, um die Erstellung natürlich klingender synthetischer Stimmen zu erleichtern. Genauer: Die Datenerfassung wurde vollständig von afrikanischen akademischen und kommunalen Organisationen unter Anleitung von Google-Experten für Datenerfassungspraktiken durchgeführt.
URLs:
- Bericht bei Google: https://research.goo … e-speech-technology/
- Dataset bei Huggingface: https://huggingface. … sets/google/WaxalNLP
- Forschungsbericht bei arXiv: https://arxiv.org/abs/2602.02734
