Endspurt für neues „neutrales“ Dataset
Aber es gibt doch schon ein „neutrales“ Thorsten-Dataset – wozu noch eins?
Stimmt. Aber als ich das erste neutrale Dataset aufgenommen habe, war ich etwas naiv. So habe ich beispielsweise die Aufnahmen mit einem schlechten Audio-Setup begonnen. Das wurde zwar dank Dominiks Audio-Optimierungsfähigkeiten verbessert, war aber trotzdem etwas ärgerlich. Außerdem wollte ich so klar und deutlich wie möglich lesen — das ist mir zwar gelungen, aber dadurch ist der natürliche Sprachfluss etwas verloren gegangen. Basierend auf meinen Erfahrungen wollte ich ein „besseres“ neutrales Dataset aufnehmen.
Und wo ist dieses fabelhafte neue Dataset? Noch in Arbeit. Ich plane ca. 11 Stunden reines Audio im Dataset zu haben. Aktuell bin ich bei ca. 9 Stunden — einige Minuten fallen bestimmt auch der Nachbearbeitung zum Opfer. Also, so Pi mal Daumen, fehlen noch gute 2 Stunden Audio — und daran bin ich aktuell dran.
Ich hoffe, dass ich das neue Dataset Anfang 2022 veröffentlichen kann. Weitere Details folgen zu gegebener Zeit.
Bis dahin dürft ihr euch gerne meine beiden bisherigen Datasets anschauen bzw. anhören: Thorsten (neutral) und Thorsten (emotional). Details zu den veröffentlichten Datasets findet ihr hier.