YODAS v3: Mehr als eine Million Stunden Sprache für offene Audiomodelle
ESPnet stellt einen großen offenen Sprachdatensatz mit mehrkanaligem Audio bereit. Was die Daten für Spracherkennung und Audiogenerierung leisten – und wo ihre Grenzen liegen.
YODAS v3: Mehr als eine Million Stunden Sprache für offene Audiomodelle Weiterlesen »


