| Name des Datensatzes | Aufnahmegerät | Daten Größe | Spezifikationen |
| 2 Stunden - 4 Länder Englischer Sprachsynthesekorpus | Mikrofon | 2 Stunden, 4 Personen | Personen: 4 Personen aus Amerika, Großbritannien, Australien, Neuseeland Format : 48,000Hz, 24bit, unkomprimiertes WAV, Monokanal; Aufnahmeumgebung: professionelles Tonstudio |
| 20 Stunden - Frankreich Französisch Lesen & Konversation Sprachdaten per Handy | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Portugal Sprache : Portugiesisch; Merkmale der Annotation : Transkriptionstext; Accuracy Rate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %. |
| 20 Stunden - Deutsche Lese- und Konversationsdaten per Mobiltelefon | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Deutschland Sprache : Deutsch; Merkmale der Annotation : Transkriptionstext; Accuracy Rate : Wort-Genauigkeits-Rate (WAR) beträgt mindestens 97% |
| 20 Stunden - Italienische Lese- und Konversationsdaten per Mobiltelefon | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Italien Sprache : Italienisch; Merkmale der Annotation : Transkriptionstext; Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %. |
| 20 Stunden - Spanien Spanisch Lesen & Konversation Sprachdaten per Handy | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Spanien Sprache : Spanisch; Merkmale der Annotation : Transkriptionstext; Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %. |
| 20 Stunden - Europäisches Portugiesisch Lese- und Konversationsdaten per Mobiltelefon | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Portugal Sprache : Portugiesisch; Merkmale der Annotation : Transkriptionstext; Accuracy Rate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %. |
| 20 Stunden - Japanisch Lesen & Konversationsdaten per Mobiltelefon | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Japan Sprache : Japanisch; Merkmale der Anmerkung : Transkriptionstext; Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %. |
| 20 Stunden - Koreanische Lese- und Konversationsdaten per Mobiltelefon | Mobiltelefon | 20 Stunden | Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Korea Sprache : Koreanisch; Merkmale der Annotation : Transkriptionstext; Genauigkeitsrate : Wort-Genauigkeits-Rate (WAR) beträgt mindestens 97% |
| 10 Stunden - Paschtu-Gesprächsdaten per Telefon | Telefon | 10 Stunden | Format : 8kHz 8bit, a-law/u-law pcm, mono channel Inhaltskategorie : Dialog basierend auf vorgegebenen Themen Aufnahmebedingungen : Geringe Hintergrundgeräusche (in Innenräumen) Aufnahmegerät : Telefonie Land : Afghanistan(AFG) Sprache(Region) Code : ps-AF Sprache : Paschtu Sprecher : 224 Personen insgesamt, 92% männlich und 8% weiblich Merkmale der Annotation : Transkriptionstext, Zeitstempel, Sprecher-ID, Geschlecht Genauigkeitsrate : Wortgenauigkeitsrate (WAR) 95% Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 95%. |
Hinweis: Bitte bewerben Sie sich für Datensätze, die Ihrem Forschungsgebiet angemessen sind. Die maximale Anzahl von Bewerbungen für Computer Vision-Datensätze beträgt 4 Sätze.