Please fill in your name

Mobile phone format error

Bitte geben Sie die Telefonnummer ein!

Bitte geben Sie den Namen Ihres Unternehmens ein

Bitte geben Sie Ihre Unternehmens-E-Mail-Adresse ein

Bitte geben Sie die Datenanforderung ein

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

Die Datenanforderung darf nicht weniger als 5 Wörter enthalten und darf keine reinen Zahlen sein.

Offene Datensätze für die akademische Forschung

Nexdata hat das datengestützte KI-Forschungsprogramm für nicht-kommerzielle Organisationen weltweit, einschließlich Universitäten und akademische Einrichtungen, gestartet. Dieses Programm bietet wertvolle Trainingsdatensätze in den Bereichen Computer Vision, Spracherkennung und anderen Bereichen zur Unterstützung der akademischen KI-Forschung.

Spracherkennung Spracherkennung
Name des Datensatzes Aufnahmegerät Daten Größe Spezifikationen
2 Stunden - 4 Länder Englischer Sprachsynthesekorpus Mikrofon 2 Stunden, 4 Personen Personen: 4 Personen aus Amerika, Großbritannien, Australien, Neuseeland Format : 48,000Hz, 24bit, unkomprimiertes WAV, Monokanal; Aufnahmeumgebung: professionelles Tonstudio
20 Stunden - Frankreich Französisch Lesen & Konversation Sprachdaten per Handy Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Portugal Sprache : Portugiesisch; Merkmale der Annotation : Transkriptionstext; Accuracy Rate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %.
20 Stunden - Deutsche Lese- und Konversationsdaten per Mobiltelefon Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Deutschland Sprache : Deutsch; Merkmale der Annotation : Transkriptionstext; Accuracy Rate : Wort-Genauigkeits-Rate (WAR) beträgt mindestens 97%
20 Stunden - Italienische Lese- und Konversationsdaten per Mobiltelefon Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Italien Sprache : Italienisch; Merkmale der Annotation : Transkriptionstext; Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %.
20 Stunden - Spanien Spanisch Lesen & Konversation Sprachdaten per Handy Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Spanien Sprache : Spanisch; Merkmale der Annotation : Transkriptionstext; Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %.
20 Stunden - Europäisches Portugiesisch Lese- und Konversationsdaten per Mobiltelefon Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Portugal Sprache : Portugiesisch; Merkmale der Annotation : Transkriptionstext; Accuracy Rate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %.
20 Stunden - Japanisch Lesen & Konversationsdaten per Mobiltelefon Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Japan Sprache : Japanisch; Merkmale der Anmerkung : Transkriptionstext; Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 97 %.
20 Stunden - Koreanische Lese- und Konversationsdaten per Mobiltelefon Mobiltelefon 20 Stunden Format: 16kHz, 16bit, unkomprimiertes WAV, Monokanal; Aufnahmebedingungen: Geringe Hintergrundgeräusche (in Innenräumen), ohne Echo; Inhaltskategorie : Lesen, Konversation Aufnahmegerät : Android Smartphone, iPhone; Land : Korea Sprache : Koreanisch; Merkmale der Annotation : Transkriptionstext; Genauigkeitsrate : Wort-Genauigkeits-Rate (WAR) beträgt mindestens 97%
10 Stunden - Paschtu-Gesprächsdaten per Telefon Telefon 10 Stunden Format : 8kHz 8bit, a-law/u-law pcm, mono channel Inhaltskategorie : Dialog basierend auf vorgegebenen Themen Aufnahmebedingungen : Geringe Hintergrundgeräusche (in Innenräumen) Aufnahmegerät : Telefonie Land : Afghanistan(AFG) Sprache(Region) Code : ps-AF Sprache : Paschtu Sprecher : 224 Personen insgesamt, 92% männlich und 8% weiblich Merkmale der Annotation : Transkriptionstext, Zeitstempel, Sprecher-ID, Geschlecht Genauigkeitsrate : Wortgenauigkeitsrate (WAR) 95% Genauigkeitsrate : Die Wortgenauigkeitsrate (WAR) liegt bei mindestens 95%.
Hinweis: Bitte bewerben Sie sich für Datensätze, die Ihrem Forschungsgebiet angemessen sind. Die maximale Anzahl von Bewerbungen für Computer Vision-Datensätze beträgt 4 Sätze.

Antragsverfahren und Anweisungen

Gesponserten Datensatz auswählen

Gesponserten Datensatz auswählen

Das Formular abschicken

Das Formular abschicken

Warten auf Rückmeldung

Warten auf Rückmeldung

Datensatz empfangen

Datensatz empfangen

Gesponserten Datensatz beantragen

Mit dem Absenden erkläre ich mich mit der Datenlizenzvereinbarung einverstanden.

Kooperation Institution

Nexdata behält sich das Recht vor, die Open-Source-Datenaktivitäten zu interpretieren.

3fab39bb-4e95-4216-9446-bc36af67a18c

1af21b56-895a-4865-92a0-35a81586a59c