Spraakdataset

Koreaanse dataset

Gebruik het apparaat

Hoogwaardige Koreaanse callcenter-, scripted monoloog- en media- (podcast) dataset voor AI- en spraakmodellen

Koreaanse dataset

Overzicht

  • TaalKorean
  • DatasettypenCallcenter, podcast, gescripte monoloog
  • LandKorea

Beschrijving

Deze dataset bevat niet-gescripte synthetische telefoongesprekken tussen agenten en klanten (5–15 minuten), licentieerbare audio-/videobestanden in het publieke domein, zoals interviews en podcasts met 1 tot 5 deelnemers (15–60 minuten) en gescripte monologen met één spreker die vooraf gedefinieerde inhoud levert voor spraak- en taalmodeltraining.

Hoogtepunten van de dataset

  • TaalKorean
  • Sample Rate16 kHz / 24 kHz / 48 kHz / 8 kHz
  • Uren in totaal2761:14:49
  • Sprekers1,641+
  • KanalenDubbel / Mono
  • Duurbereik5 - 60 minuten

Gebruikers verhalen

  • ASR (automatische spraakherkenning)
  • Virtuele assistenten en chatbots
  • Conversationele AI
  • Spraakanalyse
  • TTS (tekst-naar-spraak)
  • Taalmodellering

Specificaties van de voorbeeldgegevensset

GegevenssettypeCall CenterMediagegevensMonoloog met scriptMonoloog met script
Sampling Rate8 kHz16 kHz24 kHz48 kHz
Sprekers2-SprekersMeerdere luidsprekersEnkele luidsprekerEnkele luidspreker
KanaalDubbelMonoMonoMono
Uren in totaal102:27:55203:46:54500:00:001,955:00:00
Totaal aantal sprekers1,244397Op aanvraagOp aanvraag

Belangrijkste voordelen

  • Divers en representatiefEen breed scala aan sprekers over inclusieve, praktijkgerichte AI.
  • Hoogwaardige audioZuivere, evenwichtige opnames voor betrouwbare modelprestaties.
  • Klaar voor AI/MLGestructureerd en van aantekeningen voorzien voor naadloze integratie.
  • Schaalbaar en flexibelDiverse duur, sprekers en thema's beschikbaar, afgestemd op uw behoeften.

Uitgelichte klanten

Vertrouwd door toonaangevende AI-teams en bedrijven wereldwijd.

  • Microsoft
  • Amazon Web Services
  • Google

Kunt u niet vinden wat u zoekt?

Er worden nieuwe kant-en-klare datasets verzameld voor alle datatypen

Neem nu contact met ons op om uw zorgen over het verzamelen van audio-/spraaktrainingsgegevens los te laten

  • Dit veld is voor de validatie doeleinden en moet onveranderd worden gelaten.
  • Door te registreren ga ik akkoord met Shaip Privacybeleid en Algemene Voorwaarden en geef mijn toestemming om B2B-marketingcommunicatie van Shaip te ontvangen.