Spraakdataset

VS Japanse dataset

Hoogwaardige dataset met Amerikaans-Japanse callcenters en uitingsdata voor AI- en spraakmodellen

VS Japanse dataset

Overzicht

  • TaalVS Japans
  • DatasettypenCallcenter, Uiting
  • Land

Beschrijving

Deze dataset bevat niet-gescripte synthetische telefoongesprekken tussen agenten en klanten (5–15 minuten) en een Utterance Dataset met korte spraakopnames. Deze dataset biedt gedetailleerde gegevens voor het trainen en evalueren van spraak- en taalmodellen.

Hoogtepunten van de dataset

  • TaalVS Japans
  • Sample Rate8 kHz
  • Uren in totaal4:05:42
  • Sprekers14+
  • KanalenDubbel
  • Duurbereik5 - 15 minuten

Gebruikers verhalen

  • ASR (automatische spraakherkenning)
  • Virtuele assistenten en chatbots
  • Conversationele AI
  • Spraakanalyse
  • TTS (tekst-naar-spraak)
  • Taalmodellering

Specificaties van de voorbeeldgegevensset

GegevenssettypeCall Centeruiting
Sampling Rate8 kHz8 kHz
Sprekers2-Sprekers2-Sprekers
KanaalDubbelDubbel
Uren in totaal02:02:5102:02:51
Totaal aantal sprekers122

Belangrijkste voordelen

  • Divers en representatiefEen breed scala aan sprekers over inclusieve, praktijkgerichte AI.
  • Hoogwaardige audioZuivere, evenwichtige opnames voor betrouwbare modelprestaties.
  • Klaar voor AI/MLGestructureerd en van aantekeningen voorzien voor naadloze integratie.
  • Schaalbaar en flexibelDiverse duur, sprekers en thema's beschikbaar, afgestemd op uw behoeften.

Uitgelichte klanten

Vertrouwd door toonaangevende AI-teams en bedrijven wereldwijd.

  • Microsoft
  • Amazon Web Services
  • Google

Kunt u niet vinden wat u zoekt?

Er worden nieuwe kant-en-klare datasets verzameld voor alle datatypen

Neem nu contact met ons op om uw zorgen over het verzamelen van audio-/spraaktrainingsgegevens los te laten

  • Dit veld is voor de validatie doeleinden en moet onveranderd worden gelaten.
  • Door te registreren ga ik akkoord met Shaip Privacybeleid en Algemene Voorwaarden en geef mijn toestemming om B2B-marketingcommunicatie van Shaip te ontvangen.