Spraakdataset

Telugu-gegevensset

తెలుగు డేటాసెట్

Hoogwaardige Telugu callcenter-, algemene conversatie-, gescripte monoloog- en mediadataset (podcast) voor AI- en spraakmodellen

Telugu-gegevensset

Overzicht

  • TaalTelugu
  • DatasettypenCallcenter, algemeen gesprek, podcast, gescripte monoloog
  • LandIndia

Beschrijving

Deze dataset bevat niet-gescripte synthetische gesprekken tussen agenten en klanten (5-15 minuten), natuurlijke telefoongesprekken tussen mensen (15-60 minuten) en mediadata met transcripties. Daarmee worden uiteenlopende spraakgegevens geboden voor het trainen en evalueren van spraak- en taaltechnologieën.

Hoogtepunten van de dataset

  • TaalTelugu
  • Sample Rate16 kHz / 24 kHz / 8 kHz
  • Uren in totaal3083:04:59
  • Sprekers3,327+
  • KanalenDubbel / Mono
  • Duurbereik5 - 60 minuten

Gebruikers verhalen

  • ASR (automatische spraakherkenning)
  • Virtuele assistenten en chatbots
  • Conversationele AI
  • Spraakanalyse
  • TTS (tekst-naar-spraak)
  • Taalmodellering

Specificaties van de voorbeeldgegevensset

GegevenssettypeCall CenterAlgemeen gesprekMediagegevensMonoloog met script
Sampling Rate8 kHz8 kHz16 kHz24 kHz
Sprekers2-Sprekers2-SprekersMeerdere luidsprekersEnkele luidspreker
KanaalDubbelDubbelMonoMono
Uren in totaal62:32:27654:08:03666:24:291,700:00:00
Totaal aantal sprekers4961,6011,230Op aanvraag

Belangrijkste voordelen

  • Divers en representatiefEen breed scala aan sprekers over inclusieve, praktijkgerichte AI.
  • Hoogwaardige audioZuivere, evenwichtige opnames voor betrouwbare modelprestaties.
  • Klaar voor AI/MLGestructureerd en van aantekeningen voorzien voor naadloze integratie.
  • Schaalbaar en flexibelDiverse duur, sprekers en thema's beschikbaar, afgestemd op uw behoeften.

Uitgelichte klanten

Vertrouwd door toonaangevende AI-teams en bedrijven wereldwijd.

  • Microsoft
  • Amazon Web Services
  • Google

Kunt u niet vinden wat u zoekt?

Er worden nieuwe kant-en-klare datasets verzameld voor alle datatypen

Neem nu contact met ons op om uw zorgen over het verzamelen van audio-/spraaktrainingsgegevens los te laten

  • Dit veld is voor de validatie doeleinden en moet onveranderd worden gelaten.
  • Door te registreren ga ik akkoord met Shaip Privacybeleid en Algemene Voorwaarden en geef mijn toestemming om B2B-marketingcommunicatie van Shaip te ontvangen.