Spraakdataset

Kannada-gegevensset

ಕನ್ನಡಡೇಟಾಸೆಟ್

Hoogwaardige Kannada-dataset voor callcenters, algemene gesprekken, gescripte monologen en media (podcasts) voor AI- en spraakmodellen

Kannada-gegevensset

Overzicht

  • TaalKannada
  • DatasettypenCallcenter, algemeen gesprek, podcast, gescripte monoloog
  • LandIndia

Beschrijving

Deze dataset bevat niet-gescripte synthetische telefoongesprekken tussen agenten en klanten (5–15 minuten), licentieerbare audio- of videobestanden in het publieke domein, zoals interviews en podcasts met 1 tot 5 deelnemers (15–60 minuten) en gescripte monologen waarin één spreker vooraf gedefinieerde inhoud levert voor het trainen en evalueren van spraak- en taalmodellen.

Hoogtepunten van de dataset

  • TaalKannada
  • Sample Rate16 kHz / 24 kHz / 8 kHz
  • Uren in totaal911:11:05
  • Sprekers10,546+
  • KanalenDubbel / Mono
  • Duurbereik5 - 60 minuten

Gebruikers verhalen

  • ASR (automatische spraakherkenning)
  • Virtuele assistenten en chatbots
  • Conversationele AI
  • Spraakanalyse
  • TTS (tekst-naar-spraak)
  • Taalmodellering

Specificaties van de voorbeeldgegevensset

GegevenssettypeCall CenterCall CenterAlgemeen gesprekMediagegevensMonoloog met script
Sampling Rate8 kHz16 kHz8 kHz16 kHz24 kHz
Sprekers2-Sprekers2-Sprekers2-SprekersMeerdere luidsprekersEnkele luidspreker
KanaalDubbelMonoDubbelMonoMono
Uren in totaal59:57:02195:26:56141:27:1514:19:52500:00:00
Totaal aantal sprekers4949,504424124Op aanvraag

Belangrijkste voordelen

  • Divers en representatiefEen breed scala aan sprekers over inclusieve, praktijkgerichte AI.
  • Hoogwaardige audioZuivere, evenwichtige opnames voor betrouwbare modelprestaties.
  • Klaar voor AI/MLGestructureerd en van aantekeningen voorzien voor naadloze integratie.
  • Schaalbaar en flexibelDiverse duur, sprekers en thema's beschikbaar, afgestemd op uw behoeften.

Uitgelichte klanten

Vertrouwd door toonaangevende AI-teams en bedrijven wereldwijd.

  • Microsoft
  • Amazon Web Services
  • Google

Kunt u niet vinden wat u zoekt?

Er worden nieuwe kant-en-klare datasets verzameld voor alle datatypen

Neem nu contact met ons op om uw zorgen over het verzamelen van audio-/spraaktrainingsgegevens los te laten

  • Dit veld is voor de validatie doeleinden en moet onveranderd worden gelaten.
  • Door te registreren ga ik akkoord met Shaip Privacybeleid en Algemene Voorwaarden en geef mijn toestemming om B2B-marketingcommunicatie van Shaip te ontvangen.