Kannada-datasett

ಕನ್ನಡ ಡೇಟಾಸೆಟ್

Kannada-kundesenterdatasett av høy kvalitet, generelle samtaler, manusbaserte monologer og mediedatasett (podkaster) for AI- og talemodeller

Oversikt

Tittel (språk)

Kannada-språkdatasett

Datasetttyper

Kundesenter, Generell samtale, Mediedata, Skriptet monolog

Land

India

Tekniske beskrivelser

Dette datasettet inkluderer uskriptede telefonsamtaler mellom syntetiske agenter og kunder (5–15 minutter), lisensierbare lyd- eller videofiler i offentlig eiendom, for eksempel intervjuer og podkaster med 1 til 5 deltakere (15–60 minutter), og skriptede monologer der én enkelt taler leverer forhåndsdefinert innhold for trening og evaluering av tale- og språkmodeller.

Bruk sak

ASR, Virtual Assistant, Chatbot, Conversational AI, Speech Analytics, TTS, Language Modeling

Datasettdetaljer

Datasettype Sampling Rate Høyttalere Kanal Totalt antall timer Totalt antall høyttalere
Call Center 8 kHz 2 høyttalere dual 59:57:02 494
Call Center 16 kHz 2 høyttalere Mono 195:26:56 9,504
Generell samtale 8 kHz 2 høyttalere dual 141:27:15 424
Mediedata 16 kHz Flere høyttalere Mono 14:19:52 124
Manuskriptmonolog 24 kHz Enkelt høyttaler Mono 500:00:00 På forespørsel

Utvalgte klienter

Gir teamene mulighet til å bygge verdensledende AI-produkter.

Amazon
Google
Microsoft
Shaip kontakt oss

Finner du ikke det du leter etter?

Nye hylledatasett samles inn på tvers av alle datatyper

Kontakt oss nå for å gi slipp på bekymringene for innsamling av lyd-/taletreningsdata

  • Dette feltet er for validering formål og bør stå uendret.
  • Ved å registrere meg godtar jeg Shaip Personvernerklæring og Våre vilkår og gi mitt samtykke til å motta B2B-markedsføringskommunikasjon fra Shaip.