Malayalam-datasett

മലയാളം ഡാറ്റാസെറ്റ്

Høykvalitets malayalamsk generell samtale og podcastdatasett for AI og talemodeller

Oversikt

Tittel (språk)

Malayalam-språkdatasett

Datasetttyper

Generell samtale, mediedata (podkastdata)

Land

India

Tekniske beskrivelser

Dette datasettet inkluderer uskriptede syntetiske telefonsamtaler mellom en agent og en kunde (5–15 minutter) og lisensierbare lyd- eller videofiler i offentlig eiendom, for eksempel intervjuer og podkaster med 1 til 5 deltakere (15–60 minutter).

Bruk sak

ASR, Virtual Assistant, Chatbot, Conversational AI, Speech Analytics, TTS, Language Modeling

Datasettdetaljer

Datasettype Sampling Rate Høyttalere Kanal Totalt antall timer Totalt antall høyttalere
Generell samtale 8 kHz 2 høyttalere dual 70:46:30 576
Generell samtale 8 kHz 2 høyttalere dual 149:39:33 296
Mediedata 16 kHz Flere høyttalere Mono 12:39:24 81

Utvalgte klienter

Gir teamene mulighet til å bygge verdensledende AI-produkter.

Amazon
Google
Microsoft
Shaip kontakt oss

Finner du ikke det du leter etter?

Nye hylledatasett samles inn på tvers av alle datatyper

Kontakt oss nå for å gi slipp på bekymringene for innsamling av lyd-/taletreningsdata

  • Dette feltet er for validering formål og bør stå uendret.
  • Ved å registrere meg godtar jeg Shaip Personvernerklæring og Våre vilkår og gi mitt samtykke til å motta B2B-markedsføringskommunikasjon fra Shaip.