Taledatasæt

Russisk datasæt

Русский набор данных

Russisk musik af høj kvalitet, datasæt med manuskriptmonologer til AI og talemodeller

Russisk datasæt

Oversigt

  • Sprogrussisk
  • DatasættyperManuskriptmonolog, sanglyd
  • LandRusland

Beskrivelse

Dette datasæt indeholder sanglyd med transskriptioner og manuskriptbaserede monologer, hvor en enkelt taler leverer foruddefineret indhold og leverer forskelligartede data af høj kvalitet til træning og evaluering af tale- og sprogteknologier.

Datasæt højdepunkter

  • Sprogrussisk
  • Prøvefrekvens24 kHz / 48 kHz
  • Samlede timer2902:41:15
  • Højttalere3,856 +
  • KanalerMono

Brug cases

  • ASR (Automatisk talegenkendelse)
  • Virtuelle assistenter og chatbots
  • Samtaler AI
  • Taleanalyse
  • TTS (Tekst-til-tale)
  • Sprogmodellering

Specifikationer for eksempeldatasæt

DatasættypeMusicManuskriptmonologManuskriptmonolog
Sampling Rate48 kHz24 kHz48 kHz
HøjttalereEnkel højttalerEnkel højttalerEnkel højttaler
KanalMonoMonoMono
Samlede timer05:41:15500:00:002,397:00:00
Samlet antal talere11På forespørgsel3,845

Fordele

  • Mangfoldig og repræsentativBred dækning af talere for inkluderende, virkelighedsnær AI.
  • Lyd af høj kvalitetRene, afbalancerede optagelser for pålidelig modelydelse.
  • Klar til AI/MLStruktureret og kommenteret for problemfri integration.
  • Skalerbar og fleksibelFlere varigheder, talere og domæner, der passer til dine behov.

Fremhævede klienter

Tillid fra førende AI-teams og virksomheder verden over.

  • microsoft
  • Amazon Web Services
  • Google

Kan du ikke finde det, du leder efter?

Nye hyldedatasæt bliver indsamlet på tværs af alle datatyper

Kontakt os nu for at give slip på dine bekymringer om dataindsamling af lyd/taletræning

  • Dette felt er til validering og bør overlades uændret.
  • Ved tilmelding er jeg enig med Shaip Privatlivspolitik og Servicevilkår og give mit samtykke til at modtage B2B marketingkommunikation fra Shaip.