Taledatasæt

Kinesisk forenklet datasæt

简体中文数据集

Kinesisk af høj kvalitet forenkler TTS-datasæt til kunstig intelligens og talemodeller

Kinesisk forenklet datasæt

Oversigt

  • SprogForenklet kinesisk
  • DatasættyperTTS
  • LandKina

Beskrivelse

Optagelser med enkelt ytring, som har tendens til at falde i intervallet 5 til 30 sekunder.

Datasæt højdepunkter

  • SprogForenklet kinesisk
  • Prøvefrekvens48 kHz
  • Samlede timer2,762 timer
  • Højttalere3,725 +
  • KanalerMono

Brug cases

  • ASR (Automatisk talegenkendelse)
  • Virtuelle assistenter og chatbots
  • Samtaler AI
  • Taleanalyse
  • TTS (Tekst-til-tale)
  • Sprogmodellering

Specifikationer for eksempeldatasæt

DatasættypeTTS
Sampling Rate48 kHz
Højttalere3,725 højttalere
KanalMono
Samlede timer2,762 timer
Samlet antal talere3,725

Fordele

  • Mangfoldig og repræsentativBred dækning af talere for inkluderende, virkelighedsnær AI.
  • Lyd af høj kvalitetRene, afbalancerede optagelser for pålidelig modelydelse.
  • Klar til AI/MLStruktureret og kommenteret for problemfri integration.
  • Skalerbar og fleksibelFlere varigheder, talere og domæner, der passer til dine behov.

Tekniske detaljer

  • OptageplatformMobile App
  • Lyd Format. Wav
  • Transskriptionsformat.json
  • WER (%)5
  • KønsfordelingKvinde 1,920, Mand 1,535, Ukendt 270
  • Aldersspænd18-50

Fremhævede klienter

Tillid fra førende AI-teams og virksomheder verden over.

  • microsoft
  • Amazon Web Services
  • Google

Kan du ikke finde det, du leder efter?

Nye hyldedatasæt bliver indsamlet på tværs af alle datatyper

Kontakt os nu for at give slip på dine bekymringer om dataindsamling af lyd/taletræning

  • Dette felt er til validering og bør overlades uændret.
  • Ved tilmelding er jeg enig med Shaip Privatlivspolitik og Servicevilkår og give mit samtykke til at modtage B2B marketingkommunikation fra Shaip.