Taledatasæt

Wake Word koreansk datasæt

Koreansk datasæt

Koreansk Wake Word-datasæt af høj kvalitet til AI- og talemodeller

Wake Word koreansk datasæt

Oversigt

  • Sprogkoreansk
  • DatasættyperWake Word / Keyphrase
  • Landkoreansk

Beskrivelse

Indsamling af data til aktiveringsord / Stemmekommando / Triggerord / Nøglefrase 50 talere 4 unikke nøglefraser pr. taler 10 lydfiler pr. unik nøglefrase 40 samlede optagede ytringer pr. taler

Datasæt højdepunkter

  • Sprogkoreansk
  • Prøvefrekvens16 kHz
  • Samlede timer2,000 lydbånd
  • Højttalere50 +
  • Kanaler1 kanal

Brug cases

  • Detektion af vågne ord
  • Stemmekommando og udløser
  • Søgeordspotting
  • Håndfri aktivering
  • Stemmegrænseflade på enheden

Specifikationer for eksempeldatasæt

DatasættypeWake Word
Sampling Rate16 kHz
Højttalere50 højttalere
Kanal1 kanal
Samlede timer2,000 lydbånd
Samlet antal talere50

Fordele

  • Mangfoldig og repræsentativBred dækning af talere for inkluderende, virkelighedsnær AI.
  • Lyd af høj kvalitetRene, afbalancerede optagelser for pålidelig modelydelse.
  • Klar til AI/MLStruktureret og kommenteret for problemfri integration.
  • Skalerbar og fleksibelFlere varigheder, talere og domæner, der passer til dine behov.

Tekniske detaljer

  • OptageplatformMobile App
  • Lyd Format. Wav
  • Transskriptionsformat.json
  • WER (%)5
  • KønsfordelingKvinder 50 %, mænd 50 %
  • Aldersspænd18-50

Fremhævede klienter

Tillid fra førende AI-teams og virksomheder verden over.

  • microsoft
  • Amazon Web Services
  • Google

Kan du ikke finde det, du leder efter?

Nye hyldedatasæt bliver indsamlet på tværs af alle datatyper

Kontakt os nu for at give slip på dine bekymringer om dataindsamling af lyd/taletræning

  • Dette felt er til validering og bør overlades uændret.
  • Ved tilmelding er jeg enig med Shaip Privatlivspolitik og Servicevilkår og give mit samtykke til at modtage B2B marketingkommunikation fra Shaip.