Taledatasæt

Wake Word hebraisk datasæt

Hebraisk Wake Word-datasæt af høj kvalitet til kunstig intelligens og talemodeller

Wake Word hebraisk datasæt

Oversigt

  • Sproghebraisk
  • DatasættyperWake Word / Keyphrase
  • Landhebraisk

Beskrivelse

Indsamling af data til opvågningsord / Stemmekommando / Triggerord / Nøglefrase 200 talere 3 unikke nøglefraser pr. taler 25-30 gentagne nøglefraseoptagelser pr. unik nøglefrase 25-30 lydfiler pr. unik nøglefrase 90 samlede optagede ytringer pr. taler

Datasæt højdepunkter

  • Sproghebraisk
  • Prøvefrekvens16 kHz
  • Samlede timer200 højttalere
  • Højttalere200 +
  • Kanaler1 kanal

Brug cases

  • Detektion af vågne ord
  • Stemmekommando og udløser
  • Søgeordspotting
  • Håndfri aktivering
  • Stemmegrænseflade på enheden

Specifikationer for eksempeldatasæt

DatasættypeWake Word
Sampling Rate16 kHz
Højttalere200 højttalere
Kanal1 kanal
Samlede timer200 højttalere
Samlet antal talere200

Fordele

  • Mangfoldig og repræsentativBred dækning af talere for inkluderende, virkelighedsnær AI.
  • Lyd af høj kvalitetRene, afbalancerede optagelser for pålidelig modelydelse.
  • Klar til AI/MLStruktureret og kommenteret for problemfri integration.
  • Skalerbar og fleksibelFlere varigheder, talere og domæner, der passer til dine behov.

Tekniske detaljer

  • OptageplatformMobile App
  • Lyd Format. Wav
  • Transskriptionsformat.json
  • WER (%)5
  • KønsfordelingKvinder 50 %, mænd 50 %
  • Aldersspænd18-50

Fremhævede klienter

Tillid fra førende AI-teams og virksomheder verden over.

  • microsoft
  • Amazon Web Services
  • Google

Kan du ikke finde det, du leder efter?

Nye hyldedatasæt bliver indsamlet på tværs af alle datatyper

Kontakt os nu for at give slip på dine bekymringer om dataindsamling af lyd/taletræning

  • Dette felt er til validering og bør overlades uændret.
  • Ved tilmelding er jeg enig med Shaip Privatlivspolitik og Servicevilkår og give mit samtykke til at modtage B2B marketingkommunikation fra Shaip.