Cele mai de încredere servicii de colectare a datelor despre vorbire pentru IA dvs

Antrenați-vă modelele NLP, VA, prototipurile TTS și multe altele cu date conversaționale de calitate, cu serviciile noastre de colectare a datelor audio și de vorbire

Colectarea datelor despre vorbire
Țări
0 +
Ore de
Date de vorbire
0 +
Proiecte
0 +
Limbi (100+ dialecte)
0 +

8 / 16 / 44 / 48 kHz

Rata de eșantionare

Servicii profesionale de colectare a datelor audio/voce

Orice subiect. Orice scenariu.

La Shaip, expertiza noastră constă în crearea de seturi de date de vorbire de înaltă calitate, concepute pentru diverse cerințe AI/ML. Oferim o gamă extinsă de limbi și înregistrăm în diverse setări, făcând seturile noastre de date cuprinzătoare și adaptabile. Accentul nostru se pune pe furnizarea de modele cu cel mai mare volum de date de vorbire personalizate, în cel mai mic timp posibil. Cu noi la bord, vă puteți aștepta la: 

Culegere de vorbire
  • Date audio/voce multilingve de înaltă calitate pentru a îmbunătăți acuratețea
  • Cel mai înalt nivel posibil de specificitate a domeniului pentru a viza diverse configurații de scenarii
  • Scalați-vă modelul ML pentru a se potrivi cu diverse categorii demografice și verticale
  • Medii de înregistrare: Calitate studio, oferind un sunet clar, cu zgomot de fundal minim și Mediile naturale, unde înregistrările încorporează sunete ambientale pentru a imita situațiile din lumea reală.

Expertiza noastră

Aliniați datele audio la pentru modele NLP mai inteligente

Shaip oferă servicii de colectare de date de vorbire/audio de la capăt la capăt în peste 100 de limbi pentru a permite tehnologiilor activate de voce să răspundă unui set divers de public de pe tot globul. Putem lucra la proiecte de orice anvergură și dimensiune; de la acordarea de licențe a seturilor de date audio existente, până la gestionarea colecției de date audio personalizate, la transcrierea și adnotarea audio. Indiferent cât de mare este proiectul dvs. de colectare a datelor despre vorbire, putem personaliza serviciile de colectare audio pentru a se potrivi nevoilor dvs. pentru a construi seturi de date NLP de înaltă calitate care vizează dialectele, tonurile și limbile. Alegeți din gama noastră largă de seturi de date despre vorbire și resurse de colectare a datelor audio, pentru setări inteligente care permit vocea.

Discurs monolog

Monolog scenariu și discurs spontan

Se concentrează pe procesarea vorbirii de la un singur vorbitor. Utilizați instrucțiuni scriptate pentru a alimenta fișiere audio cu un singur canal, asigurând capturarea de modele de vorbire, tonuri și nuanțe unice specifice individului respectiv.

Discurs de dialog

Dialog scenariu și discurs spontan

Interacțiunea a două persoane, reproducând conversațiile și dialogurile din lumea reală cu expunere multilingvă prin fișiere cu două canale și resurse transcrise.

Conversații cu mai multe persoane

Grup / Muti-party
conversaţii

Discuții cu mai multe persoane, captarea dinamicii grupului, suprapuneri și tonuri variate, astfel încât să antreneze cu precizie modelele de vorbire.

Colecție de enunțuri cu cuvinte de trezire

Cuvânt de trezire / Expresie cheie / Colecție de expresii

Antrenați AI pentru a identifica fraze cheie sau cuvinte trezite sau enunțuri cu semnificații similare, folosind enunțuri diverse, bogate și autentice pentru procesarea și înțelegerea avansată a limbajului natural.

Discurs acustic

Date acustice
Colectie

Putem înregistra profesional date audio la calitate de studio, fie că este vorba de restaurante, birouri sau case sau din diverse medii și limbi, acoperind în același timp o gamă acustică mai largă (Seturi de date complete de sunet).

Recunoașterea automată a vorbirii

Recunoaștere automată a vorbirii (ASR)

Îmbunătățiți acuratețea sistemelor dvs. de recunoaștere automată a vorbirii (ASR) având acces la seturi de date audio/vorbire diversificate de ultimă generație, dintr-o gamă largă de date demografice.

Limbajul natural

Date de antrenament audio/vorbire multilingve

Profesioniștii noștri calificați în limbi străine din întreaga lume oferă date audio/vorbire multilingve în diferite limbi și dialecte. Acest efort încurajează comunicarea globală și depășește barierele lingvistice, contribuind la soluții AI mai incluzive și mai eficiente.

Asistenți virtuali digitali

Text-to-Speech
(TTS)

Construiți un model multilingv de text-to-speech (TTS) cu ajutorul forței noastre de muncă globale, care vă ajută să colectați date de vorbire în peste 150 de limbi și dialecte pentru a vă îmbunătăți modelele AI, de la comenzile din mașină la chatbot și soluții de învățare cu date audio de calitate.

Înregistrări din call center

Call Center
conversaţii

Schimburi autentice între agenți și clienți, care acceptă numeroase limbi precum spaniolă, germană, engleză americană, bengaleză, japoneză, chineză și hindi.

pentru Manșon Gastric

Seturi de date AI conversaționale cu peste 3 de ore de date în 8 limbi

În căutarea de a construi o platformă multilingvă pentru limbile indiene, clientul a colaborat cu Shaip pentru a colecta, segmenta și transcrie seturi mari de date în mai multe limbi indiene. Acest lucru ar ajuta la dezvoltarea modelelor de vorbire eficiente care ar putea alimenta noua platformă inovatoare a clientului.

Problemă: Peste 3,000 de ore de date audio colectate în 8 limbi indiene, segmentate și transcrise pentru a dezvolta recunoașterea automată a vorbirii.

Soluție: Am asigurat colectarea, segmentarea și transcrierea datelor și am livrat fișiere JSON cu metadate. Am colectat 3000 de ore de date audio în 8 limbi indiene la scară largă pentru proiectul de tehnologie vocală al clientului.

Studiu de caz de colectare a datelor despre vorbire

Motive pentru a alege Shaip ca partener de încredere pentru colectarea datelor despre vorbire

oameni

oameni

Echipe dedicate și pregătite:

  • Peste 30,000 de colaboratori pentru crearea datelor, etichetare și asigurare a calității
  • Echipa de management de proiect acreditată
  • Echipa de dezvoltare a produselor cu experiență
  • Echipa Talent Pool Sourcing & Onboarding
Etape

Etape

Cea mai mare eficiență a procesului este asigurată cu:

  • Proces robust 6 Sigma Stage-Gate
  • O echipă dedicată de centuri negre 6 Sigma – proprietari cheie de proces și conformitate cu calitatea
  • Îmbunătățire continuă și buclă de feedback
Platformă

Platformă

Platforma patentata ofera beneficii:

  • Platformă end-to-end bazată pe web
  • Calitate impecabilă
  • TAT mai rapid
  • Livrare fără întreruperi

Seturi de date pentru vorbire/audio disponibile

Set de date de limbăRata simplaTipul setului de dateNumărul total de ore audio
+Vernacular afro-american8 kHzCall-center211
Descriere pe scurtDatele centrului de apeluri vernaculare afro-americane
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 612, Bărbat: 1242 și Necunoscut: 12
+16 kHzPodcast154
Descriere pe scurtDate despre mediile vernaculare afro-americane
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 151, Bărbat: 150 și Necunoscut: 10
+afrikaans8 kHzConversație generală368
Descriere pe scurtDate despre conversația generală africană
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute, limba afrikaans vorbită în Africa
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 502, Bărbat: 390 și Necunoscut: 2
+16 kHzPodcast658
Descriere pe scurtFișiere media africane
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 750, Bărbat: 1278 și Necunoscut: 52
+Arabă8 kHzConversație generală292
Descriere pe scurtDate despre conversația generală arabă
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute, arabă din țările din Golf
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 171, Bărbat: 534 și Necunoscut: 1
+48 kHzMonolog scenariu1,947
Descriere pe scurtMonolog cu scenarii arabe
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 838 Bărbat 1209 Necunoscut 78
+Asamez (În conductă) Call center60
Descriere pe scurtDate din Assamese (In Pipeline) Call Center
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtAssamese (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtAssamese (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+bengaleză (în conductă) Call center60
Descriere pe scurtDatele call-centerului în bengaleză (în conductă).
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtBengali (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtBengali (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Boston engleză8 kHzCall center177
Descriere pe scurtDatele din centrul de apeluri din Boston
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 605, Bărbat: 711 și Necunoscut: 0
+8 kHzConversație generală32
Descriere pe scurtDate despre conversația generală din Boston
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 53, Bărbat: 83 și Necunoscut: 0
+16 kHzPodcast93
Descriere pe scurtDate audio Boston Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 43, Bărbat: 181 și Necunoscut: 2
+Franceză canadiană48 kHzMonolog scenariu1,222
Descriere pe scurtFranceză canadiană
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 974 Bărbat 631 Necunoscut 1
+Engleză chineză8 kHzCall center169
Descriere pe scurtDatele call-centerului chinezesc
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 1790, Bărbat: 523 și Necunoscut: 13
+16 kHzPodcast249
Descriere pe scurtDate audio media chinezești
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 126, Bărbat: 346 și Necunoscut: 6
+Chineza simplificată48 kHzMonolog scenariu2,762
Descriere pe scurtChineza simplificată
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1920 Bărbat 1535 Necunoscut 270
+Chineză Tradițională48 kHzMonolog scenariu1,028
Descriere pe scurtChineză Tradițională
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1069 Bărbat 262 Necunoscut 3
+daneză8 kHzConversație generală372
Descriere pe scurtDate de conversație generală daneză
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 311, Bărbat: 417, Necunoscut: 0
+16 kHzPodcast664
Descriere pe scurtDate audio Danish Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie: 369, Bărbat: 864, Necunoscut: 27
+48 kHzMonolog scenariu2,579
Descriere pe scurtMonolog cu scenariu danez
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde, daneză din Danemarca
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1551 Bărbat 1233 Necunoscut 42
+Sudul Adanc englezesc8 kHzCall center151
Descriere pe scurtEngleză Deep South Call-center de date
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 221 , Bărbat 1004 , Necunoscut 7
+8 kHzConversație generală56
Descriere pe scurtEngleză Deep South General Conversation date
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 99, Bărbat 31, Necunoscut 0
+16 kHzPodcast266
Descriere pe scurtEngleză Deep South Media date audio
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 204, Bărbat 356, Necunoscut 21
+Germană8 kHzCall center64
Descriere pe scurtDate germane ale centrului de apeluri
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioMono
Platformă de înregistrareDesktop
NOI SUNTEM (%)
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 478 Barbat 1440 Necunoscut 0
+8 kHz IVR200
Descriere pe scurtDate IVR germane
Descrierea setului de dateDe la om la mașină. Un tip de flux IVR în care există un prompt TTS (de exemplu „Cum vă pot ajuta”) urmat de un răspuns uman spontan
Canal audioMono
Platformă de înregistrareDesktop
NOI SUNTEM (%)
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 10115 Barbat 8750 Necunoscut 0
+Gujarati (În conductă) Call center60
Descriere pe scurtDatele call-centerului din Gujarati (în conductă).
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtGujarati (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtGujarati (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+ebraică8 kHzConversație generală399
Descriere pe scurtDate despre conversația generală ebraică
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute, ebraică în Israel
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 414 , Bărbat 399 , Necunoscut 1
+16 kHzPodcast427
Descriere pe scurtDate audio media ebraică
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 361, Bărbat 513, Necunoscut 13
+hindi16 kHzPodcast219
Descriere pe scurtDate audio Hindi Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 83, Bărbat 309, Necunoscut 0
+48 kHzMonolog scenariu2,867
Descriere pe scurtMonolog cu scenariu hindi
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1977 Bărbat 1864 Necunoscut 147
+hinglish8 kHzCall center208
Descriere pe scurtHINGLISH Datele centrului de apeluri
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 822, Bărbat 1262, Necunoscut 0
+16 kHzPodcast216
Descriere pe scurtHINGLISH Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 75, Bărbat 380, Necunoscut 0
+engleza hispanica8 kHzCall center212
Descriere pe scurtDate de la call-center hispanic
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 822, Bărbat 1262, Necunoscut 0
+16 kHzPodcast155
Descriere pe scurtAudio media hispanic Call Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 140, Bărbat 219, Necunoscut 5
+Indoneziană8 kHzConversație generală496
Descriere pe scurtDate despre conversația generală indoneziană
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute, indoneziană Bahasa
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 524, Bărbat 454, Necunoscut 2
+16 kHzPodcast643
Descriere pe scurtDate audio media indoneziene
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 746, Bărbat 1507, Necunoscut 129
+irlandez8 kHzConversație generală192
Descriere pe scurtDate despre conversația generală irlandeză
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 213 , Bărbat 153 , Necunoscut 0
+Japonez48 kHzMonolog scenariu2,335
Descriere pe scurtMonolog cu scenariu japonez
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1460 Bărbat 1221 Necunoscut 194
+Kannada (În conductă) Call center60
Descriere pe scurtDatele din centrul de apeluri Kannada (In Pipeline).
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtKannada (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtKannada (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Coreeană8 kHzCall center107
Descriere pe scurtDatele centrului de apeluri coreeane
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1086, Bărbat 210, Necunoscut 4
+16 kHzPodcast204
Descriere pe scurtDate audio media coreene
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 70 Bărbat 303, Necunoscut 25
+48 kHzMonolog scenariu1,955
Descriere pe scurtMonolog cu scenariu coreean
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1195 Bărbat 1134 Necunoscut 122
+malaezian8 kHzConversație generală266
Descriere pe scurtDate despre conversația generală malaeză
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute, malay în Malaezia
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 316, Bărbat 176, Necunoscut 0
+16 kHzPodcast344
Descriere pe scurtDate audio Malay Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 236, Bărbat 626, Necunoscut 47
+Malayalam (În conductă) Call center60
Descriere pe scurtMalayalam (In Pipeline) Date call-center
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtMalayalam (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtMalayalam (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Marathi (În conductă) Call center60
Descriere pe scurtDate de la Call-Center Marathi (In Pipeline).
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtMarathi (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtMarathi (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Spaniolă (Mexic)48 kHzMonolog scenariu1,492
Descriere pe scurtMonolog cu scenariu mexican spaniol
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1016 Bărbat 1069 Necunoscut 95
+Olandeză48 kHzMonolog scenariu1,205
Descriere pe scurtMonolog cu scenariu olandez
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1285 Bărbat 531 Necunoscut 3
+New York engleză8 kHzCall center103
Descriere pe scurtNew York English Date call-center
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 610, Bărbat 532, Necunoscut 0
+8 kHzConversație generală107
Descriere pe scurtDate despre conversația generală în limba engleză din New York
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 118, Bărbat 114, Necunoscut 0
+16 kHzPodcast140
Descriere pe scurtDate audio New York English Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 66, Bărbat 230, Necunoscut 11
+engleză din Noua Zeelandă 8 kHzConversație generală148
Descriere pe scurtDate de conversație generală în limba engleză din Noua Zeelandă
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 167, bărbat 121, Necunoscut 4
+16 kHzPodcast400
Descriere pe scurtAudio media engleză din Noua Zeelandă
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 367, bărbat 678, Necunoscut 26
+Oriya (În conductă) Call center60
Descriere pe scurtOriya (In Pipeline) Datele Call Center
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtOriya (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtOriya (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Poloneză16 kHzPodcast269
Descriere pe scurtAudio media poloneză
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 173 Bărbat 354 Necunoscut 6
+Poloneză (Polonia)48 kHzMonolog scenariu1,482
Descriere pe scurtPolonia poloneză - Monolog scenariu
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1324 Bărbat 701 Necunoscut 24
+Punjabi (În conductă) Call center60
Descriere pe scurtPunjabi (In Pipeline) Date call-center
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtPunjabi (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtPunjabi (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Rusă48 kHzMonolog scenariu2,398
Descriere pe scurtMonolog cu scenariu rusesc
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1689 Bărbat 1937 Necunoscut 214
+scoțian (accent englezesc)8 kHzConversație generală292
Descriere pe scurtDate despre conversația generală din Scoția
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 285, Bărbat 260, Necunoscut 3
+Singapore engleză8 kHzCall center218
Descriere pe scurtDate din centrul de apeluri din Singapore
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 2139, Bărbat 884, Necunoscut 21
+16 kHzPodcast247
Descriere pe scurtDate audio Singapore Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 160, Bărbat 455, Necunoscut 37
+engleză sud-africană8 kHzCall center261
Descriere pe scurtDatele centrului de apel în engleză din Africa de Sud
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1274 , Bărbat 935 , Necunoscut 1
+16 kHzPodcast251
Descriere pe scurtDate audio media engleză din Africa de Sud
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 235, Bărbat 432, Necunoscut 36
+Swahili8 kHzCall center230
Descriere pe scurtDatele call-centerului swahili
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 611, Bărbat 833, Necunoscut 0
+16 kHzPodcast265
Descriere pe scurtDate audio Swahili Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 118, Bărbat 493, Necunoscut 25
+Suedeză8 kHzCall center250
Descriere pe scurtDatele call-centerului suedez
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1581, bărbat 727, Necunoscut 2
+16 kHzPodcast278
Descriere pe scurtDate audio media suedeză
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 195, bărbat 500, Necunoscut 21
+Tamil (În conductă) Call center60
Descriere pe scurtDate din call-center tamil (în conductă).
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală100
Descriere pe scurtTamil (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast40
Descriere pe scurtTamil (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+telugu8 kHzConversație generală553
Descriere pe scurtTelugu General Conversation date
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 574, Bărbat 564, Necunoscut 0
+16 kHzPodcast648
Descriere pe scurtDate audio Telugu Media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 207, Bărbat 963, Necunoscut 2
+Telugu (În conductă) Call center30
Descriere pe scurtTelugu (In Pipeline) Date call-center
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Conversație generală50
Descriere pe scurtTelugu (In Pipeline) Date generale de conversație
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audio
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Podcast20
Descriere pe scurtTelugu (In Pipeline) Date audio media
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audio
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitori
+Thailandeză8 kHzConversație generală183
Descriere pe scurtConversație generală thailandeză
Descrierea setului de dateConversație telefonică fără scenariu între două persoane. Aproximativ. Durata audio (interval) - 15-60 de minute, un registru informal folosit între prieteni
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 338, Bărbat 96, Necunoscut 8
+16 kHzPodcast173
Descriere pe scurtAudio media thailandez
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 143, Bărbat 502, Necunoscut 26
+Turcia turcească48 kHzMonolog scenariu2,027
Descriere pe scurtTurcia turcească
Descrierea setului de dateÎnregistrări cu un singur rostire, care tind să se încadreze în intervalul de la 5 la 30 de secunde
Canal audioMono
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 1561 Bărbat 1241 Necunoscut 31
+Vietnameză8 kHzConversație generală295
Descriere pe scurtDate de conversație generală vietnameză
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute, nord (de exemplu, Hanoi), centru și sud (de exemplu, orașul Ho Chi Minh).
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 400, bărbat 380, Necunoscute 2
+16 kHzPodcast257
Descriere pe scurtDate audio media vietnameze
Descrierea setului de dateFișiere audio/video din domeniul public cu licență, cum ar fi interviuri, podcasturi etc. - 1 până la 5 persoane. Aproximativ. Durata audio (interval) 15-60 minute
Canal audioMono
Platformă de înregistrareWeb Sourcing
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 249, bărbat 200, Necunoscute 45
+Welsh (accent englezesc)8 kHzConversație generală278
Descriere pe scurtDate despre conversația generală galeză
Descrierea setului de dateConversație telefonică sintetică, fără scenariu, între „agent” și „client”, aprox. Durata audio (interval) 5-15 minute,
Canal audioDual
Platformă de înregistrareDesktop
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriFemeie 270, Bărbat 324, Necunoscut 0
+Marea Britanie16 kHzWake WordDifuzoarele 200
Descriere pe scurtWake Word engleză britanică
Descrierea setului de datefraze cheie colectare de date
  • boxe 200
  • 4 fraze cheie unice pentru fiecare difuzor
  • 25-30 de înregistrări repetate de fraze cheie pentru fiecare frază cheie unică
  • 25-30 de fișiere audio pentru fiecare frază cheie unică
  • 120 total de enunțuri înregistrate pentru fiecare vorbitor
Canal audiocanal 1
Platformă de înregistrareAplicație Mobilă
NOI SUNTEM (%)5.0
Format audio.wav
Format de transcriere.json
Utilizare cazASR, Asistent virtual, Chatbot, IA conversațională, Analiza vorbirii, TTS, Modelare lingvistică
Număr de vorbitoriSex: 50% bărbați, 50% femei, +/- 10%.

Servicii oferite

Colectarea expertă a datelor de tip text nu este operațională pentru setări AI complete. La Shaip, puteți chiar să luați în considerare următoarele servicii pentru a face modelele mult mai răspândite decât de obicei:

Colectarea datelor text

Servicii de colectare a datelor text

Adevărata valoare a serviciilor de colectare a datelor cognitive Shaip este că oferă organizațiilor cheia pentru a debloca informațiile critice găsite în datele nestructurate.

Colectarea datelor de imagine

Servicii de colectare a datelor de imagine

Asigurați-vă că modelul dvs. de viziune computerizată identifică fiecare imagine cu acuratețe, pentru a antrena fără probleme modelele AI de nouă generație ale viitorului

Colectarea datelor video

Servicii de colectare a datelor video

Acum concentrați-vă pe viziunea computerizată împreună cu NLP pentru a vă antrena modelele pentru a identifica obiectele, indivizii, elementele de descurajare și alte elemente vizuale la perfecțiune

Clienți prezentați

Împuternicirea echipelor să construiască produse AI de top la nivel mondial.

Shaip contactați-ne

Doriți să vă construiți propriul set de date audio?

Conectați-vă cu expertul nostru intern în colectarea datelor despre vorbire pentru a configura un depozit audio care se potrivește cel mai bine cerințelor dvs

  • Acest câmp este pentru scopuri de validare și trebuie să rămână neschimbate.
  • Prin înregistrare, sunt de acord cu Shaip Politica de Confidențialitate și Termeni şi Condiții și îmi dau consimțământul pentru a primi comunicări de marketing B2B de la Shaip.

Colectarea datelor de vorbire pentru un model ML se referă la procesul de colectare a înregistrărilor audio ale limbajului vorbit. Această colecție ajută la formarea și perfecționarea algoritmilor de învățare automată, în special a celor centrați pe înțelegerea și procesarea vocilor umane.

Când doriți să colectați date audio pentru recunoașterea automată a vorbirii (ASR), ar trebui să începeți prin a defini nevoile specifice ale proiectului, inclusiv limba dorită, accentul și tipul de vorbire. După setarea acestor parametri, asigurați-vă că obțineți toate permisiunile necesare pentru a respecta confidențialitatea utilizatorului. Apoi, utilizați dispozitive de înregistrare sau software adecvate pentru a captura mostre audio clare. Fiecare înregistrare ar trebui să fie adnotată meticulos cu transcrierea sau alte metadate pertinente și stocată sistematic pentru acces fără efort.

Un set de date de vorbire în învățarea automată este esențial pentru formarea, testarea și validarea modelelor adaptate pentru a recunoaște, transcrie sau interpreta limbajul vorbit. Astfel de seturi de date deschid calea pentru o multitudine de aplicații, de la asistenți vocali și servicii de transcriere până la biometrie vocală.

Pentru a colecta date precise din diverse limbi și accente, este vitală colaborarea cu vorbitori nativi din mediul lingvistic dorit. Urmăriți un eșantion variat și reprezentativ pentru a acoperi un spectru larg de nuanțe demografice. Folosiți echipamente de înregistrare standardizate în medii uniforme pentru a asigura consistența audio. Și, important, adnotă fiecare bucată de date cu transcripții și metadate detaliate, indicând limba și accentul specific.