[{"@type":"PropertyValue","name":"Formato","value":"16kHz, 16 bit, WAV, mono"},{"@type":"PropertyValue","name":"Ambiente de Gravação","value":"Baixo ruído"},{"@type":"PropertyValue","name":"País","value":"Índia"},{"@type":"PropertyValue","name":"Código de Região Linguística","value":"hi-IN"},{"@type":"PropertyValue","name":"Língua","value":"Hindi"},{"@type":"PropertyValue","name":"Características de Anotação","value":"Anotação de conteúdo textual, marca de tempo de frase, identificação do locutor, género, anotação de ruído"},{"@type":"PropertyValue","name":"Taxa de Precisão","value":"Precisão de palavras: 98%"}]
{"id":1269,"datatype":"1","titleimg":"https://pt.nexdata.ai/shujutang/static/image/index/datatang_yuyin_default.webp","type1":"165","type1str":null,"type2":"166","type2str":null,"dataname":"494 horas de Dados de voz em hindi — coloquial","datazy":[{"title":"Formato","desc":"Formato","content":"16kHz, 16 bit, WAV, mono"},{"title":"Ambiente de Gravação","desc":"Ambiente de Gravação","content":"Baixo ruído"},{"title":"País","desc":"País","content":"Índia"},{"title":"Código de Região Linguística","desc":"Código de Região Linguística","content":"hi-IN"},{"title":"Língua","desc":"Língua","content":"Hindi"},{"title":"Características de Anotação","desc":"Características de Anotação","content":"Anotação de conteúdo textual, marca de tempo de frase, identificação do locutor, género, anotação de ruído"},{"title":"Taxa de Precisão","desc":"Taxa de Precisão","content":"Precisão de palavras: 98%"}],"datatag":"Hindi,Conversational","technologydoc":null,"downurl":null,"datainfo":null,"standard":null,"dataylurl":null,"flag":null,"publishtime":null,"createby":null,"createtime":null,"ext1":null,"samplestoreloc":null,"hosturl":null,"datasize":null,"industryPlan":null,"keyInformation":"","samplePresentation":[],"officialSummary":"Dados de voz em híndi – linguagem coloquial. Reflete situações de interação do mundo real. Este conjunto de dados inclui anotações de conteúdo textual, identidade do locutor, gênero e outros atributos. Foi gravado por locutors nativos de híndi provenientes de diferentes regiões e contextos culturais, garantindo alta precisão e facilidade de uso. Trata-se de um recurso valioso para pesquisas e aplicações relacionadas ao reconhecimento de voz, ajudando os modelos a apresentarem bom desempenho diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e regulamentos de privacidade, garantindo que a coleta, armazenamento e uso dos dados respeitem a privacidade e os direitos legais dos usuários. Todos os dados estão em conformidade com o GDPR, CCPA e PIPL.","dataexampl":null,"datakeyword":["Espontâneo","Fala","Hindi"],"isDelete":null,"ids":null,"idsList":null,"datasetCode":null,"productStatus":null,"tagTypeEn":"Data Type,Language","tagTypeZh":null,"website":null,"samplePresentationList":null,"datazyList":null,"keyInformationList":null,"dataexamplList":null,"bgimg":null,"datazyScriptList":null,"datakeywordListString":null,"sourceShowPage":"speechRec","dataShowType":"[{\"code\":\"0\",\"language\":\"ZH\"},{\"code\":\"1\",\"language\":\"ZH\"},{\"code\":\"2\",\"language\":\"EN,JP,PT,DE,KO,FR,ES\"},{\"code\":\"3\",\"language\":\"EN\"},{\"code\":\"4\",\"language\":\"JP\"}]","productNameEn":"1,003 Hours - Hindi Spontaneous Speech Data","BGimg":"brightSpot_audio","voiceBg":["/shujutang/static/image/comm/audio_bg.webp","/shujutang/static/image/comm/audio_bg2.webp","/shujutang/static/image/comm/audio_bg3.webp","/shujutang/static/image/comm/audio_bg4.webp","/shujutang/static/image/comm/audio_bg5.webp"]}
Dados de voz em híndi – linguagem coloquial. Reflete situações de interação do mundo real. Este conjunto de dados inclui anotações de conteúdo textual, identidade do locutor, gênero e outros atributos. Foi gravado por locutors nativos de híndi provenientes de diferentes regiões e contextos culturais, garantindo alta precisão e facilidade de uso. Trata-se de um recurso valioso para pesquisas e aplicações relacionadas ao reconhecimento de voz, ajudando os modelos a apresentarem bom desempenho diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e regulamentos de privacidade, garantindo que a coleta, armazenamento e uso dos dados respeitem a privacidade e os direitos legais dos usuários. Todos os dados estão em conformidade com o GDPR, CCPA e PIPL.
Dataset pago com licença comercial. Pronto para integração em projetos de IA.
Características
Formato
16kHz, 16 bit, WAV, mono
Ambiente de Gravação
Baixo ruído
País
Índia
Código de Região Linguística
hi-IN
Língua
Hindi
Características de Anotação
Anotação de conteúdo textual, marca de tempo de frase, identificação do locutor, género, anotação de ruído