pt

Please fill in your name

Mobile phone format error

Por favor, insira o telefone

Por favor, insira o nome da sua empresa

Por favor, insira o e-mail da sua empresa

Por favor, insira a solicitação de dados

Successful submission! Thank you for your support.

Format error, Please fill in again

Confirm

A solicitação de dados não pode conter menos de 5 palavras nem conter apenas números

Datasets para ASR

Melhore instantaneamente o desempenho dos seus modelos de IA com conjuntos de dados prontos para uso e de alta qualidade.

Idioma

Todos
208
Árabe
4
Birmanês
3
Dialetos chineses
3
Inglês
44
Francês
11
Alemão
9
Hindi
6
Indonésio
8
Italiano
9
Japonês
9
Coreano
14
Malaio
5
Mandarim
3
Outros
47
Português
12
Russo
6
Espanhol
14
Tailandês
9
Vietnamita
6

Tipos de Dados

Todos
208
Diálogo
105
Leitura
104

97 horas de dados de voz infantil em português do Brasil – estilo coloquial

Dados de voz infantil em português do Brasil – estilo coloquial O conteúdo abrange áreas gerais como mídias sociais, diálogos, transmissões ao vivo, palestras e programas de variedades, refletindo situações reais de interação. Este conjunto de dados é anotado com conteúdo textual, identidade dos locutors, gênero, sotaque e outros atributos. As gravações foram feitas por várias crianças brasileiras de até 12 anos, provenientes de diferentes regiões e contextos culturais. Os dados apresentam alta precisão e são fáceis de utilizar, oferecendo recursos valiosos para pesquisas e aplicações em reconhecimento de fala. Foram validados por múltiplas empresas de IA, auxiliando os modelos a se destacarem diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e privacidade, garantindo que a coleta, o armazenamento e o uso das informações mantenham os direitos legais e a privacidade dos usuários. Todos os dados estão em conformidade com o GDPR, CCPA e PIPL.
Português brasileiro Fala espontânea Anotação de texto

406 horas de Dados de voz em português europeu – conversas por celular

Dados de voz em português europeu – conversas por celular – foram simulados com base em cerca de trinta temas comuns. Este conjunto de dados inclui anotações como conteúdo textual, marcações temporais por frase, identidade do locutor, gênero, entre outros atributos. As gravações foram feitas por 590 locutors nativos de português europeu de múltiplas regiões e contextos culturais. Possui alta precisão e oferece recursos valiosos para pesquisas e aplicações em reconhecimento de fala. Validado por múltiplas empresas de IA, ajuda os modelos a lidarem bem com a diversidade do mundo real. Todos os dados foram coletados, armazenados e utilizados em conformidade com os regulamentos de privacidade e proteção de dados (GDPR, CCPA, PIPL).
Áudio Dados Conjunto de dados Conversacional Dados de ASR Português Europeu

101 horas de Dados de voz infantil em italiano – estilo coloquial

Dados de voz infantil em italiano (estilo coloquial), com conteúdo abrangendo mídias sociais, diálogos, transmissões ao vivo, palestras, programas de variedades, entre outros domínios gerais, refletindo contextos reais de interação. O conjunto é anotado com conteúdo textual, identidade e gênero do locutor, sotaque, entre outros atributos. As gravações foram feitas por várias crianças italianas de até 12 anos, de diferentes regiões e contextos culturais. O conjunto tem alta precisão e é fácil de usar, oferecendo ricas fontes para pesquisa e aplicação em reconhecimento de fala. Ajuda os modelos a lidar com a diversidade do mundo real. Seguimos rigorosamente as regulamentações de proteção de dados e privacidade, garantindo a proteção dos direitos dos usuários durante a coleta, o armazenamento e o uso. Todos os dados seguem as normas GDPR, CCPA e PIPL.
Dados de voz espontânea Anotação de Texto Italiano

200 horas de dados de voz em malaio _ conversas (celular)

Dados de voz em malaio _ conversas (via celular), gravados com base em cerca de 30 temas comuns. O conjunto de dados inclui marcações de conteúdo textual, marca de tempo por frase, identificação e gênero do locutor. Foi gravado por 228 malaios de múltiplas regiões e origens culturais. A precisão é alta e os dados são recursos valiosos para pesquisa e aplicações em reconhecimento de fala, verificados por várias empresas de IA. Cumpre rigorosamente regulamentos como GDPR, CCPA e PIPL para proteger privacidade e direitos legais.
Áudio Dados Conjunto de dados Conversacional Dados ASR Malaio

162 horas de dados de voz de crianças em francês – linguagem coloquial

Dados de voz de crianças francesas – linguagem coloquial, com conteúdo abrangendo mídias sociais, diálogos, transmissões ao vivo, palestras, variedades e outras áreas gerais, refletindo situações de interação do mundo real. Este conjunto de dados inclui anotações de conteúdo textual, identidade do locutor, gênero, sotaque e outros atributos. Foi gravado por várias crianças francesas com até 12 anos, provenientes de diferentes regiões e contextos culturais, garantindo alta precisão e facilidade de uso. É um recurso valioso para pesquisas e aplicações relacionadas ao reconhecimento de voz, ajudando os modelos a apresentarem bom desempenho diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e regulamentos de privacidade, garantindo a privacidade e os direitos legais dos usuários durante a coleta, armazenamento e uso dos dados. Todos os dados estão em conformidade com o GDPR, CCPA e PIPL.
Francês Fala espontânea Criança

494 horas de Dados de voz em hindi — coloquial

Dados de voz em híndi – linguagem coloquial. Reflete situações de interação do mundo real. Este conjunto de dados inclui anotações de conteúdo textual, identidade do locutor, gênero e outros atributos. Foi gravado por locutors nativos de híndi provenientes de diferentes regiões e contextos culturais, garantindo alta precisão e facilidade de uso. Trata-se de um recurso valioso para pesquisas e aplicações relacionadas ao reconhecimento de voz, ajudando os modelos a apresentarem bom desempenho diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e regulamentos de privacidade, garantindo que a coleta, armazenamento e uso dos dados respeitem a privacidade e os direitos legais dos usuários. Todos os dados estão em conformidade com o GDPR, CCPA e PIPL.
Espontâneo Fala Hindi

136 horas de Dados de voz em coreano — diálogos (por telefone)

Dados de voz em coreano — diálogos (por telefone), gravados de forma simulada com base em cerca de trinta temas comuns. Este conjunto de dados contém anotações do conteúdo textual, marcas de tempo das frases, identificação do locutor, gênero e outras características. Foi gravado por 216 coreanos nativos de diferentes regiões e contextos culturais, apresentando alta precisão. Oferece um recurso valioso para pesquisas e aplicações relacionadas ao reconhecimento de voz, e foi validado por múltiplas empresas de IA: contribui para que os modelos tenham um bom desempenho diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e as normas de privacidade para garantir que a coleta, o armazenamento e o uso dos dados protejam a privacidade e os direitos legais dos usuários. Todos os dados seguem as regulamentações GDPR, CCPA e PIPL.
Conversacional Telefone Coreano

347 horas de dados de voz em indonésio (celular)

Dados de voz em indonésio (celular) Gravados com base em cerca de trinta temas comuns simulados. Este conjunto de dados inclui anotações de conteúdo textual, marcação de tempo das frases, identidade dos locutors, gênero e outros atributos. Foi gravado por 412 locutors nativos da Indonésia com diferentes origens regionais e culturais, garantindo alta precisão. Trata-se de um recurso valioso para pesquisas e aplicações relacionadas ao reconhecimento de voz, já validado por múltiplas empresas de IA: auxilia os modelos a apresentarem excelente desempenho diante da diversidade do mundo real. Seguimos rigorosamente as leis de proteção de dados e regulamentos de privacidade, garantindo que a coleta, o armazenamento e o uso dos dados respeitem a privacidade e os direitos legais dos usuários. Todos os dados estão em conformidade com o GDPR, CCPA e PIPL.
Áudio dados Conjunto de dados Conversacional Dados de reconhecimento automático de fala Indonésio

Dados de vídeo multimodais de leitura labial com múltiplos ângulos de 202 pessoas

Dados de vídeo multimodal de leitura labial com múltiplos ângulos envolvendo 202 pessoas. As cenas de coleta incluem ambientes internos com luz natural e ambientes internos com iluminação fluorescente. Os vídeos foram gravados com celular. A diversidade da coleta abrange diferentes cenários, faixas etárias e 13 ângulos de filmagem. A linguagem usada é o mandarim padrão. Os conteúdos gravados são de domínio geral, sem restrição de tema. Os dados podem ser usados em pesquisas de algoritmos de aprendizado multimodal na área de voz e imagem.
Múltiplos Ângulos Multimodalidade Labial Cenas Internas com Luz Natural Cenas Internas com Iluminação Fluorescente 13 Ângulos de Filmagem Mandarim Chinês Campo Geral
. . .

loading

Personalize os Seus Dados Agora

Porquê escolher conjuntos de dados prontos?

  • Direitos de Autor

    Direitos de Autor

    Direitos claros e verificáveis
  • Segurança

    Segurança

    Autorização adequada Utilização segura
  • Profissionalismo

    Profissionalismo

    Produzido por especialistas em dados de IA
  • Diversidade

    Diversidade

    Coletado a partir de múltiplos cenários reais
  • Rentabilidade

    Rentabilidade

    Mais económico do que dados personalizados
  • Eficiência

    Eficiência

    Prontos a usar em segundos
c69eff79-07f6-4eb1-b992-d62e8b013f6a