음성 데이터 세트

다리 데이터세트

AI 및 음성 모델을 위한 고품질 Dari 일반 대화 및 TTS 데이터 세트

다리 데이터세트

회사 개요

  • LanguageDari
  • 데이터 세트 유형일반 회화, TTS
  • 국가아프가니스탄

기술설명

대본 없이 녹음된 "화자 1"과 "화자 2" 간의 전화 통화 내용입니다. 오디오 재생 시간은 약 5~15분입니다.

데이터 세트 하이라이트

  • LanguageDari
  • 샘플 속도16kHz / 44kHz
  • 전체 시간600의 시간
  • 채널모노
  • 지속 시간 범위5~15분

고객 사례

  • 정치
  • 시사
  • 지방 뉴스
  • 종교
  • 경제와 금융
  • 관광

샘플 데이터셋 사양

데이터 세트 유형일반회화TTS
샘플링 속도44 kHz16 kHz
채널모노모노
전체 시간-600의 시간

핵심 장점

  • 다양성과 대표성포괄적이고 실질적인 AI를 위한 폭넓은 연사 초청 강연.
  • 고품질 오디오깨끗하고 균형 잡힌 녹음으로 안정적인 모델 성능을 보장합니다.
  • AI/ML 준비 완료!원활한 통합을 위해 구조화되고 주석이 달려 있습니다.
  • 확장 가능하고 유연함필요에 따라 다양한 기간, 발표자 및 분야를 선택할 수 있습니다.

기술적인 세부 사항

  • 녹음 플랫폼모바일 애플 리케이션
  • 오디오 형식. WAV
  • 전사 형식.json
  • WER(%)5
  • 연령대18-50

주요 클라이언트

전 세계 유수의 AI 팀과 기업들이 신뢰하는 솔루션입니다.

  • Microsoft
  • Amazon Web Services
  • 구글

찾고 있는 것을 찾을 수 없습니까?

모든 데이터 유형에 걸쳐 새로운 기성 데이터 세트가 수집되고 있습니다.

오디오/스피치 트레이닝 데이터 수집 걱정은 지금 바로 연락주세요.

  • 이 필드는 검증 목적이며 변하지 남아 있어야합니다.
  • 등록함으로써 Shaip에 동의합니다. 개인정보 처리방침 서비스약관 그리고 Shaip의 B2B 마케팅 커뮤니케이션 수신에 동의합니다.