모음
한국어 음성 인식(ASR) 데이터셋
8 개 · GearDel
기어델 카탈로그에서 이 주제는 8개입니다 (음성 8개). 제공처: AI Hub 3개, GitHub 4개. 예: ClovaCall, KsponSpeech (대규모 자유발화), 소아 및 어린이 구어 음성 인식. 상업 이용 가능 표기는 2개입니다. 음성 인식(ASR)으로 보이는 항목입니다. 성우 낭독 TTS와 한 학습에 넣지 않는 것이 좋습니다. 시간 표기는 다시 잰 값이 아닙니다. 기어델은 파일을 보관하지 않으니 원본 주소에서 받습니다.
음성 모음 전체와 달리, 이 표는 인식(ASR)으로 보이는 행만 남깁니다. KsponSpeech처럼 자유 발화 인식용과 Zeroth처럼 읽기 음성 인식용이 같이 있을 수 있습니다. TTS 낭독 음성과 한 학습에 넣지 않는 것이 좋습니다.
시간·화자 수는 카탈로그에 적힌 문구입니다. 원본이 샘플만 공개하거나 구간을 나눠 받는 경우가 있어, 표의 시간을 받은 파일 길이로 믿지 않습니다.
콜센터·방언 음성은 화자 동의가 라이선스 한 줄보다 까다로운 경우가 많습니다. 상업 이용 가능이어도 원본 약관의 수집 동의 항목을 읽습니다.
합성(TTS)이 필요하면 음성 모음으로 돌아가 합성으로 적힌 행만 고릅니다. 기어델은 파일을 보관하지 않습니다.
인식용만 모았습니다. TTS가 필요하면 음성 모음에서 합성으로 적힌 행을 고릅니다.
상업 이용 가능
2
조건부
5
제한
1
이 모음 안의 행 수입니다. 다운로드 수가 아닙니다. 아래 라이선스는 저장된 표기 그대로입니다.
- AI Hub 이용안내 · 3
- 미기재 · 1
- Apache 2.0 · 1
- CC BY-NC 4.0 · 1
- CC BY-NC-ND 4.0 · 1
- MIT · 1
| 이름 | 용도 | 제공처 | 크기 | 라이선스 | 상업이용 |
|---|---|---|---|---|---|
| ClovaCall | 한국어 음성인식 데이터셋 | GitHub | 11,000명 이상 | MIT | 불가 |
| KsponSpeech (대규모 자유발화) | 한국어 자유발화 음성인식 | AI Hub | 1000시간 | AI Hub 이용안내 | 조건부 가능 |
| 소아 및 어린이 구어 음성 인식 | 한국어 음성인식 데이터셋 | AI Hub | 120시간 | AI Hub 이용안내 | 조건부 가능 |
| 실버 세대 장노년층 구어 음성 | 한국어 음성인식 데이터셋 | AI Hub | 150시간 | AI Hub 이용안내 | 조건부 가능 |
| Zeroth 한국어 음성 인식 오픈소스 데이터셋 | 한국어 음성인식 데이터셋 | GitHub | 대용량 | Apache 2.0 | 가능 |
| KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋 | 한국어 음성인식 데이터셋 | Hugging Face (KoelLabs) | 18 GB | CC BY-NC 4.0 | 가능 |
| Pansori TEDxKR 음성 코퍼스 | 한국어 음성인식 데이터셋 | GitHub | 약 3시간 | CC BY-NC-ND 4.0 | 조건부 가능 |
| OLKAVS 한국어 시청각 음성 | 한국어 음성인식 데이터셋 | GitHub | 1,150시간 오디오 | 원본 확인 | 조건부 가능 |