한국어 음성인식 데이터셋 · 음성
KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋
한국어 음성인식 데이터셋·Korean Speech Recognition Dataset
한국어가 모국어가 아닌 외국인 화자(미국, 중국, 베트남 등)가 발화한 한국어 녹음 자료를 바탕으로 악센트 및 잘못된 발음 형태를 ASR이 올바르게 보정 인식하게 돕는 ASR 벤치마크입니다.
Source
Hugging Face (KoelLabs)
License
CC BY-NC 4.0
Catalog verified
Language
Korean
Needs review
Format
Audio
Needs review
Size
18 GB
4.5K 외국인 발화 오디오
Year
2025
이 데이터셋이 맞는 경우
KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋은 Hugging Face (KoelLabs)에서 제공하는 한국어 음성인식 데이터셋입니다. 태그: 악센트, 다국어화자, ASR, 발음교정. 라이선스 표기: CC BY-NC 4.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.
- 과제 / 카테고리
- 음성 · 음성 · 악센트, 다국어화자, ASR, 발음교정
- Language
- Korean
- Format · Size
- Audio · 18 GB (4.5K 외국인 발화 오디오)
- License
- CC BY-NC 4.0(Catalog verified) · License document
- Source & original link
- Hugging Face (KoelLabs) · Original dataset link(Verified)
- Verification status
- Source: Verified · License: Verified · Last checked: 2026-09-03
KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋: Korean Speech Recognition Dataset from Hugging Face (KoelLabs). License CC BY-NC 4.0. Open the original link to download.
비슷한 데이터셋
같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.
SAMPLE
Example records
Catalog samples only. Actual files may differ on the original source.
전사 및 발음
한국의 경복궁은 정마루 아룹다웠습니다. (정말 아름다웠습니다)
Trust & metadata
GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.
- Source
- Hugging Face (KoelLabs)Verified
- Source URL
- https://huggingface.co/datasets/KoelLabs/L2ArcticVerified
- License
- CC BY-NC 4.0Verified
- Verification
- License verified
- Language
- KoreanNeeds review
- Format
- AudioNeeds review
- Size
- 18 GBNeeds review
- Last checked
- 2026-09-03