한국어 음성인식 데이터셋 · 음성

📞
악센트다국어화자ASR발음교정

KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋

한국어 음성인식 데이터셋·Korean Speech Recognition Dataset

한국어가 모국어가 아닌 외국인 화자(미국, 중국, 베트남 등)가 발화한 한국어 녹음 자료를 바탕으로 악센트 및 잘못된 발음 형태를 ASR이 올바르게 보정 인식하게 돕는 ASR 벤치마크입니다.

Source VerifiedLicense Verified
Commercial use: 가능(catalog)

Source

Hugging Face (KoelLabs)

License

CC BY-NC 4.0

Catalog verified

Language

Korean

Needs review

Format

Audio

Needs review

Size

18 GB

4.5K 외국인 발화 오디오

Year

2025

이 데이터셋이 맞는 경우

KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋은 Hugging Face (KoelLabs)에서 제공하는 한국어 음성인식 데이터셋입니다. 태그: 악센트, 다국어화자, ASR, 발음교정. 라이선스 표기: CC BY-NC 4.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.

과제 / 카테고리
음성 · 음성 · 악센트, 다국어화자, ASR, 발음교정
Language
Korean
Format · Size
Audio · 18 GB (4.5K 외국인 발화 오디오)
License
CC BY-NC 4.0(Catalog verified) · License document
Source & original link
Hugging Face (KoelLabs) · Original dataset link(Verified)
Verification status
Source: Verified · License: Verified · Last checked: 2026-09-03

KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋: Korean Speech Recognition Dataset from Hugging Face (KoelLabs). License CC BY-NC 4.0. Open the original link to download.

비슷한 데이터셋

같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.

SAMPLE

Example records

Catalog samples only. Actual files may differ on the original source.

전사 및 발음

한국의 경복궁은 정마루 아룹다웠습니다. (정말 아름다웠습니다)

Trust & metadata

GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.

Source
Hugging Face (KoelLabs)Verified
License
CC BY-NC 4.0Verified
Verification
License verified
Language
KoreanNeeds review
Format
AudioNeeds review
Size
18 GBNeeds review
Last checked
2026-09-03
Always re-check license and terms on the original page. Standard license document
Open original dataset