GGearDel← 데이터셋 목록

데이터셋 / 음성

📞
악센트다국어화자ASR발음교정

KoelLabs 다국어 화자 한국어 악센트 음성 데이터셋

한국어가 모국어가 아닌 외국인 화자(미국, 중국, 베트남 등)가 발화한 한국어 녹음 자료를 바탕으로 악센트 및 잘못된 발음 형태를 ASR이 올바르게 보정 인식하게 돕는 ASR 벤치마크입니다.

상업적 이용 가능 (Apache 2.0)

출처

Hugging Face (KoelLabs)

등록 연도

2025

데이터 크기

18 GB

구성

4.5K 외국인 발화 오디오

원본 데이터셋에서 보기

DATA PREVIEW

이런 형태의 데이터예요

아래는 데이터 구조를 이해하기 위한 예시입니다. 실제 내려받기 전에는 원본 제공처의 최신 안내를 확인하세요.

전사 및 발음

한국의 경복궁은 정마루 아룹다웠습니다. (정말 아름다웠습니다)