한국어 NLP 데이터셋 · 텍스트
한국어 자소-음소 변환 소리 정렬 데이터셋
한국어 NLP 데이터셋·Korean NLP Dataset
음성 합성 및 받아쓰기 모델 개발 시 연음 법칙, 비음화, 자음동화 등 한글 표기와 실제 발음이 전치되는 현상(Grapheme-to-Phoneme)을 교정하는 정밀 사전 데이터셋입니다.
Source
GitHub
License
MIT
Catalog hint — re-check original
Language
Korean
Needs review
Format
Text
Needs review
Size
소용량
150K 단어 발음 기호
Year
2021
이 데이터셋이 맞는 경우
한국어 자소-음소 변환 소리 정렬 데이터셋은 GitHub에서 제공하는 한국어 NLP 데이터셋입니다. 태그: 연음법칙, 자소음소, G2P, 발음교정. 라이선스 표기: MIT. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.
- 과제 / 카테고리
- 텍스트 · 텍스트 · 연음법칙, 자소음소, G2P, 발음교정
- Language
- Korean
- Format · Size
- Text · 소용량 (150K 단어 발음 기호)
- License
- MIT(Catalog hint — re-check original) · License document
- Source & original link
- GitHub · URL not verified
- Verification status
- Source: Unknown · License: Needs review · Last checked: 2026-09-03
한국어 자소-음소 변환 소리 정렬 데이터셋: Korean NLP Dataset from GitHub. License MIT. Open the original link to download.
비슷한 데이터셋
같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.
SAMPLE
Example records
Catalog samples only. Actual files may differ on the original source.
단어 표기
독립문
실제 발음
동님문
Trust & metadata
GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.
- Source
- GitHubNot verified
- License
- MITNeeds review
- Verification
- License needs review
- Language
- KoreanNeeds review
- Format
- TextNeeds review
- Size
- 소용량Not verified
- Last checked
- 2026-09-03
Original URL unknown · search on GitHub