한국어 NLP 데이터셋 · 텍스트

연음법칙자소음소G2P발음교정

한국어 자소-음소 변환 소리 정렬 데이터셋

한국어 NLP 데이터셋·Korean NLP Dataset

음성 합성 및 받아쓰기 모델 개발 시 연음 법칙, 비음화, 자음동화 등 한글 표기와 실제 발음이 전치되는 현상(Grapheme-to-Phoneme)을 교정하는 정밀 사전 데이터셋입니다.

Source UnknownLicense Needs review
Commercial use: 가능(catalog)

Source

GitHub

License

MIT

Catalog hint — re-check original

Language

Korean

Needs review

Format

Text

Needs review

Size

소용량

150K 단어 발음 기호

Year

2021

이 데이터셋이 맞는 경우

한국어 자소-음소 변환 소리 정렬 데이터셋은 GitHub에서 제공하는 한국어 NLP 데이터셋입니다. 태그: 연음법칙, 자소음소, G2P, 발음교정. 라이선스 표기: MIT. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.

과제 / 카테고리
텍스트 · 텍스트 · 연음법칙, 자소음소, G2P, 발음교정
Language
Korean
Format · Size
Text · 소용량 (150K 단어 발음 기호)
License
MIT(Catalog hint — re-check original) · License document
Source & original link
GitHub · URL not verified
Verification status
Source: Unknown · License: Needs review · Last checked: 2026-09-03

한국어 자소-음소 변환 소리 정렬 데이터셋: Korean NLP Dataset from GitHub. License MIT. Open the original link to download.

비슷한 데이터셋

같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.

SAMPLE

Example records

Catalog samples only. Actual files may differ on the original source.

단어 표기

독립문

실제 발음

동님문

Trust & metadata

GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.

Source
GitHubNot verified
License
MITNeeds review
Verification
License needs review
Language
KoreanNeeds review
Format
TextNeeds review
Size
소용량Not verified
Last checked
2026-09-03

Original URL unknown · search on GitHub