한국어 유해성 데이터셋 · 텍스트
HateScore 한국어 다중 차원 혐오 감지 데이터셋
한국어 유해성 데이터셋·Korean Toxicity Dataset
단순한 욕설 차원을 넘어 성별, 종교, 연령, 지역 등 현대 사회의 미묘하고 비정형적인 혐오 카테고리를 세분화하여 탐지하는 가드레일 데이터셋입니다.
Source
GitHub
License
Apache 2.0
Catalog verified
Language
Korean
Needs review
Format
Text
Needs review
Size
중용량
11K 데이터
Year
2022
이 데이터셋이 맞는 경우
HateScore 한국어 다중 차원 혐오 감지 데이터셋은 GitHub에서 제공하는 한국어 유해성 데이터셋입니다. 태그: 혐오탐지, 다중분류, 가드레일, 윤리. 라이선스 표기: Apache 2.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.
- 과제 / 카테고리
- 텍스트 · 텍스트 · 혐오탐지, 다중분류, 가드레일, 윤리
- Language
- Korean
- Format · Size
- Text · 중용량 (11K 데이터)
- License
- Apache 2.0(Catalog verified) · License document
- Source & original link
- GitHub · Original dataset link(Verified)
- Verification status
- Source: Verified · License: Verified · Last checked: 2026-09-03
HateScore 한국어 다중 차원 혐오 감지 데이터셋: Korean Toxicity Dataset from GitHub. License Apache 2.0. Open the original link to download.
비슷한 데이터셋
같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.
SAMPLE
Example records
Catalog samples only. Actual files may differ on the original source.
텍스트 내용
저 나이대 사람들은 고집이 너무 세서 말이 안 통해.
분류 결과
연령 편견 및 차별적 언어
Trust & metadata
GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.
- Source
- GitHubVerified
- Source URL
- https://github.com/sgunderscore/hatescore-korean-hate-speechVerified
- License
- Apache 2.0Verified
- Verification
- License verified
- Language
- KoreanNeeds review
- Format
- TextNeeds review
- Size
- 중용량Not verified
- Last checked
- 2026-09-03