한국어 NLP 데이터셋 · 텍스트
소셜 미디어 한국어 악성 텍스트 필터링 데이터
한국어 NLP 데이터셋·Korean NLP Dataset
인스타그램, 엑스(X), 유튜브 등 글로벌 사회관계망서비스(SNS)에서 포착되는 신종 비하 단어, 문맥 왜곡형 인격 모독 문장들을 실시간성 높게 수집해 정제한 필터링용 데이터셋입니다.
Source
GitHub
License
Apache 2.0
Catalog hint — re-check original
Language
Korean
Needs review
Format
Text
Needs review
Size
중용량
15K 소셜 코멘트
Year
2023
이 데이터셋이 맞는 경우
소셜 미디어 한국어 악성 텍스트 필터링 데이터는 GitHub에서 제공하는 한국어 NLP 데이터셋입니다. 태그: 소셜미디어, 악성댓글, 가드레일, 윤리정렬. 라이선스 표기: Apache 2.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.
- 과제 / 카테고리
- 텍스트 · 텍스트 · 소셜미디어, 악성댓글, 가드레일, 윤리정렬
- Language
- Korean
- Format · Size
- Text · 중용량 (15K 소셜 코멘트)
- License
- Apache 2.0(Catalog hint — re-check original) · License document
- Source & original link
- GitHub · URL not verified
- Verification status
- Source: Unknown · License: Needs review · Last checked: 2026-09-03
소셜 미디어 한국어 악성 텍스트 필터링 데이터: Korean NLP Dataset from GitHub. License Apache 2.0. Open the original link to download.
비슷한 데이터셋
같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.
SAMPLE
Example records
Catalog samples only. Actual files may differ on the original source.
본문
외모 수준 진짜 실화냐? 연예인 하겠다고 기어나온 용기가 대단함.
악성 분류
Toxic (인신공격성 외모 비하)
Trust & metadata
GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.
- Source
- GitHubNot verified
- License
- Apache 2.0Needs review
- Verification
- License needs review
- Language
- KoreanNeeds review
- Format
- TextNeeds review
- Size
- 중용량Not verified
- Last checked
- 2026-09-03
Original URL unknown · search on GitHub