한국어 NLP 데이터셋 · 텍스트

소셜미디어악성댓글가드레일윤리정렬

소셜 미디어 한국어 악성 텍스트 필터링 데이터

한국어 NLP 데이터셋·Korean NLP Dataset

인스타그램, 엑스(X), 유튜브 등 글로벌 사회관계망서비스(SNS)에서 포착되는 신종 비하 단어, 문맥 왜곡형 인격 모독 문장들을 실시간성 높게 수집해 정제한 필터링용 데이터셋입니다.

Source UnknownLicense Needs review
Commercial use: 가능(catalog)

Source

GitHub

License

Apache 2.0

Catalog hint — re-check original

Language

Korean

Needs review

Format

Text

Needs review

Size

중용량

15K 소셜 코멘트

Year

2023

이 데이터셋이 맞는 경우

소셜 미디어 한국어 악성 텍스트 필터링 데이터는 GitHub에서 제공하는 한국어 NLP 데이터셋입니다. 태그: 소셜미디어, 악성댓글, 가드레일, 윤리정렬. 라이선스 표기: Apache 2.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.

과제 / 카테고리
텍스트 · 텍스트 · 소셜미디어, 악성댓글, 가드레일, 윤리정렬
Language
Korean
Format · Size
Text · 중용량 (15K 소셜 코멘트)
License
Apache 2.0(Catalog hint — re-check original) · License document
Source & original link
GitHub · URL not verified
Verification status
Source: Unknown · License: Needs review · Last checked: 2026-09-03

소셜 미디어 한국어 악성 텍스트 필터링 데이터: Korean NLP Dataset from GitHub. License Apache 2.0. Open the original link to download.

비슷한 데이터셋

같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.

SAMPLE

Example records

Catalog samples only. Actual files may differ on the original source.

본문

외모 수준 진짜 실화냐? 연예인 하겠다고 기어나온 용기가 대단함.

악성 분류

Toxic (인신공격성 외모 비하)

Trust & metadata

GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.

Source
GitHubNot verified
License
Apache 2.0Needs review
Verification
License needs review
Language
KoreanNeeds review
Format
TextNeeds review
Size
중용량Not verified
Last checked
2026-09-03

Original URL unknown · search on GitHub