한국어 NLP 데이터셋 · 텍스트

카카오NLI자연어추론문장비교

카카오브레인 KorNLI 자연어 추론 데이터셋

한국어 NLP 데이터셋·Korean NLP Dataset

미국 스탠포드대학의 SNLI 및 MultiNLI 데이터를 한국어 정서에 부합하도록 전문 번역 및 검수를 진행한 한국어 대표 자연어 추론(NLI) 데이터셋입니다.

Source VerifiedLicense Verified
Commercial use: 가능(catalog)

Source

GitHub (kakaobrain)

License

CC BY-SA 4.0

Catalog verified

Language

Korean

Needs review

Format

Text

Needs review

Size

대용량

950K 대형 문장쌍

Year

2020

이 데이터셋이 맞는 경우

카카오브레인 KorNLI 자연어 추론 데이터셋은 GitHub (kakaobrain)에서 제공하는 한국어 NLP 데이터셋입니다. 태그: 카카오, NLI, 자연어추론, 문장비교. 라이선스 표기: CC BY-SA 4.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.

과제 / 카테고리
텍스트 · 텍스트 · 카카오, NLI, 자연어추론, 문장비교
Language
Korean
Format · Size
Text · 대용량 (950K 대형 문장쌍)
License
CC BY-SA 4.0(Catalog verified) · License document
Source & original link
GitHub (kakaobrain) · Original dataset link(Verified)
Verification status
Source: Verified · License: Verified · Last checked: 2026-09-03

카카오브레인 KorNLI 자연어 추론 데이터셋: Korean NLP Dataset from GitHub (kakaobrain). License CC BY-SA 4.0. Open the original link to download.

비슷한 데이터셋

같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.

SAMPLE

Example records

Catalog samples only. Actual files may differ on the original source.

전제

한 남성이 한강 둔치에서 돗자리를 펴고 책을 읽고 있다.

가설

남성은 지금 야외에 누워 잠을 자고 있다.

관계 판정

Contradiction (모순)

Trust & metadata

GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.

Source
GitHub (kakaobrain)Verified
License
CC BY-SA 4.0Verified
Verification
License verified
Language
KoreanNeeds review
Format
TextNeeds review
Size
대용량Not verified
Last checked
2026-09-03
Always re-check license and terms on the original page. Standard license document
Open original dataset