한국어 LLM 벤치마크 · 텍스트
KLUE 한국어 유사도 측정 데이터셋
한국어 LLM 벤치마크·Korean LLM Benchmark Dataset
서로 다른 문장 두 개가 의미상으로 얼마나 유사한지를 0점에서 5점 사이의 실수값으로 세밀하게 채점해 둔 시맨틱 문장 유사도(Semantic Textual Similarity) 데이터셋입니다.
Source
Hugging Face (KLUE)
License
CC BY-SA 4.0
Catalog verified
Language
Korean
Needs review
Format
Text
Needs review
Size
소용량
11K 문장쌍
Year
2021
이 데이터셋이 맞는 경우
KLUE 한국어 유사도 측정 데이터셋은 Hugging Face (KLUE)에서 제공하는 한국어 LLM 벤치마크입니다. 태그: 유사도, STS, 임베딩평가, KLUE. 라이선스 표기: CC BY-SA 4.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.
- 과제 / 카테고리
- 텍스트 · 텍스트 · 유사도, STS, 임베딩평가, KLUE
- Language
- Korean
- Format · Size
- Text · 소용량 (11K 문장쌍)
- License
- CC BY-SA 4.0(Catalog verified) · License document
- Source & original link
- Hugging Face (KLUE) · Original dataset link(Verified)
- Verification status
- Source: Verified · License: Verified · Last checked: 2026-09-03
KLUE 한국어 유사도 측정 데이터셋: Korean LLM Benchmark Dataset from Hugging Face (KLUE). License CC BY-SA 4.0. Open the original link to download.
비슷한 데이터셋
같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.
SAMPLE
Example records
Catalog samples only. Actual files may differ on the original source.
문장 A
오늘 점심에는 따뜻한 국밥 한 그릇을 먹을 예정이다.
문장 B
금일 낮에는 온기 있는 국밥을 한 대접 먹으려고 한다.
유사 점수
4.8 (매우 유사)
Trust & metadata
GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.
- Source
- Hugging Face (KLUE)Verified
- Source URL
- https://huggingface.co/datasets/klue/klueVerified
- License
- CC BY-SA 4.0Verified
- Verification
- License verified
- Language
- KoreanNeeds review
- Format
- TextNeeds review
- Size
- 소용량Not verified
- Last checked
- 2026-09-03