한국어 LLM 벤치마크 · 텍스트

📰
유사도STS임베딩평가KLUE

KLUE 한국어 유사도 측정 데이터셋

한국어 LLM 벤치마크·Korean LLM Benchmark Dataset

서로 다른 문장 두 개가 의미상으로 얼마나 유사한지를 0점에서 5점 사이의 실수값으로 세밀하게 채점해 둔 시맨틱 문장 유사도(Semantic Textual Similarity) 데이터셋입니다.

Source VerifiedLicense Verified
Commercial use: 가능(catalog)

Source

Hugging Face (KLUE)

License

CC BY-SA 4.0

Catalog verified

Language

Korean

Needs review

Format

Text

Needs review

Size

소용량

11K 문장쌍

Year

2021

이 데이터셋이 맞는 경우

KLUE 한국어 유사도 측정 데이터셋은 Hugging Face (KLUE)에서 제공하는 한국어 LLM 벤치마크입니다. 태그: 유사도, STS, 임베딩평가, KLUE. 라이선스 표기: CC BY-SA 4.0. 카탈로그 기준으로는 상업 이용 가능으로 표시되어 있습니다. GearDel은 탐색 카탈로그이며 파일을 호스팅하지 않습니다.

과제 / 카테고리
텍스트 · 텍스트 · 유사도, STS, 임베딩평가, KLUE
Language
Korean
Format · Size
Text · 소용량 (11K 문장쌍)
License
CC BY-SA 4.0(Catalog verified) · License document
Source & original link
Hugging Face (KLUE) · Original dataset link(Verified)
Verification status
Source: Verified · License: Verified · Last checked: 2026-09-03

KLUE 한국어 유사도 측정 데이터셋: Korean LLM Benchmark Dataset from Hugging Face (KLUE). License CC BY-SA 4.0. Open the original link to download.

비슷한 데이터셋

같은 유형·태그·제공처를 공유하는 카탈로그 항목입니다.

SAMPLE

Example records

Catalog samples only. Actual files may differ on the original source.

문장 A

오늘 점심에는 따뜻한 국밥 한 그릇을 먹을 예정이다.

문장 B

금일 낮에는 온기 있는 국밥을 한 대접 먹으려고 한다.

유사 점수

4.8 (매우 유사)

Trust & metadata

GearDel does not host datasets. Status below is catalog metadata and may differ from the original provider.

Source
Hugging Face (KLUE)Verified
License
CC BY-SA 4.0Verified
Verification
License verified
Language
KoreanNeeds review
Format
TextNeeds review
Size
소용량Not verified
Last checked
2026-09-03
Always re-check license and terms on the original page. Standard license document
Open original dataset