비교

카탈로그 행 두 개를 나란히 보기

표는 각 데이터셋에 이미 적힌 라이선스, 상업 이용 표기, 제공처, 규모 문자열을 옮깁니다. 품질 순위를 매기지 않고, 파일을 다시 재지도 않습니다. 받기 전에 원본 페이지를 엽니다.

카탈로그 전체 집계

강원 영동 건조기 산림 화재 및 연기 · 건설 철골 토목 공사 현장 인부 보호구 착용

강원 영동 건조기 산림 화재 및 연기의 카탈로그 주제는 한국어 비전 데이터셋이고, 건설 철골 토목 공사 현장 인부 보호구 착용의 카탈로그 주제는 한국어 비전 데이터셋입니다. 주제는 제목과 태그를 보고 고른 분류라서, 원본이 적은 공식 과제명과 다를 수 있습니다.

유형 표기는 둘 다 이미지입니다.

라이선스 표기는 강원 영동 건조기 산림 화재 및 연기가 AI Hub 이용안내 (확인됨), 건설 철골 토목 공사 현장 인부 보호구 착용가 AI Hub 이용안내 (확인됨)입니다.

상업 이용 표기는 강원 영동 건조기 산림 화재 및 연기가 조건부 가능, 건설 철골 토목 공사 현장 인부 보호구 착용가 조건부 가능입니다. 카탈로그 표기이며 법률 판단이 아닙니다.

제공처 표기는 강원 영동 건조기 산림 화재 및 연기가 AI Hub (원본 주소 미확인), 건설 철골 토목 공사 현장 인부 보호구 착용가 AI Hub (원본 주소 미확인)입니다.

규모 문자열은 강원 영동 건조기 산림 화재 및 연기가 45K 상공뷰, 150GB, 건설 철골 토목 공사 현장 인부 보호구 착용가 400K 프레임, 1.2TB입니다. 기어델이 파일을 받아 다시 센 값이 아닙니다.

연도 표기는 강원 영동 건조기 산림 화재 및 연기가 2022, 건설 철골 토목 공사 현장 인부 보호구 착용가 2021입니다.

칸강원 영동 건조기 산림 화재 및 연기건설 철골 토목 공사 현장 인부 보호구 착용
주제한국어 비전 데이터셋한국어 비전 데이터셋
유형이미지이미지
라이선스AI Hub 이용안내AI Hub 이용안내
라이선스 확인확인됨확인됨
상업 이용 표기조건부 가능조건부 가능
제공처AI HubAI Hub
원본 주소미확인미확인
언어한국어한국어
형식ImageImage
규모 문자열45K 상공뷰 · 150GB400K 프레임 · 1.2TB
연도20222021

미리 풀어 둔 비교

고르는 칸을 쓰지 않아도 차이를 읽을 수 있게, 이 쌍은 HTML에 그대로 둡니다.

KMMLU · KoBEST

KMMLU의 카탈로그 주제는 한국어 LLM 벤치마크이고, KoBEST의 카탈로그 주제는 한국어 LLM 벤치마크입니다. 주제는 제목과 태그를 보고 고른 분류라서, 원본이 적은 공식 과제명과 다를 수 있습니다.

유형 표기는 둘 다 텍스트입니다.

라이선스 표기는 KMMLU가 CC BY-ND 4.0 (확인됨), KoBEST가 CC BY-SA 4.0 (확인됨)입니다.

상업 이용 표기는 KMMLU가 불가, KoBEST가 가능입니다. 카탈로그 표기이며 법률 판단이 아닙니다.

제공처 표기는 KMMLU가 Hugging Face (원본 주소 확인됨), KoBEST가 Hugging Face (원본 주소 확인됨)입니다.

규모 문자열은 KMMLU가 35,030 테스트 문항, 70.7 MB, KoBEST가 4.8K 문항, 5.1MB입니다. 기어델이 파일을 받아 다시 센 값이 아닙니다.

연도 표기는 KMMLU가 2024, KoBEST가 2022입니다.

칸KMMLUKoBEST
주제한국어 LLM 벤치마크한국어 LLM 벤치마크
유형텍스트텍스트
라이선스CC BY-ND 4.0CC BY-SA 4.0
라이선스 확인확인됨확인됨
상업 이용 표기불가가능
제공처Hugging FaceHugging Face
원본 주소확인됨확인됨
언어한국어한국어
형식TextText
규모 문자열35,030 테스트 문항 · 70.7 MB4.8K 문항 · 5.1MB
연도20242022

KMMLU · KMMLU-Pro

KMMLU의 카탈로그 주제는 한국어 LLM 벤치마크이고, KMMLU-Pro의 카탈로그 주제는 한국어 LLM 벤치마크입니다. 주제는 제목과 태그를 보고 고른 분류라서, 원본이 적은 공식 과제명과 다를 수 있습니다.

유형 표기는 둘 다 텍스트입니다.

라이선스 표기는 KMMLU가 CC BY-ND 4.0 (확인됨), KMMLU-Pro가 CC BY-NC 4.0 (확인됨)입니다.

상업 이용 표기는 KMMLU가 불가, KMMLU-Pro가 가능입니다. 카탈로그 표기이며 법률 판단이 아닙니다.

제공처 표기는 KMMLU가 Hugging Face (원본 주소 확인됨), KMMLU-Pro가 Hugging Face (LGAI-EXAONE) (원본 주소 확인됨)입니다.

규모 문자열은 KMMLU가 35,030 테스트 문항, 70.7 MB, KMMLU-Pro가 2,822개 고난도 전문 문항, 12MB입니다. 기어델이 파일을 받아 다시 센 값이 아닙니다.

연도 표기는 KMMLU가 2024, KMMLU-Pro가 2025입니다.

칸KMMLUKMMLU-Pro
주제한국어 LLM 벤치마크한국어 LLM 벤치마크
유형텍스트텍스트
라이선스CC BY-ND 4.0CC BY-NC 4.0
라이선스 확인확인됨확인됨
상업 이용 표기불가가능
제공처Hugging FaceHugging Face (LGAI-EXAONE)
원본 주소확인됨확인됨
언어한국어한국어
형식TextText
규모 문자열35,030 테스트 문항 · 70.7 MB2,822개 고난도 전문 문항 · 12MB
연도20242025

KsponSpeech · KSS Dataset

KsponSpeech의 카탈로그 주제는 한국어 자유발화 음성인식이고, KSS Dataset의 카탈로그 주제는 한국어 TTS 데이터셋입니다. 주제는 제목과 태그를 보고 고른 분류라서, 원본이 적은 공식 과제명과 다를 수 있습니다.

유형 표기는 둘 다 음성입니다.

라이선스 표기는 KsponSpeech가 AI Hub 이용안내 (확인됨), KSS Dataset가 CC BY-NC-SA 4.0 (확인됨)입니다.

상업 이용 표기는 KsponSpeech가 조건부 가능, KSS Dataset가 불가입니다. 카탈로그 표기이며 법률 판단이 아닙니다.

제공처 표기는 KsponSpeech가 AI Hub (원본 주소 확인됨), KSS Dataset가 Hugging Face (원본 주소 확인됨)입니다.

규모 문자열은 KsponSpeech가 2,000명 발성 · WAV/전사, 1000시간, KSS Dataset가 WAV 음성 12,853개, 12시간+입니다. 기어델이 파일을 받아 다시 센 값이 아닙니다.

연도 표기는 KsponSpeech가 2018, KSS Dataset가 2018입니다.

칸KsponSpeechKSS Dataset
주제한국어 자유발화 음성인식한국어 TTS 데이터셋
유형음성음성
라이선스AI Hub 이용안내CC BY-NC-SA 4.0
라이선스 확인확인됨확인됨
상업 이용 표기조건부 가능불가
제공처AI HubHugging Face
원본 주소확인됨확인됨
언어한국어한국어
형식AudioAudio
규모 문자열2,000명 발성 · WAV/전사 · 1000시간WAV 음성 12,853개 · 12시간+
연도20182018

KLUE Benchmark · KoBEST

KLUE Benchmark의 카탈로그 주제는 한국어 LLM 벤치마크이고, KoBEST의 카탈로그 주제는 한국어 LLM 벤치마크입니다. 주제는 제목과 태그를 보고 고른 분류라서, 원본이 적은 공식 과제명과 다를 수 있습니다.

유형 표기는 둘 다 텍스트입니다.

라이선스 표기는 KLUE Benchmark가 CC BY-SA 4.0 (확인됨), KoBEST가 CC BY-SA 4.0 (확인됨)입니다.

상업 이용 표기는 KLUE Benchmark가 조건부 가능, KoBEST가 가능입니다. 카탈로그 표기이며 법률 판단이 아닙니다.

제공처 표기는 KLUE Benchmark가 Hugging Face (원본 주소 확인됨), KoBEST가 Hugging Face (원본 주소 확인됨)입니다.

규모 문자열은 KLUE Benchmark가 8개 과제, 62.3 MB, KoBEST가 4.8K 문항, 5.1MB입니다. 기어델이 파일을 받아 다시 센 값이 아닙니다.

연도 표기는 KLUE Benchmark가 2021, KoBEST가 2022입니다.

칸KLUE BenchmarkKoBEST
주제한국어 LLM 벤치마크한국어 LLM 벤치마크
유형텍스트텍스트
라이선스CC BY-SA 4.0CC BY-SA 4.0
라이선스 확인확인됨확인됨
상업 이용 표기조건부 가능가능
제공처Hugging FaceHugging Face
원본 주소확인됨확인됨
언어한국어한국어
형식TextText
규모 문자열8개 과제 · 62.3 MB4.8K 문항 · 5.1MB
연도20212022

KoAlpaca-v1.1a · KULLM-v2 (한국어 지시문)

KoAlpaca-v1.1a의 카탈로그 주제는 한국어 지시문 학습 데이터셋이고, KULLM-v2 (한국어 지시문)의 카탈로그 주제는 한국어 지시문 학습 데이터셋입니다. 주제는 제목과 태그를 보고 고른 분류라서, 원본이 적은 공식 과제명과 다를 수 있습니다.

유형 표기는 둘 다 텍스트입니다.

라이선스 표기는 KoAlpaca-v1.1a가 없음 (미확인), KULLM-v2 (한국어 지시문)가 Apache 2.0 (확인됨)입니다.

상업 이용 표기는 KoAlpaca-v1.1a가 가능, KULLM-v2 (한국어 지시문)가 가능입니다. 카탈로그 표기이며 법률 판단이 아닙니다.

제공처 표기는 KoAlpaca-v1.1a가 Hugging Face (원본 주소 확인됨), KULLM-v2 (한국어 지시문)가 Hugging Face (원본 주소 확인됨)입니다.

규모 문자열은 KoAlpaca-v1.1a가 21,155개 지시어, 대용량, KULLM-v2 (한국어 지시문)가 152,630 샘플, 180MB입니다. 기어델이 파일을 받아 다시 센 값이 아닙니다.

연도 표기는 KoAlpaca-v1.1a가 2023, KULLM-v2 (한국어 지시문)가 2023입니다.

칸KoAlpaca-v1.1aKULLM-v2 (한국어 지시문)
주제한국어 지시문 학습 데이터셋한국어 지시문 학습 데이터셋
유형텍스트텍스트
라이선스없음Apache 2.0
라이선스 확인미확인확인됨
상업 이용 표기가능가능
제공처Hugging FaceHugging Face
원본 주소확인됨확인됨
언어한국어한국어
형식TextText
규모 문자열21,155개 지시어 · 대용량152,630 샘플 · 180MB
연도20232023