카탈로그
한국어 AI 데이터셋 이름순 목록
286개 중 121–160 · 4 / 8쪽
홈에 카탈로그 전체를 넣지 않기 위해, 같은 목록을 짧은 HTML 페이지로 나눈 보기입니다. 라이선스와 용량은 저장된 표기입니다. 음성·OCR·지시문·감성은 모음 페이지에 있습니다. 기어델은 파일을 보관하지 않습니다.
| 이름 | 용도 | 제공처 | 크기 | 라이선스 | 상업이용 |
|---|---|---|---|---|---|
| 한국어 기초 간호 기록지 익명 명세 코퍼스 | 한국어 사전학습 코퍼스 | GitHub | 중용량 | Apache 2.0 | 가능 |
| 한국어 다단계 논리 추론 데이터셋 | 한국어 QA 데이터셋 | Hugging Face | 소용량 | Apache 2.0 | 가능 |
| 한국어 단문 및 장문 SMS 스팸 분류 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 대규모 기계독해 데이터셋 2.0 (KorQuAD) | 한국어 QA 데이터셋 | KorQuAD 공식 | 대용량 (표 포함) | CC BY-ND 4.0 | 가능 |
| 한국어 대화 요약 데이터셋 | 한국어 요약 데이터셋 | AI Hub | 대용량 | AI Hub 이용안내 | 조건부 가능 |
| 한국어 말투 및 종결어미 스타일 변환 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 중용량 | MIT | 가능 |
| 한국어 문법성 판단 및 비문 교정 데이터셋 | 한국어 문법 평가 벤치마크 | GitHub | 소용량 | MIT | 가능 |
| 한국어 반어법 및 비꼼 감정 분류 데이터셋 | 한국어 감성분석 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 사설 및 논설 아규먼트 마이닝 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 사전학습 위키 코퍼스 | 한국어 사전학습 코퍼스 | Hugging Face | 중용량 | MIT | 가능 |
| 한국어 상식 추론 객관식 평가 벤치마크 | 한국어 LLM 벤치마크 | Hugging Face | 소용량 | Apache 2.0 | 가능 |
| 한국어 상업용 지시어 데이터셋 | 한국어 지시문 학습 데이터셋 | Hugging Face | 대용량 | MIT | 가능 |
| 한국어 생활 법률 민원 지식 데이터셋 | 한국어 NLP 데이터셋 | Hugging Face | 중용량 | Apache 2.0 | 가능 |
| 한국어 소형 IoT 스마트홈 제어 음성 데이터 | 한국어 음성 데이터셋 | GitHub | 중용량 | Apache 2.0 | 가능 |
| 한국어 속담 및 관용구 해석 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 속담 빈칸 완성 데이터셋 | 한국어 LLM 벤치마크 | GitHub | 소용량 | MIT | 가능 |
| 한국어 수학 문장형 문제 풀이 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 수학 추론 데이터셋 | 한국어 NLP 데이터셋 | Hugging Face | 120MB | 원본 확인 | 가능 |
| 한국어 숙어 및 다어휘식 영어 번역 병렬 데이터셋 | 한국어 번역 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 신조어 및 인터넷 밈(Meme) 해설 사전 데이터 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 안전성 벤치마크 (KoSafetyBench) | 한국어 LLM 벤치마크 | Hugging Face | 15MB | CC BY 4.0 | 가능 |
| 한국어 오탈자 및 띄어쓰기 문장 교정 코퍼스 | 한국어 사전학습 코퍼스 | GitHub | 중용량 | MIT | 가능 |
| 한국어 온라인 댓글 욕설 탐지 데이터셋 | 한국어 유해성 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 요식업 배달 앱 리뷰 감성 분류 데이터셋 | 한국어 감성분석 데이터셋 | GitHub | 중용량 | MIT | 가능 |
| 한국어 위키 개요 자동 요약 데이터셋 | 한국어 요약 데이터셋 | Hugging Face | 중용량 | CC BY-SA 4.0 | 가능 |
| 한국어 위키백과 교육용 필터 코퍼스 | 한국어 사전학습 코퍼스 | Hugging Face | 764MB | CC BY-SA 4.0 | 조건부 가능 |
| 한국어 위키백과 정제 말뭉치 | 한국어 대화 데이터셋 | GitHub | 중용량 | CC BY-SA 4.0 | 가능 |
| 한국어 위키피디아 기반 상식 질의응답 데이터셋 | 한국어 QA 데이터셋 | Hugging Face | 중용량 | MIT | 가능 |
| 한국어 은유 및 시적 비유 감지 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 의문사 기반 질문 분류 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 의미상 동치 문장 판별 데이터셋 | 한국어 NLP 데이터셋 | Hugging Face | 중용량 | Apache 2.0 | 가능 |
| 한국어 이미지 정밀 묘사 데이터셋 | 한국어 비전 데이터셋 | Hugging Face (Nagase-Kotono) | 대용량 (7.85 GB) | Apache 2.0 | 가능 |
| 한국어 이커머스 쇼핑몰 고객 의도 분류 데이터 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 인공 교과서 코퍼스 데이터셋 | 한국어 사전학습 코퍼스 | Hugging Face | 대용량 | Apache 2.0 | 가능 |
| 한국어 일반 의학 및 자가 진단 상담 데이터셋 | 한국어 NLP 데이터셋 | Hugging Face | 중용량 | Apache 2.0 | 가능 |
| 한국어 일반상식 멀티초이스 데이터 | 한국어 QA 데이터셋 | AI Hub | 45MB | AI Hub 이용안내 | 조건부 가능 |
| 한국어 일상 구어체 대화 데이터셋 | 한국어 대화 데이터셋 | Hugging Face | 대용량 | Apache 2.0 | 가능 |
| 한국어 일상 스몰토크 치챗 코퍼스 | 한국어 감성분석 데이터셋 | GitHub | 중용량 | MIT | 가능 |
| 한국어 자소-음소 변환 소리 정렬 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국어 전문 한자 용어 쉬운 말 풀이 코퍼스 | 한국어 사전학습 코퍼스 | Hugging Face | 소용량 | Apache 2.0 | 가능 |