카탈로그
한국어 AI 데이터셋 이름순 목록
286개 중 81–120 · 3 / 8쪽
홈에 카탈로그 전체를 넣지 않기 위해, 같은 목록을 짧은 HTML 페이지로 나눈 보기입니다. 라이선스와 용량은 저장된 표기입니다. 음성·OCR·지시문·감성은 모음 페이지에 있습니다. 기어델은 파일을 보관하지 않습니다.
| 이름 | 용도 | 제공처 | 크기 | 라이선스 | 상업이용 |
|---|---|---|---|---|---|
| 전국 주요 랜드마크 및 고궁 문화 경관 | 한국어 비전 데이터셋 | AI Hub | 1.1TB | AI Hub 이용안내 | 조건부 가능 |
| 전기 전자 분야 기술 특허 상세 명세 | 한국어 NLP 데이터셋 | AI Hub | 1.5GB | AI Hub 이용안내 | 조건부 가능 |
| 전문 학술지 및 도서 요약 데이터 | 한국어 요약 데이터셋 | AI Hub | 750MB | AI Hub 이용안내 | 조건부 가능 |
| 전통 악기 연주 및 음정 오디오셋 | 한국어 음성 데이터셋 | AI Hub | 85GB | AI Hub 이용안내 | 조건부 가능 |
| 정부 부처 및 국회 토론 회의 록 음성 | 한국어 음성 데이터셋 | AI Hub | 600시간 | AI Hub 이용안내 | 조건부 가능 |
| 정신건강 웰니스 챗봇 상담 질의응답 | 한국어 QA 데이터셋 | AI Hub | 8.5MB | AI Hub 이용안내 | 조건부 가능 |
| 조선왕조실록 및 고전 한문 번역 병렬 데이터 | 한국어 번역 데이터셋 | AI Hub | 1.8GB | AI Hub 이용안내 | 조건부 가능 |
| 주요 영자 신문 및 연합뉴스 한영 병렬 뉴스 | 한국어 번역 데이터셋 | AI Hub | 620MB | AI Hub 이용안내 | 조건부 가능 |
| 중소기업 기술 애로 상담 및 전문가 문답 | 한국어 NLP 데이터셋 | AI Hub | 130MB | AI Hub 이용안내 | 조건부 가능 |
| 지역별 방언 음성 코퍼스 | 한국어 음성 데이터셋 | AI Hub | 500시간 | AI Hub 이용안내 | 조건부 가능 |
| 지역별 한국어 방언 표준어 매치 | 한국어 NLP 데이터셋 | AI Hub | 320MB | AI Hub 이용안내 | 조건부 가능 |
| 지자체 대표 관광 마케팅 카드뉴스 요약 | 한국어 요약 데이터셋 | AI Hub | 85MB | AI Hub 이용안내 | 조건부 가능 |
| 차량 소음 융합 하이테크 음성 제어 | 한국어 음성 데이터셋 | AI Hub | 200시간 | AI Hub 이용안내 | 조건부 가능 |
| 청와대 국민청원 데이터셋 | 한국어 NLP 데이터셋 | Hugging Face | 대용량 | MIT | 가능 |
| 초중고 국어 및 교육용 지문 데이터셋 | 한국어 NLP 데이터셋 | AI Hub | 190MB | AI Hub 이용안내 | 조건부 가능 |
| 카카오브레인 KorNLI 자연어 추론 데이터셋 | 한국어 NLP 데이터셋 | GitHub (kakaobrain) | 대용량 | CC BY-SA 4.0 | 가능 |
| 카카오브레인 KorSTS 문장 유사도 데이터셋 | 한국어 NLP 데이터셋 | GitHub (kakaobrain) | 소용량 | CC BY-SA 4.0 | 가능 |
| 카카오엔터프라이즈 한국어 멀티턴 적대적 대화 데이터셋 | 한국어 지시문 학습 데이터셋 | GitHub | 소용량 | Apache 2.0 | 가능 |
| 캐럿AI 한국어 지시어 데이터셋 | 한국어 지시문 학습 데이터셋 | Hugging Face | 소용량 | Apache 2.0 | 가능 |
| 통합 상담사-고객 대화 분류 및 요약 | 한국어 요약 데이터셋 | AI Hub | 780MB | AI Hub 이용안내 | 조건부 가능 |
| 특허 명세서 분석 및 자동 Q&A | 한국어 NLP 데이터셋 | AI Hub | 890MB | AI Hub 이용안내 | 조건부 가능 |
| 판례 및 법률 조문 임베딩 데이터 | 한국어 NLP 데이터셋 | AI Hub | 1.1GB | AI Hub 이용안내 | 조건부 가능 |
| 피부과 탈모 및 여드름 아토피 접사 | 한국어 비전 데이터셋 | AI Hub | 320GB | AI Hub 이용안내 | 조건부 가능 |
| 한-영 IT 시스템 엔지니어링 기술 설명서 번역 | 한국어 번역 데이터셋 | AI Hub | 410MB | AI Hub 이용안내 | 조건부 가능 |
| 한-일 관광 가이드 및 지하철 노선 안내 번역 | 한국어 번역 데이터셋 | AI Hub | 120MB | AI Hub 이용안내 | 조건부 가능 |
| 한-중 무역 계약서 및 공식 비즈니스 번역 | 한국어 번역 데이터셋 | AI Hub | 320MB | AI Hub 이용안내 | 조건부 가능 |
| 한국 거리 전경 고정밀 OCR 자료 | 한국어 OCR 데이터셋 | AI Hub | 1.5TB | AI Hub 이용안내 | 조건부 가능 |
| 한국 근현대 시 문학 말뭉치 | 한국어 대화 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국 문화 맥락 이해 벤치마크 데이터셋 | 한국어 LLM 벤치마크 | Hugging Face (SOGANG-ISDS) | 소용량 | Apache 2.0 | 가능 |
| 한국 방언 및 팔도 사투리 전사 메타데이터 | 한국어 음성 데이터셋 | AI Hub / GitHub | 대용량 | Apache 2.0 | 가능 |
| 한국 보컬 가창 음원 및 분리 코퍼스 | 한국어 음성 데이터셋 | AI Hub | 150GB | AI Hub 이용안내 | 조건부 가능 |
| 한국 선거 여론 및 미디어 오피니언 분석 데이터셋 | 한국어 NLP 데이터셋 | Hugging Face (AFOS-Analytics1) | 45MB | CC BY 4.0 | 가능 |
| 한국 수어 카메라 캡처 영상 및 주석 | 한국어 음성 데이터셋 | AI Hub | 4TB | AI Hub 이용안내 | 조건부 가능 |
| 한국 전통 요리법 및 조리 순서 데이터셋 | 한국어 NLP 데이터셋 | GitHub | 소용량 | MIT | 가능 |
| 한국 특허 정보 다국어 번역 병렬 데이터 | 한국어 번역 데이터셋 | GitHub / AI Hub | 대용량 | Apache 2.0 | 가능 |
| 한국어 7대 감정 음성 전사 데이터셋 | 한국어 TTS 데이터셋 | AI Hub / GitHub | 대용량 | Apache 2.0 | 가능 |
| 한국어 교육용 필터링 웹텍스트 데이터셋 | 한국어 사전학습 코퍼스 | Hugging Face (devngho) | 대용량 | MIT | 가능 |
| 한국어 금융 뉴스 감성 분석 데이터셋 | 한국어 감성분석 데이터셋 | GitHub | 소용량 | Apache 2.0 | 가능 |
| 한국어 금융 특화 지시어 데이터셋 | 한국어 지시문 학습 데이터셋 | Hugging Face | 중용량 | MIT | 가능 |
| 한국어 금표준(Gold Standard) 개체명 인식 데이터 | 한국어 개체명 데이터셋 | GitHub | 소용량 | MIT | 가능 |