카탈로그

한국어 AI 데이터셋 이름순 목록

286개 중 281–286 · 8 / 8쪽

홈에 카탈로그 전체를 넣지 않기 위해, 같은 목록을 짧은 HTML 페이지로 나눈 보기입니다. 라이선스와 용량은 저장된 표기입니다. 음성·OCR·지시문·감성은 모음 페이지에 있습니다. 기어델은 파일을 보관하지 않습니다.

과제별로 고르기 →·홈에서 검색 →

이름용도제공처크기라이선스상업이용
TinyStories 한국어 번역 데이터셋한국어 번역 데이터셋Hugging Face대용량MIT가능
ToM-Diary 한국어 마음이해(Theory of Mind) 데이터셋한국어 NLP 데이터셋GitHub8.5MBApache 2.0가능
TyDi-QA (ko) (구글 다국어 질의응답)한국어 QA 데이터셋GitHub18.5MBApache 2.0가능
WanJuanSiLu 한국어 고품질 웹 텍스트 코퍼스한국어 대화 데이터셋Hugging Face (opendatalab)124 GBCC BY 4.0가능
xP3x 한국어 프롬프트 서브셋한국어 지시문 학습 데이터셋Hugging Face한글 4,642,468행Apache 2.0조건부 가능
Zeroth 한국어 음성 인식 오픈소스 데이터셋한국어 음성인식 데이터셋GitHub대용량Apache 2.0가능