2. 데이터셋 만들기
데이터셋을 만들고 이미지와 어노테이션 파일을 올립니다
필요 권한: 데이터셋 쓰기DEVELOPER · OPERATOR · ADMIN
데이터셋은 이름만으로 바로 만들어지고, 파일은 그 뒤에 상세 화면에서 얼마든지 더하거나 뺄 수 있습니다. 따로 "확정" 단계는 없습니다. 파일이 들어올 때마다 서버가 검증하고 파일 목록(매니페스트)과 집계를 다시 기록합니다.
이 튜토리얼에서는 현장 카메라 사진(.jpg)과 LabelMe 형식 어노테이션(.json) 8쌍을 올립니다. 클래스는 helmet(안전모)과 head(맨머리) 두 가지입니다.
- 사이드바 데이터셋에서 새 데이터셋①을 누릅니다.
데이터셋 목록: ① 새 데이터셋 - 직접 업로드를 고르고 이름을 적습니다. 모달리티는 이미지 (+어노테이션), 소스 (선택)에는 데이터가 나온 곳을 메모해 둡니다. 등록을 누르면 데이터셋 상세로 이동합니다.
새 데이터셋: 직접 업로드, 이름·모달리티·소스 - 파일 탭에서 파일이나 폴더를 점선 상자①에 끌어다 놓습니다(눌러서 고를 수도 있습니다). 이미지와 같은 이름의 어노테이션이 짝이 되어, 올라가는 대로 유효·오류가 표시됩니다.
데이터셋 상세의 파일 탭: ① 파일을 끌어다 놓는 곳 ② 이 데이터셋으로 학습 - 개요 탭에서 파일 집계와 검증 결과를 확인합니다. "모든 이미지에 라벨 짝이 있습니다" 와 이름 옆 학습 가능 배지가 보이면 학습에 쓸 수 있습니다.
데이터셋 개요: 파일이 들어오면 검증 결과와 클래스 분포가 바로 갱신됩니다
올릴 수 있는 파일
| 모달리티 | 확장자 |
|---|---|
| 이미지 (+어노테이션) | .png .jpg .jpeg .bmp .tiff .webp + .json .xml, 묶음 .zip |
| 포인트클라우드 (PLY) | .ply, .zip |
| 시계열 / 표 형식 | .csv .tsv .parquet, .zip |
- 어노테이션은 LabelMe·COCO·VOC 형식을 서버가 검증 단계에서 알아봅니다.
- 32 MiB 가 넘는 파일과
.zip은 브라우저가 알아서 조각(청크)으로 나눠 보내므로 중간에 끊겨도 이어 갑니다. 파일 하나는 최대 2 GiB(서버 기본값)입니다. - 파일 이름은 폴더 구조 없이 파일 이름만 남습니다. 서로 다른 폴더에 같은 이름이 있으면 겹치니 주의하세요.
오른쪽 위 이 데이터셋으로 학습②(파일 탭 그림)을 누르면 이 데이터셋이 미리 골라진 채로 새 학습 마법사가 열립니다.
다음: 3. 새 학습