색인 및 OCR
업데이트: 2026년 8월 5일
Theca에 도서를 업로드하는 것이 첫 번째 단계입니다. 검색하거나 요약을 생성하기 전에 도서는 색인 처리 과정을 거쳐야 합니다. 이 문서는 그 과정에서 어떤 일이 일어나는지, 앱이 보여주는 상태를 어떻게 읽는지 설명합니다.
처리가 필요한 이유
Theca의 검색은 원본 파일에서 직접 작동하지 않습니다. 시스템은 텍스트를 추출하고 단편으로 분할하여 정확한 단어를 기억하지 못해도 관련 구절을 찾을 수 있는 표현을 만듭니다. 처리 없이는 도서를 읽고 다운로드하는 것만 가능합니다.
처리 중 앱이 표시하는 내용
각 도서는 카드와 상세 패널에 상태 표시기를 보여줍니다.
- 대기 중 — 도서가 아직 처리 대기열에 들어가지 않았습니다.
- 대기열 — 도서가 차례를 기다리고 있습니다.
- 처리 중 — 색인이 진행 중입니다. 표시기에 진행 수(예: "처리 중 4/10")가 나타날 수 있습니다.
- 처리됨 — 도서가 검색 및 요약에 사용할 준비가 되었습니다.
- 오류 — 다시 시도 — 무언가 실패했습니다. 상세 패널의 다시 시도 버튼으로 다시 시도할 수 있습니다.
도서를 수동으로 대기열에 추가하려면 상세 패널을 열고 처리를 클릭하십시오. 처리되지 않은 도서를 한꺼번에 대기열에 추가하려면 도구 모음의 전체 처리 버튼을 사용하십시오.
스캔된 PDF: 특수한 경우
PDF는 텍스트 레이어 없이 페이지 이미지만으로 구성될 수 있습니다 — 이른바 스캔입니다. Theca가 이를 자동으로 감지하여 스캔됨, 텍스트 없음 상태를 표시합니다.
이 상태의 도서는 읽고 다운로드할 수 있지만 추출할 텍스트가 없으므로 직접 색인할 수 없습니다. 검색 가능하게 하려면 광학 문자 인식(OCR)을 사용해야 합니다.
- 도서의 상세 패널을 여십시오.
- **텍스트 추출 (OCR)**을 클릭하십시오.
OCR은 각 페이지를 이미지로 분석하여 텍스트를 추출합니다. 이 과정은 특히 긴 도서의 경우 일반 색인보다 훨씬 오래 걸립니다. 진행 중에는 상태가 **추출 중…**으로 변경됩니다.
OCR에는 쿨다운 기간이 있습니다. 방금 시작했다가 중단되면 다시 시작하기 전에 몇 분 기다려야 합니다.
기능 배지
도서가 처리되면 인식된 콘텐츠 유형을 나타내는 추가 배지가 표시될 수 있습니다.
- OCR — 광학 인식으로 텍스트가 추출되었습니다(도서가 스캔이었음).
- 수식 — 도서에 인식된 수학 또는 화학 기호가 포함되어 있습니다.
이 배지를 통해 도서를 검색하거나 요약할 때 무엇을 기대할 수 있는지 알 수 있습니다.
도서에 오류가 표시되면 어떻게 해야 하나요
상태에 오류 — 다시 시도가 표시되면 상세 패널을 열고 다시 시도를 클릭하십시오. 여러 번 시도해도 오류가 지속되면 파일을 다운로드하여 기기에서 열어 손상 여부를 확인하십시오.
자주 묻는 질문
일반 색인은 얼마나 걸리나요? 도서 크기와 시스템 부하에 따라 다릅니다. 일반적인 길이의 도서는 보통 몇 분이면 됩니다.
OCR은요? OCR은 각 페이지를 이미지로 분석하므로 일반 색인보다 훨씬 오래 걸립니다. 긴 도서는 몇 분이 걸릴 수 있습니다.
처리 중인 도서를 읽을 수 있나요? 예. 색인 상태와 관계없이 언제든지 리더에서 열 수 있습니다.
도서가 오랫동안 "대기열" 또는 "처리 중" 상태입니다 — 정상인가요? 활동이 많은 시간에는 시스템이 더 오래 걸릴 수 있습니다. 오랜 시간이 지나도 상태가 진행되지 않으면 상세 패널에서 다시 시도를 클릭해 보십시오.