Indexado y OCR
Actualizado el 5 de agosto de 2026
Subir un libro a Theca es el primer paso. Antes de poder buscarlo o generar un resumen a partir de él, el libro tiene que pasar por un proceso de indexado. Este artículo explica qué ocurre en ese proceso y cómo interpretar los estados que muestra la app.
Por qué es necesario el procesamiento
La búsqueda de Theca no trabaja con el archivo crudo. El sistema extrae el texto, lo divide en fragmentos y construye una representación que permite encontrar pasajes relevantes incluso cuando no recuerdas las palabras exactas. Sin ese procesamiento, el libro solo puede leerse y descargarse.
Qué indica la app mientras tanto
Cada libro muestra un indicador de estado en su tarjeta y en el panel de detalle:
- Pendiente — el libro aún no ha entrado en la cola de procesamiento.
- En cola — el libro está esperando su turno.
- Procesando — el indexado está en curso. El indicador puede mostrar el avance (por ejemplo, "Procesando 4/10").
- Procesado — el libro está listo para la búsqueda y los resúmenes.
- Error — reintentar — algo falló. Puedes volver a intentarlo con el botón Reintentar del panel de detalle.
Para poner un libro en cola manualmente, abre su panel de detalle y haz clic en Procesar. Si quieres encolar todos los libros pendientes a la vez, usa el botón Procesar todo en la barra de herramientas.
PDF escaneados: el caso especial
Un PDF puede ser solo imágenes de páginas sin ninguna capa de texto — lo que se llama un escaneo. Theca lo detecta automáticamente y muestra el estado Escaneo sin texto.
Un libro en ese estado puede leerse y descargarse, pero no puede indexarse directamente porque no hay texto que extraer. Para habilitarlo en la búsqueda, necesitas usar el reconocimiento óptico de caracteres (OCR):
- Abre el panel de detalle del libro.
- Haz clic en Extraer texto (OCR).
El OCR analiza cada página como imagen y extrae el texto. Este proceso tarda bastante más que el indexado normal, especialmente en libros largos. Mientras avanza, el estado cambia a Extrayendo…
El OCR tiene un período de enfriamiento: si acabas de lanzarlo y lo cancelas, tendrás que esperar unos minutos antes de poder iniciarlo de nuevo.
Marcas de capacidad
Una vez procesado, el libro puede mostrar marcas adicionales que indican qué tipo de contenido reconoció:
- OCR — el texto se extrajo mediante reconocimiento óptico (el libro era un escaneo).
- Fórmulas — el libro contiene notación matemática o química reconocida.
Estas marcas te ayudan a saber qué puedes esperar al buscar o resumir ese libro.
Qué hacer si un libro quedó con error
Si el estado muestra Error — reintentar, abre el panel de detalle y haz clic en Reintentar. Si el error persiste con varios intentos, comprueba que el archivo no esté dañado descargándolo y abriéndolo en tu dispositivo.
Preguntas frecuentes
¿Cuánto tarda el procesamiento normal? Depende del tamaño del libro y de la carga del sistema. Generalmente es cuestión de minutos para libros de tamaño habitual.
¿Y el OCR? El OCR tarda bastante más que el indexado normal porque analiza cada página como imagen. Los libros largos pueden tardar varios minutos.
¿Puedo leer un libro mientras se procesa? Sí. Puedes abrirlo en el lector en cualquier momento, independientemente de su estado de indexado.
El libro lleva mucho tiempo "En cola" o "Procesando", ¿es normal? En momentos de alta actividad el sistema puede tardar más. Si el estado no avanza después de un tiempo prolongado, intenta hacer clic en Reintentar desde el panel de detalle.
Siguiente paso
- Buscar en tu biblioteca — cómo funciona la búsqueda una vez que los libros están procesados.
- Resúmenes — genera resúmenes con citas a partir de tus libros indexados.
- Tu biblioteca — volver a los conceptos básicos de la biblioteca.