Cómo usar
- Arrastra tu PDF escaneado o solo de imagen a la página, o haz clic para seleccionar un archivo .pdf de tu dispositivo.
- La herramienta renderiza cada página en un lienzo de alta resolución y ejecuta Tesseract OCR, mostrando el progreso en vivo de la página actual.
- Lee el texto reconocido mientras llena el cuadro de salida, página por página, separado por líneas en blanco.
- Copia el texto al portapapeles o descárgalo como archivo .txt — sin subidas, nada sale de tu dispositivo.
Preguntas frecuentes
¿Con qué tipo de PDF funciona esta herramienta de OCR?
Está pensada para PDF escaneados o solo de imagen — páginas que son imágenes sin texto seleccionable incrustado. Cada página se renderiza como imagen y se lee con OCR. Si tu PDF ya tiene una capa de texto real, un extractor de PDF a texto normal será más rápido y preciso.
¿Se sube mi PDF a un servidor?
No. Todo el proceso se ejecuta 100% en tu navegador con pdf.js y Tesseract.js. Tu PDF se lee localmente, el OCR ocurre en tu propio dispositivo y nada se sube nunca, así que tu documento sigue siendo totalmente privado.
¿Qué idiomas puede reconocer?
El OCR usa el modelo de idioma inglés (eng), por lo que funciona mejor con documentos en inglés. El texto en otros alfabetos o con muchos acentos puede no reconocerse con precisión.
¿Hay un límite de tamaño de archivo o de páginas?
No hay un límite fijo, pero el OCR consume muchos recursos y se ejecuta en tu dispositivo. Los PDF grandes con muchas páginas tardan más y usan más memoria, así que los documentos muy grandes o de alta resolución pueden ir lentos en equipos menos potentes.
¿Qué precisión tiene el texto extraído?
La precisión depende del escaneo. Las páginas limpias, con buen contraste, rectas y con una fuente clara dan los mejores resultados. Los escaneos borrosos, páginas torcidas, la letra manuscrita, las fuentes diminutas o los diseños complejos a varias columnas pueden generar errores, así que conviene revisar el resultado.
¿Puedo recuperar el texto?
Sí. El texto reconocido aparece en un cuadro de salida editable donde puedes seleccionarlo, copiarlo al portapapeles con un clic o descargarlo como archivo .txt plano que mantiene cada página separada por una línea en blanco.
Acerca de esta herramienta
OCR de PDF gratis que convierte PDF escaneados o solo de imagen en texto editable con Tesseract en tu dispositivo. Cópialo o descarga un .txt — 100% en tu navegador, sin subidas.