OCR de PDF

OCR de PDF es una herramienta gratuita que ejecuta reconocimiento óptico de caracteres sobre páginas escaneadas directamente en tu navegador. Elige los idiomas y obtén el texto como TXT o como PDF con búsqueda. Los modelos de idioma se descargan una sola vez y se guardan en caché; tus documentos nunca salen del dispositivo.

Mascota de PDFerret: una comadreja blanca lista para trabajar

Suelta archivos PDF aquí o haz clic para explorar

Los archivos se quedan en tu madriguera: todo se procesa en tu dispositivo, sin subidas.

Cómo usar esta herramienta

  1. 1Suelta un PDF escaneado en la herramienta.
  2. 2Elige uno o más idiomas de reconocimiento y la resolución del escaneo (150 o 300 DPI).
  3. 3Selecciona la salida: texto plano, PDF con búsqueda (imagen de página más capa de texto invisible) o ambos.
  4. 4Pulsa Reconocer y sigue el progreso página a página; descarga el resultado al terminar.

Preguntas frecuentes

¿Por qué la primera ejecución tarda en arrancar?

El modelo del idioma debe descargarse una vez, entre 1 y 3 MB por idioma. Tras esa primera descarga queda en caché en tu dispositivo y las siguientes veces arranca al instante.

¿Funciona con cualquier PDF escaneado?

No, la calidad del escaneo decide. Páginas rectas y uniformes a 200 DPI o más se reconocen bien. Páginas torcidas, luz escasa o irregular, escritura a mano y mucho ruido reducen la precisión. En fotos de páginas hechas con móvil, cuenta con corregir errores a mano.

¿Qué precisión tiene frente a servicios OCR de servidor?

Es un OCR honesto y competente, no precisión de servidor. El texto impreso limpio en un idioma compatible suele salir con gran precisión; tablas, diseños a varias columnas, fórmulas y escrituras mixtas pueden dar errores. El PDF con búsqueda conserva la página como imagen con una capa de texto invisible, así que buscar y copiar funcionan sin que el aspecto empeore.

Herramientas relacionadas