OCR PDF
Añade una capa de texto invisible a un PDF escaneado para poder buscar en él y copiar su texto, sin que cambie el aspecto de ninguna página.
o arrástralo aquí · hasta 50 MB, gratis
¿Archivos más grandes? Con Pro conviertes archivos de hasta 500 MBSupera los límites gratis: podrás desbloquear la descarga desde 1,99 €.
Procesando…
Tu archivo está listo
Gratis · Sin registro · Sin marca de agua · Tus archivos no salen de tu dispositivo
OCR PDF en 3 pasos
- Selecciona tu PDF escaneado o arrástralo al recuadro.
- Elige el idioma del texto (y un segundo si el documento mezcla dos) y haz clic en Aplicar OCR.
- Descarga el PDF con texto buscable, o todo el texto reconocido en un archivo TXT.
Cómo el OCR convierte un escaneo en un PDF buscable
Una página escaneada es solo una foto del papel: no puedes buscar en ella, ni seleccionar una frase, ni copiar una cifra. El OCR (reconocimiento óptico de caracteres) lee las letras de esa imagen y las añade a la página como una capa de texto invisible, colocada justo encima de cada palabra. La página se ve igual que antes, pero ahora Ctrl+F encuentra palabras, puedes subrayar y copiar texto en Acrobat, Vista Previa, Chrome o Edge, y Windows, macOS, Google Drive o tu gestor documental pueden indexar el archivo.
El texto se reconoce en tu dispositivo con Tesseract, un motor de OCR de código abierto. Cada página se lee a un máximo de 300 ppp; las páginas que ya tienen texto se dejan como están y las que se escanearon de lado o del revés se giran para que se lean bien. Funciona mejor con texto impreso y nítido, como cartas, facturas, contratos, libros y formularios. La letra a mano, la letra muy pequeña, las páginas desvaídas y las fotos hechas en ángulo dan más errores, y las tablas salen como texto, no como celdas. La primera vez que usas un idioma, su modelo de lectura (de 1 a 3 MB) se descarga de esta web y se guarda en tu navegador.
Preguntas frecuentes
¿Cambia el aspecto de mi PDF después del OCR?
No. Las páginas, imágenes y dibujos originales no se modifican ni se vuelven a comprimir. El OCR solo añade una capa de texto invisible encima de cada página, así que el archivo se ve igual y solo crece unos pocos kilobytes por página. Las páginas escaneadas de lado se giran para leerlas mejor.
¿Qué idiomas puede leer?
Veinticuatro: español, inglés, francés, alemán, italiano, portugués, neerlandés, polaco, turco, indonesio, vietnamita, japonés, chino simplificado y tradicional, coreano, ruso, ucraniano, árabe, hindi, catalán, checo, griego, rumano y sueco. Puedes elegir dos a la vez para documentos que mezclan idiomas, como español e inglés.
¿Qué precisión tiene el reconocimiento de texto?
Con un escaneo limpio de texto impreso acierta casi todas las palabras: en nuestras pruebas con escaneos de oficina a 200 ppp, más del 98 % de los caracteres se leyeron bien. La letra a mano, las fuentes diminutas o decorativas, los escaneos borrosos y los fondos de color bajan la precisión, así que revisa nombres y cifras importantes.
¿Cuánto tarda el OCR?
Unos segundos por página en un ordenador reciente y aproximadamente el doble en un móvil, más una breve descarga del modelo de idioma la primera vez. Un escaneo de 20 páginas suele tardar entre uno y tres minutos. Deja la pestaña abierta mientras trabaja; las páginas que ya tienen texto se saltan.
¿Puedo obtener el texto en un archivo TXT?
Sí. Junto al PDF buscable puedes descargar todo el texto reconocido en un archivo TXT, página a página, listo para pegarlo en Word, Google Docs o un correo. Para fotos y capturas de pantalla, usa nuestra herramienta Imagen a texto, que funciona igual.
¿Se sube mi PDF a algún servidor?
No. Las páginas las lee un motor de OCR que funciona dentro de tu navegador, en tu propio dispositivo, así que contratos, informes médicos y documentos de identidad nunca se nos envían ni se guardan en ningún sitio. Solo se descargan de esta web, una vez, el motor de OCR y el modelo de idioma, que se quedan en tu navegador.