Qué es el OCR y para qué sirve
OCR significa reconocimiento óptico de caracteres. Cuando escaneas un documento o lo fotografías, el PDF que obtienes es solo una imagen: no puedes buscar una palabra, copiar un párrafo ni seleccionar un número. El OCR en PDF lee esa imagen, identifica las letras y las convierte en texto.
En ConvertirDocs, el texto reconocido se agrega como una capa invisible encima de cada página. El PDF se ve exactamente igual que antes, pero ahora puedes usar la búsqueda del lector, seleccionar texto y copiarlo a otro documento. Es útil para contratos escaneados, apuntes, facturas en papel, libros digitalizados o cualquier documento que llegó como imagen.
Idiomas y cómo elegirlos
La herramienta reconoce español, inglés y portugués. Puedes elegir uno o varios, algo práctico cuando un documento mezcla idiomas, como un certificado bilingüe o un artículo académico con resumen en inglés.
La primera vez que usas un idioma, el navegador descarga sus datos de reconocimiento, que pesan varios MB. Esa descarga viene desde ConvertirDocs y no incluye tu documento: es el diccionario que el reconocimiento necesita para trabajar. Las siguientes veces suele ir más rápido.
Qué tan preciso es
La precisión depende sobre todo de la calidad del escaneo. Un documento nítido, bien iluminado, derecho y con buena resolución da muy buenos resultados. Una foto borrosa, con sombras, torcida o de baja resolución produce errores: letras confundidas, palabras cortadas o renglones mezclados. La letra manuscrita es especialmente difícil.
Para mejorar el resultado, digitaliza con «Escanear a PDF»: recortas las cuatro esquinas, corriges la perspectiva y usas el filtro de documento o de más contraste. Si las páginas vienen giradas, enderézalas antes con «Rotar PDF». Y revisa siempre los datos importantes, como cifras o nombres, antes de usarlos.
Casos en los que te ahorra tiempo
Piensa en un contrato escaneado de veinte páginas donde necesitas encontrar una cláusula, o en una factura en papel de la que quieres copiar el número de cuenta. Sin OCR tendrías que leer página por página o transcribir a mano. Con la capa de texto, basta con buscar la palabra en tu lector de PDF.
También sirve para estudiantes que escanean capítulos de libros o apuntes impresos y quieren subrayar, buscar términos o copiar citas para un trabajo, siempre revisando que la cita haya quedado bien reconocida.
Páginas con texto, privacidad y siguientes pasos
Por defecto, la herramienta salta las páginas que ya tienen texto, así no repite trabajo en documentos mixtos. Todo el reconocimiento se hace en tu navegador: el PDF no sale de tu dispositivo y no se guarda nada.
Después del OCR puedes seguir sin volver a subir el archivo: convertirlo con «PDF a Word» o «PDF a Excel» para editar el contenido, o comprimirlo con «Comprimir PDF» antes de enviarlo.