Saltar al contenido

Glosario

Qué es el OCR

Convertir la imagen de un texto en texto que se puede buscar y leer.

Actualizado el 13/08/2026

OCR

Reconocimiento óptico de caracteres: la técnica que mira la imagen de una página y reconoce qué letras y números hay en ella, convirtiéndola en texto.

Un PDF escaneado es una foto de un papel: para un ordenador, píxeles. El OCR es lo que convierte esos píxeles en palabras, y es lo que permite después buscar dentro de él o extraerle una fecha.

Por qué a veces falla

OriginalQué tal se reconoce
PDF generado por ordenadorPerfecto: el texto ya está dentro
Escaneo a 300 ppp, derechoMuy bien
Foto con el móvil, con luzBien
Foto torcida o con sombraRegular o mal
ManuscritoMal, y es lo esperable

Ojo con esto

Lo que tú no puedas leer a simple vista, el OCR tampoco. Si dudas al mirar el documento, no esperes que salga bien.

Ten en cuenta

Un PDF que ya lleva texto dentro no necesita OCR, y por eso se lee perfecto. Pedir los documentos en PDF en lugar de en foto es el cambio más barato para mejorar la lectura.

¿El OCR cambia mi documento?

No. El original se guarda tal cual; el texto reconocido va aparte.

¿Funciona en otros idiomas?

Sí, incluidos los que no usan alfabeto latino.

¿Se puede corregir lo que reconoce mal?

Sí, y la corrección mejora la lectura de ese tipo de documento.

Un caso real

La situación

Una empresa no consigue encontrar nada dentro de sus escaneos antiguos.

Qué haces

  1. Comprueba que se subieron sin lectura
  2. Los vuelve a procesar

Qué consigues

Pasan a ser buscables por su contenido, no solo por el nombre del archivo.

La situación

Una foto de un albarán no permite buscar el número de pedido.

Qué haces

  1. Comprueba que se procesó al subirla

Qué consigues

El número se encuentra sin abrir la imagen.

La situación

Un escaneo torcido y con sombras sale mal leído.

Qué haces

  1. Repite la captura con mejor luz y encuadre

Qué consigues

La lectura mejora sin cambiar nada del sistema.

La situación

Un documento manuscrito no se lee bien.

Qué haces

  1. Revisa a mano lo que quede marcado como dudoso

Qué consigues

Se corrige lo poco que falla en lugar de teclearlo todo.

La situación

Un PDF ya venía con texto y se vuelve a procesar.

Qué haces

  1. Comprueba si el documento ya era buscable

Qué consigues

Se evita gastar en algo que no hacía falta.

La situación

Hay cientos de escaneos antiguos sin procesar.

Qué haces

  1. Procesa primero los que se consultan de verdad

Qué consigues

El esfuerzo se concentra en lo que alguien va a buscar.

Este artículo responde a

  • qué es el ocr
  • reconocimiento óptico de caracteres
  • cómo se lee un pdf escaneado
  • buscar dentro de documentos escaneados