---
id: KB-GL-009
url: https://app.codecontract.io/ayuda/glosario/que-es-el-ocr
idioma: es
categoria: glosario
subcategoria: documentos
audiencia: usuario
nivel: intermedio
actualizado: 2026-08-13
tambienEn: [en]
relacionados: [KB-DI-004, KB-GL-010]
citadoPor: [KB-GL-020]
---

# Qué es el OCR

_Convertir la imagen de un texto en texto que se puede buscar y leer._

**Responde a:** qué es el ocr · reconocimiento óptico de caracteres · cómo se lee un pdf escaneado · buscar dentro de documentos escaneados

**OCR** — Reconocimiento óptico de caracteres: la técnica que mira la imagen de una página y reconoce qué letras y números hay en ella, convirtiéndola en texto.

Un PDF escaneado es una foto de un papel: para un ordenador, píxeles. El OCR es lo que convierte esos píxeles en palabras, y es lo que permite después buscar dentro de él o extraerle una fecha.

## Por qué a veces falla

| Original | Qué tal se reconoce |
| --- | --- |
| PDF generado por ordenador | Perfecto: el texto ya está dentro |
| Escaneo a 300 ppp, derecho | Muy bien |
| Foto con el móvil, con luz | Bien |
| Foto torcida o con sombra | Regular o mal |
| Manuscrito | Mal, y es lo esperable |

> [!WARNING]
> Lo que tú no puedas leer a simple vista, el OCR tampoco. Si dudas al mirar el documento, no esperes que salga bien.

> [!NOTE]
> Un PDF que ya lleva texto dentro no necesita OCR, y por eso se lee perfecto. Pedir los documentos en PDF en lugar de en foto es el cambio más barato para mejorar la lectura.

**¿El OCR cambia mi documento?**

No. El original se guarda tal cual; el texto reconocido va aparte.

**¿Funciona en otros idiomas?**

Sí, incluidos los que no usan alfabeto latino.

**¿Se puede corregir lo que reconoce mal?**

Sí, y la corrección mejora la lectura de ese tipo de documento.

## Ejemplos

**Una empresa no consigue encontrar nada dentro de sus escaneos antiguos.**

- Comprueba que se subieron sin lectura
- Los vuelve a procesar

→ Pasan a ser buscables por su contenido, no solo por el nombre del archivo.

**Una foto de un albarán no permite buscar el número de pedido.**

- Comprueba que se procesó al subirla

→ El número se encuentra sin abrir la imagen.

**Un escaneo torcido y con sombras sale mal leído.**

- Repite la captura con mejor luz y encuadre

→ La lectura mejora sin cambiar nada del sistema.

**Un documento manuscrito no se lee bien.**

- Revisa a mano lo que quede marcado como dudoso

→ Se corrige lo poco que falla en lugar de teclearlo todo.

**Un PDF ya venía con texto y se vuelve a procesar.**

- Comprueba si el documento ya era buscable

→ Se evita gastar en algo que no hacía falta.

**Hay cientos de escaneos antiguos sin procesar.**

- Procesa primero los que se consultan de verdad

→ El esfuerzo se concentra en lo que alguien va a buscar.
