Documentos e IA
Subir muchos documentos de golpe
Lo que conviene decidir antes de arrastrar doscientos ficheros, porque después cuesta más deshacerlo.
Antes o después toca subir un bloque grande: una carpeta de una obra terminada, el archivo de un cliente que llega, un histórico que se trae. Se puede, y el resultado depende casi entero de tres decisiones que se toman antes de empezar, no durante.
Las tres decisiones
- 1
A qué expediente va cada cosa
Subir doscientos ficheros a un sitio genérico es rápido y crea un problema que ya conocéis: un cajón.
- 2
Qué se lee y qué no
No todo merece extracción. Lo que se va a consultar por su contenido, sí; el resto puede quedarse como archivo.
- 3
Y qué se hace con los duplicados
En un bloque grande siempre hay: el mismo documento con dos nombres, o dos versiones del mismo.
Importante
La segunda es la que más cambia el coste y la que nadie decide: **cada documento que se lee es una acción**. Subir un archivo histórico de dos mil ficheros y pedir que se lean todos consume dos mil veces, y de esos dos mil probablemente se consulten cincuenta. Leer lo que se va a usar y dejar el resto como archivo es la diferencia entre traer el histórico y pagar por traerlo dos veces.
Lo que conviene mirar antes de arrastrar
| Comprobación | Por qué antes |
|---|---|
| Que los nombres digan algo | Después ya están dentro con IMG_4821 como título |
| Que no haya ficheros protegidos | Se suben, pero no se pueden leer ni buscar |
| Que el bloque sea de un solo asunto | Mezclar dos obras en una tanda es lo que crea el cajón |
| Y que alguien vaya a revisar lo que entra | Una subida masiva sin revisión es archivo, no gestión |
Ojo con esto
El matiz práctico que ahorra una tarde: **subid una muestra pequeña primero**. Veinte ficheros del mismo tipo dicen si la calidad del escaneo sirve, si los nombres se entienden y si la extracción coge lo que os interesa. Si algo no encaja, corregirlo con veinte cuesta minutos; descubrirlo con dos mil dentro, no.
Después de subir
Lo último parece obvio y es el error más repetido en migraciones largas: se trae la misma carpeta dos veces porque nadie apuntó que ya estaba.
Ten en cuenta
Si el bloque es muy grande, repartidlo en tandas por asunto y no por tamaño. Diez tandas de veinte documentos de una obra cada una son manejables; una tanda de doscientos de diez obras distintas es un problema que hay que deshacer a mano.
›¿Hay un límite por fichero?
Sí, y suele bastar: si un fichero no entra, casi siempre es un escaneo a resolución mucho mayor de la necesaria.
›¿Puedo subir carpetas enteras?
Depende de cómo lo hagáis; lo importante es a qué expediente van, no cuántos son.
›¿Y si me equivoco de expediente con todo el bloque?
Se mueve, no se borra: mover conserva el rastro y no vuelve a consumir.
Un caso real
La situación
Una empresa trae el archivo de una obra terminada y pide que se lea todo.
Qué haces
- Sube una muestra de veinte antes que los dos mil
- Decide qué tipos se leen y cuáles quedan como archivo
Qué consigues
El histórico entra ordenado y el consumo se queda en lo que de verdad se va a consultar.
La situación
Se suben trescientos documentos y no se sabe cuáles fallaron.
Qué haces
- Consulta el resultado de la carga
Qué consigues
Se reintenta solo lo que falló.
La situación
La carga se corta a mitad.
Qué haces
- Comprueba qué entró antes de repetir
Qué consigues
No se duplica lo ya subido.
La situación
Todos entran al mismo expediente sin distinguir.
Qué haces
- Prepara la asociación antes de cargar
Qué consigues
Cada documento llega a su sitio.
La situación
Se cargan sin nombres que digan qué son.
Qué haces
- Nombra o clasifica antes de subir
Qué consigues
Se localizan después.
La situación
Se hace una carga grande sin probar antes.
Qué haces
- Prueba con un lote pequeño
Qué consigues
El problema se descubre con diez y no con trescientos.
Este artículo responde a
- subir muchos archivos a la vez
- importar una carpeta de documentos
- subida masiva de documentos
- cuántos documentos puedo subir de golpe