Ir al contenido

Documents Classify Bundle

Sube un archivo con varios documentos (un bundle) cuyo troceo no es de fiar a la estación de clasificación, junto con los segmentos que propuso IDP Classify. En vez de extraer a ciegas, una persona confirma dónde empieza cada documento y de qué tipo es.

Se usa cuando IDP Classify devuelve splitNeedsReview = true.

Documents Classify Bundle path = = archivo
reference = = archivo
segments = = doc["segments"]
pages = = doc["pages"]
dpi = 200

Un troceo es incierto cuando hay páginas sin reconocer, o cuando el archivo se partió en varios documentos sin ninguna marca impresa que lo respalde (solo el juicio del modelo). IDP Classify lo señala con splitNeedsReview. El patrón típico:

If condition = = doc["splitNeedsReview"] == true
then:
Documents Classify Bundle path = = archivo, reference = = archivo,
segments = = doc["segments"], pages = = doc["pages"], dpi = 200
Continue
ParámetroTipoQué es
pathtextoLa ruta del archivo bundle.
referencetextoClave estable del bundle (p.ej. el nombre del fichero).
segmentslistaLos segmentos propuestos por IDP Classify — doc["segments"].
pageslistaLas dimensiones por página — doc["pages"] — para que la estación pueda pintar las páginas.
dpiintEl dpi con el que se leyeron las páginas.
retentionDaysintCuántos días guardar el bundle. Vacío = el default del entorno.

Pásale también document (el objeto completo que devolvió IDP Classify) y la lectura —palabras, páginas, texto— se guarda junto al bundle como caché de OCR. Cuando una persona confirme el troceo y Take Confirmed Bundles recoja el bundle, esa lectura vuelve con él y cada segmento se extrae sin re-leer el fichero ni re-pagar Azure. Sin document, todo funciona igual — solo que la extracción re-lee.

El bundle aparece en Documentos → Clasificar del entorno. Una persona ajusta las fronteras/tipos y confirma. A partir de ahí, Documents Take Confirmed lo recoge para extraer cada segmento.