Saltar al contenido
← Catálogo
Machine learningIntermedio

Amazon Textract

Extrae texto, tablas y campos de formularios de documentos escaneados, conservando su estructura.

Cuándo aplicarlo

Cuando hay que digitalizar facturas, cédulas o formularios y un reconocimiento de texto plano perdería la estructura.

Descripción

A diferencia del reconocimiento óptico clásico, Textract entiende que un documento tiene tablas y pares de campo y valor, y los devuelve como datos estructurados con su nivel de confianza. Sus variantes especializadas leen facturas, recibos y documentos de identidad.

Se combina con Augmented AI para enviar a revisión humana los campos de confianza baja.