AWS Textract es la API de OCR con machine learning de Amazon, lanzada en mayo de 2019, que extrae texto, formularios, tablas y firmas de ficheros JPEG, PNG, PDF y TIFF. Comparativas de terceros sitúan su detección de tablas y líneas de detalle entre las más sólidas de los servicios de OCR en la nube, y se integra de forma nativa con S3, Lambda, SNS y SQS, con APIs preconstruidas para gastos (AnalyzeExpense), documentos de identidad estadounidenses (AnalyzeID) y expedientes hipotecarios (AnalyzeLending). Aplica límites estrictos: las llamadas síncronas aceptan ficheros de 10 MB y PDFs de una sola página, los trabajos asíncronos 500 MB y 3.000 páginas; la detección de texto cubre seis idiomas, con escritura a mano y queries solo en inglés (documentación de AWS, 2026).
Textract devuelve salida OCR en bruto, es decir, bloques de texto, bounding boxes, pares clave-valor y celdas de tabla, y no impone ningún esquema de salida. Su función de Queries está limitada a 15 consultas por página en llamadas síncronas y 30 en asíncronas (documentación de AWS, 2026). Convertir esa salida en datos listos para tu aplicación exige un pipeline de postprocesamiento personalizado: mapeo de campos, reglas de validación, gestión de errores y normalización de formatos. anyformat extrae contra un esquema definido por el usuario en zero-shot: define los campos, sube un documento y recibe JSON validado. Acepta más de 100 formatos de documento sin plantillas, combinando LLMs con reglas determinísticas, y los cambios de esquema se aplican al instante sin despliegues de código.
Orquestación de flujos de trabajo
Textract no tiene capa de flujos de trabajo: clasificación, división, enrutamiento, validación, revisión humana y gestión de reintentos se ensamblan con Lambda, Step Functions, SNS, SQS y código personalizado. Ese esfuerzo de ingeniería, y no la tarifa por página, es el coste dominante de operar Textract en producción. anyformat incluye un constructor visual de flujos de trabajo (Studio) con ramificación, condiciones, división, enrutamiento, operadores de extracción y revisión human-in-the-loop integrada, de modo que operaciones e ingeniería actualizan los flujos sin despliegues de código.
Precios
Textract cobra por página y por funcionalidad: 1,50 $ por cada 1.000 páginas para detección de texto, 15 $ para tablas, 50 $ para formularios, 10 $ para gastos y 70 $ para expedientes hipotecarios (precios de AWS, US West, 2026). anyformat factura en créditos, por página y por operador, sin dependencia de AWS: 10 créditos cuestan 0,01 €, así que Parse son 25 créditos por página (0,025 €, publicado como 25 $ por 1.000 páginas), Extract 35 créditos por página, Classify 10, Split 25 y Validate 25 créditos por regla (precios de anyformat, 2026). Pay As You Go es gratis para empezar, con una concesión única de 50.000 créditos; Business cuesta 499 € al mes (399 € con facturación anual) con 500.000 créditos, 5 usuarios y 10 flujos de trabajo; y Enterprise tiene precio a medida, con usuarios y flujos ilimitados, despliegue en VPC u on-premise y retención cero de datos. Combinar funcionalidades de Textract multiplica la tarifa por página, y el pipeline de Lambda y Step Functions a su alrededor añade un coste de ingeniería que el precio por página nunca refleja; la métrica que importa es el coste por salida correcta, donde anyformat obtuvo un 78,1% frente al 65,4% de Textract en el benchmark de parsing de 2026 (benchmark de anyformat, 2026).
Precisión con documentos reales
anyformat obtuvo un 78,1% y AWS Textract un 65,4% en un parse score combinado sobre más de 1.000 documentos reales de más de 30 tipos (benchmark de anyformat, 2026). Textract sigue siendo sólido en formularios y tablas estándar, pero aplana los diseños multicolumna, se degrada en tablas que abarcan varias páginas o contienen celdas combinadas y no puede interpretar figuras, gráficos ni diagramas; anyformat detecta elementos visuales y devuelve descripciones estructuradas. En tablas que crecen hasta 50 páginas y unas 2.400 filas, anyformat mantuvo una recuperación de filas de ~99%, y extrajo el 94% de las facturas de formatos variados con todos los campos y líneas de detalle correctos (benchmark de anyformat, 2026). En producción, L'Oréal reporta un 99% de precisión de extracción y una reducción del 60% en el tiempo de procesamiento en más de 1.500 facturas mensuales.
Confianza y revisión humana
Las puntuaciones de confianza de Textract no están calibradas, por lo que una puntuación reportada no se corresponde con una probabilidad real de acierto (benchmark de anyformat, 2026). anyformat calibra la confianza por campo, con un 99,1% de precisión de calibración y un Adaptive ECE de 0,009 (benchmark de anyformat, 2026), y adjunta citas visuales que vinculan cada valor extraído con su posición exacta en la página. La calibración es lo que hace que los umbrales funcionen: los campos de alta confianza fluyen automáticamente y los inciertos se enrutan a revisores.
Soberanía de datos, cumplimiento y despliegue
Textract se ejecuta únicamente en AWS bajo jurisdicción estadounidense, independientemente de la región seleccionada; para organizaciones sujetas al GDPR o a DORA, la elección de región es un detalle de configuración, no una garantía de soberanía. Su postura de cumplimiento hereda certificaciones de plataforma de AWS como SOC 2 y elegibilidad HIPAA, que cubren la infraestructura y no el pipeline de extracción construido encima. anyformat es nativo de la UE, cuenta con certificación ISO 27001 sobre el pipeline documental completo, ofrece procesamiento con retención cero como un único interruptor (el equivalente en Textract exige mantener políticas de ciclo de vida de S3 y de retención de CloudWatch) y se despliega en cloud, nube privada o entornos on-premise air-gapped. Textract no tiene opción on-premise (documentación de AWS, 2026).
Una suite de evaluaciones y el pipeline de producción alrededor de la extracción. La calidad de extracción es una variable; mantenerla correcta después de la puesta en producción es donde los proyectos documentales gastan la mayor parte de su presupuesto de ingeniería.
Evaluaciones, disponibles hoy. Cada flujo de trabajo de Extract y Classify de anyformat tiene una pestaña Health. Construyes un dataset con verdad de referencia verificada, promocionando un documento que el flujo ya procesó y confirmando sus valores en la interfaz de revisión, o subiendo documentos etiquetados con su JSON esperado. Los ficheros se etiquetan en sub-datasets, de modo que la precisión se lee por proveedor, por tipo de documento o por nivel de dificultad en lugar de como un único promedio. Una evaluación vuelve a extraer cada documento incluido contra una versión concreta del flujo y lo puntúa campo a campo, con una vista de resultado frente a esperado en cada fallo; las ejecuciones son numeradas e inmutables, así que el efecto de un cambio se mide en lugar de suponerse. Health Overview sitúa después el benchmark del dataset junto a la precisión de producción en vivo, la confianza y el through rate, e informa de la diferencia entre ambos (Evals). AWS reporta precisión, recall y F1 para un adaptador entrenado de Custom Queries contra un conjunto de prueba etiquetado (documentación de AWS, 2026); esa medición se limita a un adaptador sobre la función Queries y no a un pipeline de extremo a extremo, sin segmentación por sub-datasets, sin histórico inmutable de ejecuciones y sin comparación entre benchmark y producción.
Optimizer, anunciado y todavía no disponible. anyformat ha anunciado Optimizer, un flujo de trabajo que se ajusta a sí mismo contra su propio dataset usando tus evaluaciones como objetivo. Está en la hoja de ruta, no en el producto a día de hoy (Evals).
El pipeline que no tienes que construir. Textract devuelve bloques de texto, bounding boxes, pares clave-valor y celdas de tabla. En producción hacen falta además postprocesamiento, validación de esquema, lógica de reintentos y enrutamiento, una interfaz de revisión humana, monitorización de la precisión y reajustes cada vez que cambia un diseño o un modelo subyacente; la propia guía de AWS lo monta con Lambda y Step Functions. Amazon A2I, el bucle gestionado de revisión humana conectado a la operación AnalyzeDocument de Textract, cierra el acceso a nuevos clientes el 30 de julio de 2026 y no recibirá nuevas funcionalidades (documentación de AWS, 2026). anyformat entrega esa capa como producto: flujos de trabajo en el Studio sin código, confianza calibrada por campo con enrutamiento a revisión, citas visuales para auditoría y el ciclo de evaluaciones anterior. Montar un flujo de producción con el asistente Annie lleva unos 5 minutos frente a unas 4 horas de configuración manual (benchmark interno de anyformat, 2026).
Cuándo elegir AWS Textract
Elige Textract cuando tu infraestructura es nativa de AWS, tus documentos encajan con sus APIs preconstruidas (formularios, tablas, recibos, identificaciones estadounidenses, expedientes hipotecarios) y tu equipo puede construir y mantener el pipeline circundante. El pago por uso escala desde cero sin compromiso mínimo, y la integración nativa con S3, Lambda y Step Functions mantiene todo el flujo dentro de una sola nube.
Elige anyformat cuando necesitas extracción validada contra esquema, orquestación de flujos de trabajo y revisión humana sin ensamblar infraestructura; cuando tus documentos van más allá de los formularios estándar, con tablas largas, más de 100 formatos o figuras incrustadas; o cuando la residencia de datos europea, el despliegue on-premise y la confianza calibrada para el straight-through processing son requisitos innegociables.
Los equipos que sustituyen Textract citan de forma consistente la capa de flujos de trabajo ausente, el coste del postprocesamiento y la jurisdicción estadounidense como factores decisivos. Para una visión más amplia del mercado, consulta nuestra guía de las mejores alternativas a AWS Textract.