Tabla de Contenidos
Nos complace anunciar el lanzamiento de nuestro Node.js SDK v1.1.0, Python SDK v1.3.0, y docTR v0.5.0. El SDK de Node.js es compatible con documentos de facturas, recibos y finanzas, mientras que el SDK de Python es compatible con documentos de facturas, pasaportes y recibos, incluyendo matrículas europeas. docTR se utiliza para analizar información textual (localizar e identificar cada palabra) de sus documentos. Estas actualizaciones se realizaron para aumentar y mejorar la eficiencia y el rendimiento del análisis de documentos.
⚡️ Puntos destacados
🎯 Node.js SDK v1.1.0
Para el Node.jS SDK, añadimos soporte para V2 y SO en cabeceras User-Agent.
- Una parte importante de este lanzamiento fue dar soporte a la API V2 de Mindee. La API de facturas para este SDK ahora es compatible con contenido textual nativo de PDF para moneda, importe/impuesto, número de factura, información de pago, número de registro comercial y otras 17 monedas.
- También se ha añadido soporte para SO a las cabeceras user-agent en este nuevo lanzamiento. Esto nos permite determinar qué SO utilizan nuestros clientes con nuestro SDK y así optimizar el rendimiento y la compatibilidad.
🐍 SDK de Python v1.3.0
El SDK de Python ahora es totalmente compatible con las URL en sistemas operativos Windows y con el envío de archivos mediante base64.
- Una parte importante de esta actualización fue mejorar y corregir las URL que no se construían correctamente en sistemas operativos Windows.
- Otra actualización que realizamos fue eliminar los errores que se producen al enviar archivos mediante base64.
- También se incluye soporte para el encabezado user-agent. Esto nos permite determinar en qué sistemas operativos nuestros clientes utilizan nuestro SDK y así optimizar el rendimiento y la compatibilidad.
- Finalmente, reemplazamos la biblioteca de manipulación de PDF que estábamos utilizando por una más eficiente y pasamos de la licencia GPL2 a la MIT, lo que implica menos restricciones.
💡docTR v0.5.0
La nueva versión de docTR ahora incluye soporte para la detección de texto en documentos rotados e inclinados y actualizaciones en el modelo de clasificación.
- Los documentos rotados e inclinados ahora son totalmente compatibles en esta versión. El objetivo es llevar el mismo nivel de rendimiento que ya tenemos a los documentos rotados.
- Actualizamos todos los puntos de control del zoo de modelos de clasificación utilizados tanto en PyTorch como en TensorFlow. Estos modelos fueron entrenados utilizando nuestro conjunto de datos sintéticos de clasificación de caracteres. Para más información, consulte Entrenamiento de clasificación de caracteres.
- Cabe destacar que el número de conjuntos de datos compatibles ha aumentado significativamente. Esto incluye conjuntos de datos muy utilizados que se emplean para la evaluación comparativa de actividades relacionadas con OCR; puede encontrar la lista completa lista de estos conjuntos de datos.
Plan de mantenimiento
Por el momento, la nueva versión recibirá mantenimiento activo y se aplicarán correcciones de errores críticos a las nuevas versiones. El desarrollo y el mantenimiento de las versiones anteriores cesarán. Si tiene algún problema con los SDK o las bibliotecas, le invitamos a crear una incidencia en su respectivo repositorio de Github (incidencias del SDK de Node.js, incidencias del SDK de Python, incidencias de docTR) o a ponerse en contacto con nosotros en nuestra comunidad de Slack.
¿Qué debe hacer?
Si es un cliente existente que utiliza el Node.js SDK y Python SDK o docTR, le recomendamos encarecidamente que actualice a las versiones más recientes lo antes posible. Esto le garantizará acceso a todas las últimas funciones y correcciones de errores, tanto ahora como en el futuro.
Acerca de





