Desarrollan un modelo OCR multilingüe veloz utilizando datos sintéticos

Se ha desarrollado Nemotron OCR v2, un modelo de reconocimiento óptico de caracteres (OCR) multilingüe rápido y preciso, utilizando un enfoque innovador de generación de datos sintéticos. Este método combina la calidad de la anotación manual con la escala de la recolección web, produciendo 12 millones de imágenes de entrenamiento de seis idiomas, logrando así mejorar significativamente la precisión y velocidad del modelo en la comprensión de documentos reales.

Ilustración de un hombre mayor con auriculares y chaqueta