Mistral ha publicado OCR 4.1 con extracción nativa de cajas delimitadoras a nivel de párrafo, etiquetas de bloque estructurales y puntuación de confianza por bloque, a 3,5 euros por cada mil páginas. La novedad no es leer el texto, es saber exactamente dónde está y cuánta confianza tiene el modelo en cada trozo.
Puntos clave
- Nombre en la API: `mistral-ocr-4-1+2`. Preview pública dentro del nivel Premier.
- Cajas delimitadoras por párrafo, etiquetas estructurales de bloque y confianza por bloque.
- 3,5 euros por 1.000 páginas. 4,38 euros por 1.000 páginas con anotaciones estructuradas.
- Endpoints `/v1/ocr` para procesar y `/v1/batch` para lotes.
Por qué la confianza por bloque cambia el flujo
Un OCR que devuelve texto plano te obliga a revisar el documento entero o a fiarte a ciegas. Uno que devuelve confianza por bloque te deja montar una regla: por debajo de un umbral, a revisión humana; por encima, directo al sistema.
Eso es lo que convierte un OCR en un proceso desatendido. No hace falta que acierte el 100%, hace falta que sepa decir en qué parte no está seguro. Con documentos de proveedores distintos, esa diferencia es la que decide si puedes automatizar la entrada de datos o solo acelerarla.
Las cajas delimitadoras por párrafo van en la misma dirección. Sabiendo la posición exacta de cada bloque en la página puedes cruzar el texto con la plantilla del documento, validar que el importe que extrajiste estaba donde debía estar y señalar en el PDF original qué campo dio problemas.
Las etiquetas de bloque estructurales completan el conjunto: distinguen encabezado, tabla, párrafo y pie en lugar de dejarte un muro de texto que hay que reconstruir con expresiones regulares.
Los números y lo que no dicen
3,5 euros por mil páginas son 0,0035 euros por página. Con anotaciones estructuradas sube a 4,38 euros por mil, un 25% más. Para un volumen de 20.000 páginas al mes son 70 euros, o 87,60 con anotaciones.
La documentación no especifica idiomas soportados, límite de tamaño de archivo, máximo de páginas por petición ni comparaciones de precisión contra versiones anteriores. Son cuatro datos que hay que verificar contra tu propio corpus antes de comprometer un proceso, sobre todo el de idiomas si trabajas con documentación en varios.
La versión se publicó el 16 de julio de 2026 y está en preview pública, no en disponibilidad general. Preview significa que la interfaz puede cambiar.
Dónde encaja en el resto de la jugada de Mistral
Sale en la misma semana en que Mistral se ha reposicionado como neocloud europeo con endpoints regionales y SLA. Y esa combinación es la que hace interesante el OCR más allá de sus números.
Procesar facturas y contratos es justo el tipo de carga donde la residencia del dato deja de ser un detalle técnico y se convierte en un requisito legal. Un OCR bueno servido desde un endpoint europeo con compromiso de servicio resuelve las dos preguntas a la vez.
Para probarlo sin escribir código hay un playground de OCR en la consola de Mistral Studio.
Por qué importa
Si tu empresa mueve papel, esta es la actualización que puede vaciar una bandeja. Facturas de proveedores, albaranes, packing lists, contratos escaneados con anotaciones a mano: son documentos sucios, con sellos encima del texto y campos manuscritos, exactamente el caso donde un OCR sin confianza por bloque falla en silencio.
La prueba se monta en una tarde. Coge cien documentos reales de los tuyos, de los feos, pásalos por `/v1/ocr` y mira dos cosas: qué acierta y en qué bloques dice que no está seguro. Si esa segunda lista coincide con los que un humano también marcaría, tienes un proceso automatizable con una excepción controlada. Si no coincide, tienes un OCR más.
Relacionado


