Mistral anunció la oferta de procesamiento regional de datos en Europa y Estados Unidos, acceso prioritario en horas punta y la inclusión de modelos abiertos de terceros en su plataforma. Los dos primeros recursos tienen recargo y limitaciones, informó la empresa.
En el procesamiento regional, las solicitudes pueden enviarse al endpoint europeo (api.eu.mistral.ai) o estadounidense (api.us.mistral.ai), con la garantía de que la computación ocurre en esa región. El servicio está dirigido a bancos, organismos públicos y aseguradoras que necesitan demostrar que los datos de clientes no salen de la UE, y también reduce la latencia.
La opción cuesta un 10% más sobre el precio estándar. Quien usa el endpoint estándar no tiene garantía sobre dónde se procesa la solicitud.
Límites del procesamiento regional
Entre las herramientas adicionales de la plataforma, solo function calling, que permite al modelo accionar APIs externas, funciona con los endpoints regionales. Los agentes, el procesamiento por lotes y la gestión de archivos no están disponibles en esas direcciones. La selección de modelos también varía por región, sin lista fija publicada.
Mistral no confirmó el motivo, pero la diferencia probablemente esté en el almacenamiento de estado: los agentes, los lotes y los archivos guardan datos más allá de una única llamada. Además, según la documentación, la configuración de la cuenta, las claves de API, la facturación y las estadísticas de uso aún pueden procesarse fuera de la región elegida. La empresa también menciona transferencias limitadas y seguras a subcontratistas fuera de la región.
En la práctica, los clientes que envían texto de contratos directamente al modelo pueden usar el endpoint europeo. Quienes dependen de agentes o de la API de archivos no tendrán la misma garantía.
La prioridad cuesta un 75% más
El acceso prioritario, llamado Priority Tier, está en beta abierta. Todos los clientes comparten los mismos centros de datos, y el recurso crea una vía rápida para que las solicitudes de pago se procesen antes que las demás en momentos de congestión. El público objetivo son casos en los que la latencia genera pérdidas financieras, como chatbots de atención al cliente o sistemas de planta de fábrica.
El tier incluye un SLA de disponibilidad del 99,5%, alrededor de tres horas y media de indisponibilidad al mes, algo que el plan estándar no ofrece. La activación se realiza mediante el parámetro service_tier; el valor "auto" envía la solicitud por la vía rápida cuando hay capacidad, mientras que el predeterminado es "standard_only". Los límites de solicitudes por minuto se negocian individualmente, y el exceso vuelve al procesamiento normal sin fallar.
El recargo es del 75% sobre el precio estándar, totalizando 1,75 veces el valor. Los descuentos de prompt caching, que pueden llegar al 90%, se calculan antes del recargo. El Priority Tier no es de autoservicio: exige un contrato con el equipo de ventas de Mistral.
Modelos de terceros en la plataforma
Mistral también abrió la plataforma a modelos abiertos de otros proveedores. El primero es el GLM-5.2, de la china Z.ai, que sigue las mismas reglas y garantías regionales que los modelos de Mistral. Para financiar la capacidad de cómputo, la empresa recopila compromisos plurianuales de grandes clientes, empaquetados como European Compute Units. La idea es hacer viables nuevos centros de datos en Europa con compromisos a largo plazo.


