Microsoft lanzó el modelo de código MAI Code 1.1 Flash para GitHub Copilot, afirmando que escribe mejor código, es un 25% más eficiente en tokens y cuesta una cuarta parte del valor de la versión anterior. The Decoder señaló, sin embargo, que el modelo es más caro y tiene un rendimiento inferior al DeepSeek-V4-Flash-0731, tanto en precio como en benchmarks.

Según Microsoft, el nuevo modelo aumentó la aceptación de código en un 4% y el entrenamiento involucró 'cientos de miles de entornos de aprendizaje por refuerzo en GitHub Copilot'. La empresa no proporcionó comparaciones directas con competidores en el anuncio, limitándose a métricas como 'la supervivencia del código subió un 4%' y 'el retorno de visitas aumentó un 9%'.

Rendimiento

En los benchmarks, MAI Code 1.1 Flash obtuvo 72,6% en SWE-bench Verified, superando a su predecesor (71,6%), Claude Haiku 4.5 (69,8%) y GPT-5.4 mini (69,2%). DeepSeek-V4-Flash-0731 no publicó resultados en esa prueba. En Terminal Bench 2.1, el modelo de Microsoft obtuvo 62,9%, por debajo del 82,7% de DeepSeek, pero por encima de los demás modelos de Anthropic y OpenAI.

La comparación de precios por millón de tokens muestra a DeepSeek-V4-Flash con US$ 0,14 de entrada y US$ 0,28 de salida. MAI Code 1.1 Flash cuesta US$ 0,20 y US$ 1,20, respectivamente. Claude Haiku 4.5 tiene valores más altos: US$ 1,00 y US$ 5,00.

Estrategia

El análisis señala que el lanzamiento contrasta con el discurso de Microsoft a favor de la IA abierta, ya que la empresa invierte en un modelo propietario más caro y con un rendimiento inferior a las alternativas disponibles. La compañía habría reemplazado modelos de OpenAI y Anthropic en Copilot por sus propios MAI para reducir costos, y la tendencia es que sus modelos se conviertan en el estándar en el ecosistema, limitando las opciones del usuario.

Sigue en Radar