Tendencias SaaS

MAI-Code-1.1-Flash: mejor, más rápido y a un cuarto del costo

Microsoft puso en producción dentro de GitHub Copilot su nuevo modelo de código MAI-Code-1.1-Flash: cuesta un cuarto que la versión de junio, usa 25% menos tokens por tarea y mejora 22% en Terminal-Bench 2.1.

5 min de lecturaFuente: Microsoft AI
Gráfica de Microsoft con llaves de código sobre fondo verde y el texto MAI-Code-1.1-Flash, 25% más eficiencia de tokens y un cuarto del costo
Imagen: Microsoft AI

La noticia en 30 segundos

Microsoft anunció el 11 de agosto de 2026 MAI-Code-1.1-Flash, su nuevo modelo de código ya en producción dentro de GitHub Copilot. Cuesta un cuarto de lo que costaba el modelo lanzado en junio durante Microsoft Build, entrega 25% más eficiencia de tokens y produce código de mayor calidad. En pruebas mejora 22% en Terminal-Bench 2.1 dentro de GitHub Copilot CLI y 15% en tareas de .NET. En producción, la supervivencia del código subió 4% y las visitas recurrentes 9%. Los tokens se transmiten 25% más rápido y el modelo usa 25% menos tokens para completar una tarea.

Microsoft anunció el martes 11 de agosto de 2026 MAI-Code-1.1-Flash, la nueva versión de su modelo de código propio, que ya está en producción dentro de GitHub Copilot. El titular del anuncio es económico antes que técnico: el modelo cuesta un cuarto de lo que costaba la versión 1.0 lanzada en junio durante Microsoft Build.

La compañía dice haber priorizado lo que le pidieron los desarrolladores. «Aprendimos del feedback de los desarrolladores que las tareas de CLI y el desempeño en .NET importaban, así que ahí es donde nos enfocamos», señala el equipo de Microsoft AI en el anuncio.

¿Qué mejora exactamente MAI-Code-1.1-Flash?

  • Costo: un cuarto del precio del modelo 1.0, con el ahorro trasladado a los clientes.
  • Eficiencia: 25% mayor eficiencia de tokens y 25% menos tokens para completar una tarea.
  • Velocidad: los tokens se transmiten 25% más rápido dentro de GitHub Copilot.
  • Terminal-Bench 2.1: 22% de mejora en GitHub Copilot CLI.
  • Tareas .NET: 15% de mejora.

¿Qué muestran las métricas de uso real y no de benchmark?

Microsoft es explícito en que los benchmarks son guías útiles pero que la prueba está en producción. Ahí reporta dos indicadores más difíciles de inflar: la supervivencia del código subió 4%, es decir, más código generado se queda en el repositorio en lugar de ser descartado o reescrito, y las visitas recurrentes aumentaron 9%, un proxy de que los desarrolladores vuelven a usar la herramienta.

La compañía atribuye la ganancia a mejor entrenamiento y mejor eficiencia de servicio, optimizando sobre cientos de miles de entornos de aprendizaje por refuerzo dentro de GitHub Copilot. En palabras del equipo, el ciclo es «lanzar, aprender, mejorar, repetir».

¿Por qué un modelo más barato es la noticia y no uno más grande?

Porque marca el cambio de eje de la competencia. Durante dos años el titular fue siempre el modelo más capaz. Ahora el titular es el modelo que entrega desempeño equivalente a una fracción del costo. Microsoft lo dice sin rodeos en el anuncio: se trata de obtener más trabajo útil de cada token, «no simplemente un modelo más grande con una cuenta más grande».

Esto se suma al patrón que Microsoft viene ejecutando con su familia MAI de modelos propios, con los que ha ido reemplazando dependencia de modelos de terceros dentro de sus productos, desde GitHub Copilot hasta Dynamics.

¿Qué implica para una empresa en Chile y Latinoamérica?

Implica que el costo por unidad de trabajo de IA está bajando más rápido de lo que la mayoría de los presupuestos anuales asume. Una empresa latinoamericana que licitó su stack de desarrollo en enero con una proyección de gasto en IA probablemente esté sobrepagando hoy, porque el precio de referencia se movió tres veces en el mismo período. Y como se paga en dólares, la diferencia se nota en el estado de resultados.

Análisis de Revenue Hub

La lectura de negocio es la deflación acelerada del costo de inteligencia. Cuando un proveedor de la escala de Microsoft baja el precio a un cuarto en dos meses y además mejora el desempeño, está fijando un piso nuevo para todo el mercado. Para un líder que aprobó un presupuesto de IA hace seis meses, eso significa que sus supuestos de costo están desactualizados por definición, no por error.

La decisión concreta es de cadencia de revisión, no de proveedor. Recomendamos revisar el gasto en herramientas de IA cada trimestre y no cada año, y negociar contratos con cláusulas que permitan capturar bajas de precio del proveedor en lugar de quedar fijados a la tarifa del día de la firma. En la práctica, muchas empresas de la región están pagando tarifas de 2025 por capacidades que hoy valen una fracción.

El riesgo estructural es el opuesto al que suele preocupar. No es que la IA salga demasiado cara; es que salga tan barata que se adopte sin gobernanza y el gasto se disperse en decenas de licencias sin dueño ni medición de retorno. Un costo por token que cae 75% no reduce el gasto total si al mismo tiempo el consumo se multiplica sin control. Ese trabajo de gobernanza del stack comercial es exactamente lo que revisamos en nuestros contenidos de tendencias SaaS y en el blog de Revenue Hub.

Fuente y criterio editorial

Revenue Hub resume, contextualiza y analiza esta información para equipos B2B de Chile y Latinoamérica. La publicación original pertenece a Microsoft AI.

Leer la fuente original

Para profundizar

Preguntas frecuentes

¿Qué es MAI-Code-1.1-Flash?

Es el modelo de código propio de Microsoft, en su versión 1.1, lanzado el 11 de agosto de 2026 y ya en producción dentro de GitHub Copilot. Es un modelo pequeño y eficiente orientado a tareas de programación asistida y agentes de código.

¿Cuánto cuesta MAI-Code-1.1-Flash comparado con la versión anterior?

Cuesta un cuarto de lo que costaba MAI-Code-1.0, el modelo que Microsoft lanzó en junio de 2026 durante Microsoft Build. La compañía indica que traslada ese ahorro a los clientes.

¿Cuánto mejoró el desempeño del modelo?

Microsoft reporta 22% de mejora en Terminal-Bench 2.1 dentro de GitHub Copilot CLI y 15% de mejora en tareas de .NET. En producción, la supervivencia del código subió 4% y las visitas recurrentes de los desarrolladores aumentaron 9%.

¿Qué significa que use 25% menos tokens?

Significa que completa la misma tarea consumiendo menos unidades de texto procesado, lo que reduce el costo por tarea y el tiempo de espera. Además, en GitHub Copilot los tokens se transmiten 25% más rápido, por lo que las respuestas aparecen antes.

¿Dónde puedo usar MAI-Code-1.1-Flash?

Está disponible en GitHub Copilot. Microsoft invitó a los desarrolladores a probarlo y a reportar mejoras a través del repositorio microsoft/MAI-Code en GitHub.

¿MAI-Code-1.1-Flash es mejor que GPT-5.6 o Claude para programar?

Microsoft no publicó una comparación directa con modelos de frontera de otros proveedores en este anuncio. El posicionamiento del modelo no es competir en capacidad máxima sino entregar buen desempeño de código a una fracción del costo, en el rol de modelo pequeño y eficiente de alto volumen.

¿Por qué están bajando tan rápido los precios de los modelos de IA?

Porque la competencia se desplazó desde la capacidad máxima hacia el costo por unidad de trabajo útil. Los proveedores optimizan entrenamiento y servicio para entregar desempeño equivalente con menos cómputo, y usan el precio como palanca para ganar volumen dentro de sus propios productos.

¿Qué debería hacer una empresa en Chile o Latinoamérica ante estas bajas de precio?

Revisar el gasto en herramientas de IA cada trimestre en vez de cada año y negociar contratos que permitan capturar bajas de precio del proveedor. Muchas empresas de la región siguen pagando tarifas fijadas meses atrás por capacidades que hoy cuestan una fracción, con el agravante de que el pago es en dólares.

Comparte este análisis con tu equipo

Continúa explorando

Ver toda la categoría