MAI-Image-2.6 de Microsoft debuta segundo en Arena y supera a Google, Meta y xAI
Microsoft lanzó MAI-Image-2.6, su nuevo modelo de texto a imagen, que entró directo al segundo lugar del ranking de Arena con una mejora de +79 Elo sobre la versión anterior. Solo lo supera GPT Image 2 de OpenAI.

La noticia en 30 segundos
El 10 de agosto de 2026 Microsoft lanzó MAI-Image-2.6, su nuevo modelo de generación de imágenes, que debutó en el segundo lugar del ranking de texto a imagen de Arena. Mejora +79 puntos Elo sobre MAI-Image-2.5 y +91 Elo solo en renderizado de texto dentro de la imagen. Queda por delante de los modelos de Google, Meta y xAI, y por detrás de GPT Image 2 de OpenAI. Ya está disponible en Arena y llegará a MAI Playground y a Microsoft Foundry en las próximas semanas.
Microsoft anunció el 10 de agosto de 2026 el lanzamiento de MAI-Image-2.6, la nueva generación de su familia propia de modelos de texto a imagen. El modelo entró directamente al segundo lugar del ranking de texto a imagen de Arena, la evaluación comparativa por preferencia humana que se usa como referencia en la industria.
Según la compañía, MAI-Image-2.6 mejora +79 puntos Elo sobre MAI-Image-2.5 en el agregado, con avances en todas las categorías medidas por Arena. La mejora más grande está en el renderizado de texto dentro de la imagen, que sube +91 puntos Elo, históricamente el punto débil de los modelos de imagen para uso comercial.
De acuerdo con el tablero público de Arena, el modelo alcanzó 1.336 puntos, quedando 45 puntos por debajo de GPT Image 2 (Medium) de OpenAI en el primer lugar y 20 puntos por encima de Grok Imagine Image 2.0 (Low) de xAI en el tercero.
¿Qué mejora concretamente MAI-Image-2.6?
Microsoft detalla tres áreas de avance sobre la versión anterior:
- Renderizado de texto más sólido, es decir, letras y palabras legibles dentro de la imagen generada.
- Mejores retratos e imágenes 3D.
- Salidas comerciales y fotorrealistas más pulidas, con resultados más fuertes en usos de producto, branding y cinematográficos.
La empresa también adelantó capacidades de trabajo con múltiples referencias visuales, un anclaje más rico del prompt y mayor control sobre razonamiento, formato y resolución, sin dar todavía detalles técnicos completos.
¿Dónde se puede usar hoy?
MAI-Image-2.6 está disponible desde ya para texto a imagen en Arena. Microsoft indicó que llegará a MAI Playground en los días siguientes y que se desplegará en Microsoft Foundry y otros productos más adelante, la ruta habitual por la que estos modelos terminan integrados en Copilot y en el stack empresarial de Microsoft.
¿Por qué importa que sea un modelo propio de Microsoft?
Este lanzamiento continúa una línea que Microsoft viene empujando desde comienzos de 2026: construir su propia familia de modelos MAI en lugar de depender exclusivamente de OpenAI. Ya lo hizo con modelos de voz, transcripción, código, razonamiento y ciberseguridad. En generación de imágenes, el resultado es que Microsoft compite ahora de igual a igual con Google, Meta y xAI, y solo queda detrás de su propio socio comercial.
Para las empresas de Chile y Latinoamérica que ya pagan licencias de Microsoft 365 o Copilot, esto no es una curiosidad técnica: significa que la capacidad de generación de imágenes de calidad comercial llega dentro de un contrato que ya existe, sin sumar un proveedor nuevo.
¿Cómo se compara con GPT Image 2, Gemini y Grok Imagine?
En el ranking de Arena el orden queda así: GPT Image 2 de OpenAI primero, MAI-Image-2.6 de Microsoft segundo y Grok Imagine Image 2.0 de xAI tercero, con los modelos de Google y Meta por debajo. La diferencia entre el primero y el segundo es de 45 puntos Elo, un margen que en la práctica se traduce en preferencia humana levemente mayor, no en una brecha de categoría.
Dicho de otra forma: para la mayoría de los usos de marketing, la decisión ya no pasa por cuál modelo es mejor en abstracto, sino por cuál está disponible dentro del stack que la empresa ya tiene contratado.
Análisis de Revenue Hub
La lectura para un líder de marketing en Chile o Latinoamérica no es «hay un modelo nuevo». Es que la generación de imagen de calidad comercial dejó de ser un diferencial y pasó a ser una utility. Cuando cuatro proveedores grandes están a menos de 50 puntos Elo de distancia y todos vienen empaquetados dentro de suites que las empresas ya pagan, el costo marginal de producir creatividad visual tiende a cero. Lo que se vuelve escaso es el criterio: qué se produce, para qué segmento y con qué mensaje.
La decisión concreta que esto obliga a tomar es de presupuesto. Si tu equipo todavía terceriza producción visual de volumen (banners, variantes de anuncios, imágenes de producto para catálogo), ese gasto ya no se justifica al mismo nivel. El riesgo del lado opuesto es igual de real: bajar el costo de producir imágenes sin subir el estándar de estrategia solo genera más ruido en canales que ya están saturados de contenido generado con IA.
La recomendación es simple. Antes de sumar otra herramienta, revisa qué capacidad de generación ya viene incluida en tu contrato actual de Microsoft, Google o Adobe, y redirige el ahorro hacia investigación de audiencia y medición. Si te interesa el fondo del tema, en nuestra sección de marketing y demanda seguimos la evolución de la visibilidad de marca en buscadores y motores de IA, y en el blog publicamos análisis más largos sobre cómo estructurar contenido para que los modelos lo citen.
Fuente y criterio editorial
Revenue Hub resume, contextualiza y analiza esta información para equipos B2B de Chile y Latinoamérica. La publicación original pertenece a Microsoft AI.
Leer la fuente originalPara profundizar
Preguntas frecuentes
¿Qué es MAI-Image-2.6?
Es el nuevo modelo de generación de imágenes a partir de texto de Microsoft, anunciado el 10 de agosto de 2026. Pertenece a la familia MAI, la línea de modelos propios que Microsoft desarrolla en paralelo a su acuerdo con OpenAI.
¿En qué puesto quedó MAI-Image-2.6 en Arena?
Debutó en el segundo lugar del ranking de texto a imagen de Arena, por delante de los modelos de Google, Meta y xAI, y por detrás de GPT Image 2 de OpenAI.
¿Cuánto mejoró respecto de MAI-Image-2.5?
Microsoft reporta una mejora de +79 puntos Elo en el agregado y de +91 puntos Elo específicamente en renderizado de texto dentro de la imagen, con avances en todas las categorías medidas por Arena.
¿MAI-Image-2.6 es mejor que GPT Image 2?
No según Arena. GPT Image 2 (Medium) de OpenAI sigue en el primer lugar con 45 puntos Elo de ventaja sobre MAI-Image-2.6. Es una diferencia acotada, no una brecha de categoría.
¿Dónde se puede usar MAI-Image-2.6 desde Chile o Latinoamérica?
Hoy está disponible para texto a imagen en Arena. Microsoft indicó que llegará a MAI Playground y luego se desplegará en Microsoft Foundry y otros productos de la compañía, la ruta habitual hacia Copilot y el stack empresarial.
¿Qué significa el puntaje Elo en modelos de imagen?
Es un puntaje comparativo basado en preferencia humana: se muestran dos imágenes generadas por modelos distintos y las personas eligen cuál prefieren. Más puntos Elo significa que el modelo gana más comparaciones.
¿Por qué Microsoft desarrolla sus propios modelos si tiene acuerdo con OpenAI?
Para reducir dependencia y costo. Durante 2026 Microsoft lanzó modelos propios de voz, transcripción, código, razonamiento y ciberseguridad, y los integra en productos como GitHub Copilot y Excel, en varios casos a un costo por token menor que el de los modelos de terceros.
¿Conviene cambiar de herramienta de generación de imágenes por este lanzamiento?
No de inmediato. La diferencia de calidad entre los principales modelos es acotada. Lo razonable es revisar primero qué capacidad de generación ya viene incluida en los contratos vigentes de Microsoft, Google o Adobe antes de sumar un proveedor nuevo.



