Tendencias SaaS

Alibaba apunta a tareas de código y oficina con un modelo de IA de bajo costo

Alibaba presentó Qwen3.8-Flash, un modelo multimodal de pesos abiertos entrenado a un noveno del costo de su predecesor. La versión de producción saldrá vía QwenCloud a 16 centavos de dólar por millón de tokens de entrada.

5 min de lecturaFuente: PYMNTS
Imagen de marca de Alibaba Qwen, la familia de modelos de inteligencia artificial de Alibaba
Imagen: PYMNTS

La noticia en 30 segundos

Qwen3.8-Flash es el nuevo modelo multimodal de mezcla de expertos de Alibaba, anunciado el 26 de agosto de 2026 con pesos abiertos y como anticipo de la arquitectura Qwen4. Tiene 125 mil millones de parámetros más 51 mil millones de embeddings N-gram, y activa solo 6 mil millones por token. Alibaba afirma haberlo entrenado a un noveno del costo de Qwen3.7-Plus superándolo en toda la línea, con mejoras marcadas en código y tareas de oficina. La versión de producción llegará vía la API de QwenCloud a US$0,16 por millón de tokens de entrada y US$0,47 de salida.

Alibaba presentó Qwen3.8-Flash, un modelo de inteligencia artificial diseñado explícitamente alrededor de la eficiencia de costos, según anunció la compañía el miércoles 26 de agosto de 2026 en la plataforma X.

Qwen3.8-Flash es un modelo multimodal de mezcla de expertos (MoE) publicado con pesos abiertos y presentado como un anticipo temprano de la arquitectura Qwen4. La versión de producción estará disponible próximamente vía la API de QwenCloud a 16 centavos de dólar por cada millón de tokens de entrada y 47 centavos por millón de tokens de salida.

¿Qué arquitectura tiene Qwen3.8-Flash?

Según la publicación de Alibaba, el modelo cuenta con 125 mil millones de parámetros más 51 mil millones de embeddings N-gram, y activa apenas 6 mil millones por token. Esa dispersión extrema es la palanca que explica el precio: se paga por el cómputo activado, no por el tamaño total del modelo.

La afirmación de costo que hizo la compañía es la cifra a retener: «costos de entrenamiento e inferencia dramáticamente menores: entrenado a solo 1/9 del costo de Qwen3.7-Plus, superándolo en toda la línea, con mejoras especialmente fuertes en tareas de código y de oficina».

¿Por qué importa que Alibaba libere pesos abiertos?

Porque ya cambió el balance del ecosistema. El 15 de agosto de 2026 se reportó que los modelos de pesos abiertos de Alibaba se convirtieron en la oferta líder a nivel mundial, con más de 3 mil millones de descargas en los últimos seis meses, por encima de Meta, Google y DeepSeek.

La compañía indicó que Qwen ha liberado más de 460 modelos y que su ecosistema generó más de 300 mil derivados. Como contraste, datos del hub de IA abierta Hugging Face mostraron 418 millones de descargas anuales para Google y 227 millones para Meta.

¿Cómo se conecta con los resultados de Alibaba?

El 20 de agosto de 2026 Alibaba reportó que sus ingresos por productos relacionados con IA registraron crecimiento de tres dígitos por duodécimo trimestre consecutivo. «Con nuestra estrategia de IA full-stack, hemos puesto a Alibaba en una posición superior para capturar el sustancial crecimiento de la demanda por inteligencia artificial y cómputo de IA», señaló el CEO de Alibaba, Eddie Wu, en el comunicado de resultados.

El patrón es claro: los modelos abiertos y baratos no son filantropía, son adquisición de ecosistema que se monetiza en cómputo en la nube.

¿Qué significa esto para las empresas en Chile y Latinoamérica?

Significa que el precio de referencia del token sigue cayendo, y que existe una alternativa de pesos abiertos con desempeño competitivo en las dos categorías donde más gasta una empresa B2B: generación de código y tareas de oficina. Para una compañía en Chile o Latinoamérica que ya presupuestó su gasto anual de IA sobre precios de hace seis meses, ese supuesto quedó desactualizado.

Análisis de Revenue Hub

Hay que separar dos conversaciones que suelen mezclarse. La primera es el precio por token, y esa se está desplomando de manera estructural: cada trimestre aparece un modelo que hace lo mismo por una fracción. La segunda es el costo total de operar IA en un proceso comercial, que incluye integración con el CRM, gobierno del dato, evaluación de calidad, y el tiempo del equipo. Esa segunda cifra no baja sola con el precio del token.

La decisión práctica para un líder comercial en Chile o Latinoamérica no es migrar hoy a Qwen. Es no firmar compromisos multianuales de volumen a precios de hoy, y diseñar la arquitectura de forma que el modelo sea reemplazable. Si tu automatización de ventas, tu enriquecimiento de datos o tu generación de contenido están acopladas a un único proveedor sin capa de abstracción, estás pagando un impuesto de cambio que vas a sentir cada vez que aparezca una opción más barata. Un router de modelos o una capa intermedia propia deja de ser sobreingeniería y pasa a ser cobertura de riesgo.

La advertencia honesta: pesos abiertos y precio bajo no resuelven la pregunta de dónde vive el dato ni quién responde por un error del modelo frente a un cliente. Para casos con dato sensible o exposición regulatoria, el criterio de selección sigue siendo gobierno y trazabilidad, no el precio de lista. Seguimos este mercado en Tendencias SaaS y publicamos análisis de arquitectura comercial en el blog.

Fuente y criterio editorial

Revenue Hub resume, contextualiza y analiza esta información para equipos B2B de Chile y Latinoamérica. La publicación original pertenece a PYMNTS.

Leer la fuente original

Para profundizar

Preguntas frecuentes

¿Qué es Qwen3.8-Flash de Alibaba?

Es un modelo multimodal de mezcla de expertos anunciado por Alibaba el 26 de agosto de 2026, publicado con pesos abiertos y presentado como anticipo temprano de la arquitectura Qwen4. Está orientado a eficiencia de costos, con mejoras marcadas en tareas de código y de oficina.

¿Cuánto cuesta Qwen3.8-Flash por millón de tokens?

La versión de producción estará disponible vía la API de QwenCloud a US$0,16 por millón de tokens de entrada y US$0,47 por millón de tokens de salida, según el anuncio de Alibaba en X.

¿Cuántos parámetros tiene Qwen3.8-Flash?

Tiene 125 mil millones de parámetros más 51 mil millones de embeddings N-gram, y activa solo 6 mil millones de parámetros por token. Esa dispersión es lo que permite el precio bajo, porque el costo de inferencia depende del cómputo activado, no del tamaño total.

¿Qué tan barato fue entrenar Qwen3.8-Flash?

Alibaba afirma haberlo entrenado a un noveno del costo de Qwen3.7-Plus, superando a ese modelo en toda la línea, con ganancias especialmente fuertes en tareas de código y de oficina.

¿Los modelos de Alibaba superan a los de Meta y Google en descargas?

Sí. El 15 de agosto de 2026 se reportó que los modelos de pesos abiertos de Alibaba se convirtieron en la oferta líder mundial, con más de 3 mil millones de descargas en seis meses, por delante de Meta, Google y DeepSeek. En Hugging Face, Google registró 418 millones de descargas anuales y Meta 227 millones.

¿Conviene migrar a un modelo abierto chino para bajar costos?

Depende del caso de uso. Para tareas internas de alto volumen sin dato sensible, la ecuación de costo es favorable. Para procesos con dato regulado o exposición frente a clientes, el criterio de selección debería ser gobierno del dato y trazabilidad antes que precio de lista.

¿Qué debería hacer una empresa B2B en Chile o Latinoamérica ante esta caída de precios?

Evitar compromisos multianuales de volumen a precios actuales y diseñar la arquitectura para que el modelo sea reemplazable. Una capa de abstracción o un router de modelos reduce el costo de cambiar de proveedor cuando aparece una opción más barata.

¿Cómo monetiza Alibaba modelos que regala?

Vía cómputo en la nube y ecosistema. Alibaba reportó el 20 de agosto de 2026 que sus ingresos por productos de IA crecieron a tres dígitos por duodécimo trimestre consecutivo, sostenidos por lo que su CEO Eddie Wu llama una estrategia de IA full-stack.

Comparte este análisis con tu equipo