Guía

Qwen3.8-Max, explicado: cinco modelos llamados alguna versión de «Qwen3 Max» desde 2025, y de cuál se habla en realidad

Escribe «qwen3 max» en Google hoy y obtendrás resultados sobre un modelo que Alibaba descontinuó hace un año, junto a resultados sobre el que lanzó este mes, sin ninguna señal evidente de cuál es cuál. Un rastreador independiente todavía evalúa el antiguo. Hemos construido la cronología real, comprobado qué versiones son de pesos abiertos y cuáles no (la respuesta es más complicada que un sí o un no), y extraído el precio actual directamente de un listado de API activo.

Actualizado 8 sept 202610 min de lectura
Respuesta rápida

El buque insignia actual es Qwen3.8-Max, en concreto la actualización «-0902» que Alibaba lanzó el 2 de septiembre de 2026: 2,4 billones de parámetros en total, un diseño disperso de mezcla de expertos (MoE), una ventana de contexto de 1 millón de tokens, y 2,00 $ por millón de tokens de entrada / 6,00 $ por millón de tokens de salida en OpenRouter.

Es cerrado, solo por API. Alibaba no publicó los pesos de Qwen3.8-Max. Lo que sí publicó bajo el mismo nombre «3.8», por separado, fue un checkpoint reducido solo de texto (bajo una licencia personalizada restrictiva, no Apache) y un modelo denso de 27B sin relación (gratuito, Apache 2.0): tres productos distintos, un nombre compartido que confunde.

«Qwen3-Max» (sin «.8», sin versión de punto) es un modelo distinto, más antiguo y descontinuado de septiembre de 2025, con más de 1 billón de parámetros, que el propio sucesor de Alibaba deja obsoleto. Al menos un rastreador independiente de benchmarks todavía lo lista como punto de comparación activo, que es exactamente cómo se perpetúa la confusión.

La cifra de parámetros activos que verás por todas partes («~95.000 millones activos») no está confirmada por Alibaba. Es una estimación de fuentes secundarias ampliamente repetida. Alibaba ha revelado el total de 2,4 billones, pero no la cifra de parámetros activos.

La cronología, porque nadie más la ha expuesto así

El equipo Qwen de Alibaba ha lanzado cinco cosas con nombres distintos que llevan «Qwen3» y «Max» en alguna combinación durante el último año. Leído de izquierda a derecha, el nombramiento parece incremental. No lo es: son modelos diferentes con capacidades diferentes, licencias diferentes y, en dos casos, páginas de precios de distintas empresas que no coinciden sobre lo que cuesta el mismo modelo.

Date              Release                        What it is
------------------------------------------------------------------------
Sept 2025         Qwen3-Max-Preview, then         >1T params, MoE, closed,
                   Qwen3-Max (stable, Sept 23-24)   API/Qwen Chat only.
                                                     Now discontinued.
Jan 2026           Qwen3-Max-Thinking              Reasoning-mode variant
                                                     of the same Max line,
                                                     not a separate model
                                                     family. Closed.
Jul 19, 2026       Qwen3.8-Max (preview)           2.4T params announced
                                                     at WAIC Shanghai.
Aug 3, 2026        Qwen3.8-Max (GA)                Full release: 1M
                                                     context, $2/$6 per
                                                     1M tokens. Closed.
Aug 12-13, 2026    Qwen3.8-2.4T-A95B               Same base architecture,
                                                     text-only, reduced.
                                                     Open weights, but
                                                     restrictive custom
                                                     license (not Apache).
Aug 13-14, 2026    Qwen3.8-27B                     Unrelated dense model,
                                                     27B params, genuinely
                                                     open, Apache 2.0,
                                                     runs on one GPU.
Sept 2, 2026       Qwen3.8-Max-0902                Post-training refresh
                                                     of the Aug 3 build.
                                                     Same price/specs,
                                                     stronger coding and
                                                     agent benchmarks.

El modelo al que casi con toda seguridad te refieres cuando buscas «qwen3 max» hoy es la última fila: Qwen3.8-Max-0902, activo en OpenRouter desde el 3 de septiembre de 2026. Todo lo demás en la tabla, por encima de esa fila, está descontinuado, es un modo en lugar de un modelo aparte, o es un producto completamente distinto que resulta compartir nombre.

Por qué la confusión es real, y no solo redacción descuidada

Comprobamos Artificial Analysis, uno de los rastreadores independientes de benchmarks más citados, y su página de modelo «Qwen3 Max» sigue al modelo original de septiembre de 2025, no a Qwen3.8-Max. Esa página afirma que Alibaba nunca reveló un recuento de parámetros para ese modelo, lo marca como obsoleto con el benchmarking descontinuado salvo para una longitud de entrada de 10.000 tokens, y lista un precio de 1,20 $ por millón de tokens de entrada y 6,00 $ por millón de tokens de salida. El propio listado de OpenRouter para ese mismo modelo nominal muestra en cambio 0,78 $ de entrada y 3,90 $ de salida, un conflicto real y sin resolver entre dos fuentes activas sobre el precio de un modelo que todos coinciden en que ya está obsoleto. En el momento de escribir esto, Artificial Analysis todavía no había publicado una puntuación independiente para el propio Qwen3.8-Max, lo que significa que la mayoría de las cifras de benchmark que circulan sobre el modelo actual proceden de las tablas publicadas por la propia Alibaba, no de una verificación de terceros.

Esa brecha se hizo pública en cuestión de horas tras la actualización de la clasificación de un agregador. Un hilo de Hacker News que comentaba que Qwen3.8-Max estaba clasificado como «mejor modelo general por índice agéntico» sorprendió al proveedor del benchmark subyacente cambiando su modelo de puntuación a mitad de ciclo, con la puntuación de Qwen pasando de 55,4 a 58,4 y un modelo rival (Claude Opus) volviendo a superarlo dentro del mismo ciclo de noticias. Los comentaristas señalaron la volatilidad directamente: una posición en la clasificación cambiando de forma significativa «en cuestión de segundos» pese a que la descripción del benchmark subyacente era idéntica. Si eliges un modelo basándote en la captura de pantalla de una sola clasificación, ese hilo es un buen recordatorio de que la captura puede quedar desfasada antes de que termines de leerla.

Qué es realmente Qwen3.8-Max

El buque insignia actual es un modelo disperso de mezcla de expertos con 2,4 billones de parámetros en total. La cifra de «~95.000 millones de parámetros activos», comúnmente citada, aparece en casi todas las fuentes secundarias que cubren este modelo, pero no es un número que Alibaba haya confirmado en su propio anuncio; trátala como una estimación ampliamente repetida y no como una especificación. Es multimodal, acepta entrada de texto, imagen y vídeo, y Alibaba lo posiciona en torno a la programación, el desarrollo full-stack, el análisis de datos y el trabajo de oficina general, afirmando mejoras respecto a la generación anterior, Qwen3.7-Max, en esas tareas concretas.

La ventana de contexto llega hasta 1 millón de tokens (aproximadamente 991.000 utilizables para la entrada una vez descontado el presupuesto de salida), con hasta 131.072 tokens disponibles para una sola respuesta. En el listado activo de OpenRouter, tiene un precio de 2,00 $ por millón de tokens de entrada y 6,00 $ por millón de tokens de salida, con un precio de caché de 0,25 $ por millón para una lectura de caché y 2,50 $ por millón para una escritura de caché de 5 minutos. Está disponible a través de la propia interfaz Qwen Chat de Alibaba, la API de DashScope, OpenRouter y la integración con el IDE Qoder. Existe una afirmación independiente aparte, encontrada en una sola fuente y no corroborada en ningún otro sitio, de que el modelo admite un contexto nativo de 262.144 tokens ampliable a 1.010.000; no podemos confirmar ese planteamiento concreto, y trataríamos la cifra más simple de «hasta 1M» como la más segura de repetir.

¿De pesos abiertos o no? Depende de a qué «Qwen3.8» te refieras

Este es el punto de confusión más importante de todos, porque la respuesta honesta se divide en tres según exactamente qué producto estés mirando:

  • El propio Qwen3.8-Max, el buque insignia multimodal completo con la ventana de contexto de 1M, el que alcanzas a través de Qwen Chat, la API u OpenRouter, es cerrado. Alibaba no ha publicado sus pesos, y la cobertura de su anuncio de vista previa de julio de 2026 lo describió sin rodeos como propietario, de acceso solo por API, sin ningún lanzamiento descargable previsto.
  • Qwen3.8-2.4T-A95B, lanzado por separado en torno al 12-13 de agosto de 2026, comparte la misma arquitectura base pero es solo de texto, prescinde del contexto nativo de 1M y de la entrada de visión, y Alibaba sí publicó sus pesos, pero bajo una licencia personalizada, no Apache 2.0 ni ninguna otra licencia aprobada por la OSI. Según se informa, esa licencia exige un acuerdo comercial de pago en cuanto un despliegue supera ciertos umbrales de ingresos o de usuarios (las cifras citadas incluyen 50 millones de dólares/año en ingresos de MaaS, o 100 millones de usuarios activos mensuales / 20 millones de dólares de ingresos mensuales). Tras el lanzamiento circuló un rumor de que la licencia también llevaba restricciones territoriales de descarga en EE. UU., la UE, el Reino Unido y Corea del Sur; el texto de la licencia publicado en Hugging Face no contiene ninguna cláusula territorial de ese tipo, así que esa afirmación concreta hay que tratarla como desmentida, no repetirla como un hecho. Este no es el mismo producto que Qwen3.8-Max, aunque el nombre coincida casi por completo.
  • Qwen3.8-27B, lanzado en torno a la misma semana (13-14 de agosto de 2026), es un modelo denso mucho más pequeño, de 27.000 millones de parámetros, genuinamente abierto bajo Apache 2.0, y lo bastante pequeño como para ejecutarse en una sola GPU de consumo. Es una línea de modelos completamente separada de la familia Max; el «3.8» de su nombre es lo único que comparte con el buque insignia. Nuestra propia guía de Qwen3.8-27B explica qué puede y qué no puede hacer, si lo que realmente buscas es inferencia local autoalojada.

Dicho sin rodeos: si buscaste «is Qwen3.8-Max open source» esperando poder ejecutar el buque insignia en local, la respuesta es no. Si un titular te dijo que Qwen publicó los pesos de «Qwen3.8», es muy probable que se refiriera al checkpoint más pequeño 2.4T-A95B o al modelo 27B sin relación, no al producto Max completo al que la gente se refiere cuando dice «Qwen3.8-Max». Nuestra cobertura de Qwen3.8-Flash-Next cubre un tercer lanzamiento de pesos abiertos, independiente, de la misma familia, con su propia arquitectura de embeddings no paramétrica de contexto de 1M, un diseño genuinamente distinto tanto de la línea Max como del modelo 27B, pese al nombre generacional que comparten.

Cómo se compara, con la salvedad de que la mayoría de esto es autorreportado

El benchmarking independiente, de terceros, específico de Qwen3.8-Max es escaso por ahora. La mayoría de las cifras comparativas que circulan, incluidas las propias afirmaciones de Alibaba de superar a GPT-5.6 Sol Max y a Claude Fable 5 en tareas agénticas de uso de ordenador, proceden de las tablas publicadas por la propia Alibaba y no de un tercero neutral que ejecute la misma prueba en todos los modelos. Un dato útil, aunque limitado: una discusión en Hacker News citó cifras independientes de coste por tarea que sitúan a Qwen en torno a 1,13 $ por tarea frente a Claude Opus con aproximadamente 1,80 $ para un trabajo agéntico comparable, una brecha de eficiencia real si se confirma, pero extraída de la metodología de una sola fuente y no de un consenso amplio. Mientras que las cifras de benchmark de Gemini son descritas por al menos un rastreador como auditadas de forma independiente, las de Qwen se describen en esa misma fuente como autorreportadas. Esa asimetría importa si estás tomando una decisión de compra basada en una tabla comparativa: comprueba si las cifras de Qwen de esa tabla vienen de Alibaba o del mismo laboratorio que ejecutó todos los demás modelos de la fila.

Dónde encaja esto si no vives pendiente de los benchmarks de modelos

Si tu caso de uso real es resumir o chatear con documentos que ya tienes, en lugar de elegir un modelo de programación de frontera, Qwen3.8-Max en realidad no compite en ese carril: no tiene ningún producto de fundamentación documental construido a su alrededor como sí hacen Gemini Notebook o ChatPDF, y su contexto de 1M de tokens es una cifra de capacidad bruta, no un sistema de citas y recuperación. Si lo estás evaluando porque eliges entre modelos de frontera alojados para programación o trabajo agéntico, la lista de comprobación práctica es: confirma que estás mirando el precio de la actualización «-0902» y no del Qwen3-Max original ya obsoleto (los dos tienen precios distintos en al menos un rastreador), confirma si necesitas el buque insignia cerrado por API o si en realidad te bastaría el modelo de pesos abiertos 27B, y vuelve a verificar el precio actual directamente en la propia página de DashScope de Alibaba o en un listado activo de OpenRouter en lugar de en una entrada de blog estática, ya que esta familia de modelos en concreto ha cambiado de nombre y de precio dos veces en menos de doce meses.

El propio acceso se divide según las mismas líneas que el licenciamiento. Llegar a Qwen3.8-Max a través de la app Qwen Chat de Alibaba o de la API de DashScope requiere una cuenta de Alibaba Cloud y, para la API, una configuración de facturación sobre los precios por token mencionados arriba. OpenRouter es la vía más sencilla si ya lo usas para otros modelos: lista Qwen3.8-Max como un modelo de proveedor único (solo Alibaba Cloud International, sin enrutamiento de reserva), así que una caída del servicio o un límite de tasa por parte de Alibaba no tiene a dónde recurrir, a diferencia de algunos listados multiproveedor de la misma plataforma. Si lo que realmente quieres es ejecutar algo tú mismo en lugar de llamar a una API, recuerda que Qwen3.8-Max no es una opción: las vías de pesos abiertos de esta familia son el checkpoint de licencia restrictiva Qwen3.8-2.4T-A95B o el genuinamente abierto Qwen3.8-27B, y solo el modelo de 27B encaja de forma realista en el hardware que posee la mayoría de particulares o equipos pequeños.

Preguntas frecuentes

¿Qué es Qwen3.8-Max?

El actual modelo de IA insignia de Alibaba: un modelo disperso de mezcla de expertos con 2,4 billones de parámetros y una ventana de contexto de 1 millón de tokens, lanzado el 3 de agosto de 2026 y actualizado como «Qwen3.8-Max-0902» el 2 de septiembre de 2026. Es cerrado y solo por API, con un precio de 2,00 $ por millón de tokens de entrada y 6,00 $ por millón de tokens de salida en OpenRouter.

¿Es Qwen3.8-Max lo mismo que Qwen3-Max?

No. Qwen3-Max (sin «.8») es un modelo más antiguo y descontinuado de septiembre de 2025, con más de 1 billón de parámetros. Qwen3.8-Max es su sucesor de 2026, con más del doble de parámetros y una ventana de contexto mucho mayor. Al menos un rastreador de benchmarks todavía lista el modelo antiguo por separado, lo que es una fuente habitual de confusión.

¿Es Qwen3.8-Max de código abierto?

El buque insignia completo Qwen3.8-Max no es de pesos abiertos; es cerrado y solo está disponible a través de la API de Alibaba, Qwen Chat y plataformas de terceros como OpenRouter. Un checkpoint relacionado pero distinto, reducido y solo de texto (Qwen3.8-2.4T-A95B), se publicó con pesos abiertos bajo una licencia personalizada restrictiva, y un modelo aparte, más pequeño, de 27B (Qwen3.8-27B) se publicó bajo una licencia Apache 2.0 genuinamente abierta. Son tres productos distintos pese al nombre «3.8» compartido.

¿Cuánto cuesta Qwen3.8-Max?

2,00 $ por millón de tokens de entrada y 6,00 $ por millón de tokens de salida, según el listado activo de OpenRouter para la versión actual «-0902», a fecha de septiembre de 2026. El antiguo y descontinuado Qwen3-Max tenía un precio distinto, reportado de forma inconsistente, así que no reutilices ningún precio que encuentres para ese modelo.

¿Qué es Qwen3-Max-Thinking?

Una variante centrada en el razonamiento de la línea original Qwen3-Max, lanzada hacia enero de 2026. Los indicios sugieren que es un modo o checkpoint dentro del mismo linaje Max (activable mediante un parámetro de la API) en lugar de una arquitectura de modelo totalmente separada, aunque la cobertura no es del todo coherente en este punto. Sigue siendo cerrado, solo por API y Qwen Chat.

notebooklm-to-pdf.comTodas las guías

Exporta tu NotebookLM con un clic

Extensión de Chrome gratuita. PDF, Word y Markdown. Generado en tu equipo — nada se sube a la nube.

Seguir leyendo