Qwen3.8-Max-Preview ya está disponible: el flagship de 2.4T parámetros de Alibaba llega al frontier (guía completa)

Qwen3.8-Max-Preview: el primer Qwen que cruza el billón de parámetros
El 19 de julio de 2026, en la World Artificial Intelligence Conference (WAIC) de Shanghái, el equipo Qwen de Alibaba anunció Qwen3.8-Max-Preview, el primer modelo de la familia Qwen que supera el billón de parámetros y el primero en hacerlo como sistema multimodal nativo. Con 2.4 billones de parámetros totales (2.4T) en una arquitectura sparse Mixture-of-Experts (MoE), el modelo promete rendimiento de nivel frontier, posicionándose —según las propias palabras de Alibaba— como "el segundo mejor modelo del mundo, solo por detrás de Claude Fable 5".
Pero hay un matiz importante: lo que está disponible hoy es un preview, no un release final. El modelo ID qwen3.8-max-preview está vivo y usable, pero Alibaba no ha publicado todavía la tabla de benchmarks, el model card, los pesos descargables, la licencia, ni el pricing estándar por token. Es un modelo "continuously evolving" que puede cambiar sin previo aviso durante el periodo de preview.
Especificaciones técnicas
| Especificación | Qwen3.8-Max-Preview |
|---|---|
| Model ID | qwen3.8-max-preview |
| Parámetros totales | 2.4 billones (2.4T) |
| Arquitectura | Sparse Mixture-of-Experts (MoE) |
| Parámetros activos por token | No revelado |
| Ventana de contexto | 983.616 tokens (~1M) en metadata oficial de Qwen Cloud; 1.000.000 en integración Qwen Code |
| Output máximo | 131.072 tokens |
| Modalidades de input | Texto, imágenes, video y documentos |
| Reasoning | Siempre habilitado (thinking mode) |
| Niveles de reasoning | low, high, xhigh |
| Default reasoning level | xhigh |
| Default thinking temperature | 0.6 (valores menores se ajustan a 0.6) |
| API compatibility | OpenAI spec y Anthropic Messages API |
| Parallel tool calls | No soportado en metadata de Codex |
| Licencia | Propietaria (preview); open weights prometidos "pronto" |
Multimodalidad nativa a escala
Esta es la primera vez que Qwen ofrece un modelo por encima de 1T de parámetros con multimodalidad nativa. Los Qwen Max anteriores, incluyendo Qwen3.7-Max, eran text-only. Qwen3.8-Max-Preview procesa texto, imágenes, video y documentos en un único modelo, sin un vision encoder bolted-on ni una variante separada. Si las claims se sostienen bajo testing independiente, cierra una brecha real frente a GPT-5.5 y Gemini 3.5 Pro, que ofrecen multimodalidad nativa desde hace varias generaciones.
Thinking mode con tool orchestration
El modelo soporta thinking mode explícito con function calling y herramientas integradas, siguiendo el patrón que Alibaba estableció con Qwen3-Max-Thinking: el modelo razona sobre qué tool invocar y cómo interpretar los resultados antes de responder, en lugar de llamar tools de forma reactiva. Las herramientas integradas en el Token Plan incluyen:
- Web search
- Code interpreter
- Web scraping
- Reverse image search
- Text-to-image search
¿Cómo acceder a Qwen3.8-Max-Preview?
El acceso confirmado actualmente es a través de tres canales de Alibaba:
1. Alibaba Token Plan
Suscripción basada en credits con tres tiers individuales:
| Plan | Precio promocional/mes | Credits (5h) | Credits (7 días) | Agentes concurrentes |
|---|---|---|---|---|
| Lite | $6 | 700 | 2.500 | 1-2 |
| Standard | $18 | 3.000 | 10.000 | 3-4 |
| Pro | $68 | 12.000 | 40.000 | 6-8 |
Los precios regulares detrás de la promoción son $8, $25 y $90 respectivamente. Los credits se comparten entre todos los modelos y modalidades soportadas, no son exclusivos de Qwen3.8.
2. Qoder
El entorno de coding de Alibaba expone el preview para workflows de repositorio y desarrollo de software. Productos soportados:
- Qoder Desktop
- Qoder JetBrains Plugin
- Qoder CLI
- QoderWake
- Qoder Cloud Agents
- Qoder Mobile/Web App
3. QoderWork
El asistente de escritorio de Alibaba expone el modelo para documentos, archivos, procesamiento de datos y tareas de knowledge work.
Compatibilidad con tools externos
Qwen Cloud documenta conexiones con herramientas externas como Codex, Qwen Code, Claude Code, Cursor y OpenCode. El modelo es compatible con specs de OpenAI y Anthropic, por lo que puedes apuntar tooling existente con un cambio de base URL.
Pricing promocional: 90% de descuento
Durante el periodo de preview, Qoder ofrece descuentos agresivos:
| Horario (UTC+8) | Rate estándar | Rate promocional | Descuento |
|---|---|---|---|
| Regular (08:00-22:00) | 0.5x | 0.05x | 90% off |
| Off-peak (22:00-08:00) | 0.5x | 0.01x | 98% off |
Esto significa que durante horas off-peak, el consumo de credits se reduce a 1/50 del rate estándar. El descuento aplica automáticamente para usuarios Pro, Pro+, Ultra, Pro Trial, Teams y Enterprise. No hay per-token API pricing publicado para Qwen3.8 específicamente.
¿Qué dice Alibaba sobre el rendimiento?
Alibaba claim que Qwen3.8-Max-Preview es "second only to Claude Fable 5" entre los modelos frontier. También afirma mejoras significativas sobre Qwen3.7-Max en:
- Coding y full-stack development
- Data analysis
- Office workflows
- Tareas long-horizon complejas
Lo que NO hay
El problema es que no hay benchmark table publicada. No hay scores en SWE-bench, LiveCodeBench, MMLU, GPQA, AIME, ni ningún otro benchmark estándar. No hay model card, no hay technical report, no hay evaluación independiente de Artificial Analysis, LMArena u OpenRouter. La claim "segundo solo a Fable 5" descansa enteramente en la evaluación interna de Alibaba, sin metodología publicada.
Para contexto, esto es lo que Qwen3.7-Max (el predecesor) tiene publicado:
| Benchmark | Qwen3.7-Max | Qwen3.8-Max-Preview |
|---|---|---|
| AA Intelligence Index | 56.6 | No publicado |
| SWE-bench Verified | 80.4% | No publicado |
| SWE-bench Pro | 60.6% | No publicado |
| Terminal-Bench 2.0 | 69.7% | No publicado |
En Hacker News, los escépticos notaron que Qwen tiene reputación de especialista en benchmarks, y "confía en nosotros, es #2" es exactamente el tipo de claim que una benchmark table existe para settles.
Qwen3.8 vs competidores
vs Kimi K3 (Moonshot)
Kimi K3 de Moonshot se lanzó como un release open-weight real (2.8T parámetros, Modified MIT), lo que hace que el "soon" de Qwen parezca reactivo. K3 tiene pesos descargables, benchmarks publicados y licencia clara. Qwen3.8 tiene un endpoint vivo pero no pesos verificables.
vs Claude Fable 5 (Anthropic)
Alibaba posiciona a Qwen3.8 como segundo solo a Fable 5, pero sin benchmarks publicados, la comparación es una claim de vendor, no un hecho verificable. Fable 5 sigue siendo el frontier cerrado de referencia.
vs GPT-5.5/GPT-5.6 (OpenAI)
OpenAI y Meta recientemente lanzaron modelos que superan a las ofertas actuales de Google y Qwen en coding. Qwen3.8 necesita publicar benchmarks para demostrar que está al nivel.
vs Gemini 3.5 Pro (Google)
Gemini 3.5 Pro está retrasado por problemas de coding. Qwen3.8 tiene la ventaja de estar disponible ahora (en preview), pero sin benchmarks publicados, es difícil comparar directamente.
Open weights: prometidos pero sin fecha
Alibaba dice que Qwen3.8 irá open-weight "pronto", pero no ha anunciado:
- Fecha de release de los pesos
- Licencia específica
- Checkpoint exacto
- Requisitos de serving
El término cuidadoso es "open-weight", no "open source", porque Alibaba no ha prometido datos de entrenamiento, código de entrenamiento completo, ni una licencia estilo OSI-approved.
¿Self-hosting realista?
Un modelo de 2.4T parámetros a 4-bit precision necesita aproximadamente 1.2 terabytes solo para los pesos. Una NVIDIA H200 individual lleva 141GB. Incluso un servidor de 8 tarjetas deja matemáticas incómodas y una lista muy corta de quienes pueden cargarlo. Self-hosting de Qwen3.8 Max no es algo que equipos normales podrán hacer, pesos o no pesos, hasta que aparezca una variante distilled o más pequeña.
Contexto: la carrera de los labs chinos
Qwen3.8-Max-Preview llega en una ventana de dos semanas con tres releases mayores del ecosistema IA:
- Kimi K3 (Moonshot): 2.8T parámetros, open-weight real, Modified MIT
- Qwen3.8-Max-Preview (Alibaba): 2.4T parámetros, preview, open weights prometidos
- DeepSeek V4 Pro: listado en la campaña global de Alibaba Cloud junto a Qwen3.7 Max y GLM-5.2
Los labs chinos están compitiendo duro en escala. Qwen3.8 es una señal clara de que la carrera no se ralentiza. Pero la diferencia entre anunciar y shippear pesos verificables sigue siendo el test que separa un release real de un preview de marketing.
Cómo evaluar Qwen3.8-Max-Preview hoy
Recomendaciones prácticas
- Guarda metadata de cada test: fecha, endpoint, versión del agent harness, prompt, output, y cualquier model identifier retornado por el server. Un spreadsheet con solo "Qwen3.8 passed" será imposible de interpretar después de que el endpoint cambie
- No construyas roadmaps sobre el preview: el modelo puede cambiar, ser removido o reemplazado por una versión de producción con diferente ID
- Compara con Qwen3.7-Max en el mismo harness: corre las mismas tareas en ambos modelos para tener una comparación apples-to-apples
- Presupuesta sin el descuento: el 90% off es temporal por definición. Planifica con el número sin descontar
- Prueba por $6: el tier Lite del Token Plan es la forma más barata de evaluar el modelo
Para uso en producción
Si necesitas predictable per-token pricing hoy, los tiers anteriores de Qwen son la opción más segura. Qwen3.7-Max está disponible con pricing estándar y es el modelo production-ready hasta que 3.8 tenga GA con API pricing publicada.
FAQ
¿Qwen3.8-Max-Preview es gratis?
No, pero está disponible desde $6/mes (tier Lite del Token Plan) con pricing promocional al 10% del rate estándar. No hay pricing per-token publicado para Qwen3.8 específicamente.
¿Puedo descargar los pesos de Qwen3.8?
No todavía. Alibaba promete open weights "pronto", pero no ha publicado fecha, licencia ni checkpoint. El modelo disponible hoy es un endpoint hosted.
¿Qué contexto tiene Qwen3.8-Max-Preview?
983.616 tokens según la metadata oficial de Qwen Cloud (~1M). La integración de Qwen Code reporta 1.000.000 tokens. Output máximo de 131.072 tokens.
¿Es mejor que Claude Fable 5?
Alibaba dice que es "second only to Fable 5", pero no ha publicado benchmarks que respalden esa claim. No hay evaluación independiente disponible todavía.
¿Puedo usar Qwen3.8 con Claude Code o Cursor?
Sí. El modelo es compatible con specs de OpenAI y Anthropic Messages API. Qwen Cloud documenta conexiones con Claude Code, Cursor, OpenCode, Codex y Qwen Code.
¿Qué modalidades soporta?
Texto, imágenes, video y documentos como input. Es el primer Qwen Max multimodal nativo. Los Qwen Max anteriores eran text-only.
¿Cuándo será GA (General Availability)?
No hay fecha anunciada. Alibaba dice que el preview se actualizará continuamente y puede ser reemplazado por una versión de producción. El modelo ID podría cambiar.
Conclusión
Qwen3.8-Max-Preview es un anuncio ambicioso: 2.4T parámetros, multimodal nativo, contexto de 1M, thinking mode y compatibilidad dual con APIs de OpenAI y Anthropic. Es una señal clara de que Alibaba está empujando el frontier con los labs occidentales. Pero el estado actual es preview, no release: sin benchmarks publicados, sin pesos descargables, sin licencia, sin pricing per-token, y con un modelo que puede cambiar sin previo aviso. Para desarrolladores curiosos, $6 es un costo razonable para evaluar. Para equipos que necesitan construir sobre algo estable, Qwen3.7-Max sigue siendo la opción production-ready. La pregunta clave es cuánto tardará Alibaba en publicar los benchmarks y pesos que transformen las claims en hechos verificables.