Cómo usar Qwen3.8-Max gratis: guía completa con OpenRouter, TokenRouter y OrcaRouter

Qwen3.8-Max: el flagship de Alibaba
Qwen3.8-Max es el modelo insignia de la serie Qwen3.8 de Alibaba. Con 2.4 trillones de parámetros totales y 95B activos por token, contexto de 1 millón de tokens, input multimodal (texto, imágenes, video), reasoning mode y tool calling nativo, compite directamente con GPT-5.5, Claude Opus 4.7 y Gemini 3.1 Pro.
Pero lo mejor: puedes usarlo gratis. Esta guía te muestra cómo.
El modelo: specs técnicas
| Característica | Valor |
|---|---|
| Model ID (GA) | qwen3.8-max |
| Parámetros totales | 2.4T |
| Parámetros activos | 95B (~4%) |
| Contexto | 1.000.000 tokens (1M) |
| Max output | 131.072 tokens |
| Input | Texto, imágenes, video |
| Reasoning | Sí (low/medium/xhigh, xhigh default) |
| Tool calling | Sí |
| Structured outputs | Sí |
| API compatible | OpenAI, Anthropic, DashScope |
| Precio standard | $2/1M input, $6/1M output |
| Release date | 3 de agosto 2026 |
2 rutas para usar Qwen3.8-Max gratis
Ruta 1: OpenRouter (qwen/qwen3.8-max:free) — la más fácil
OpenRouter ofrece una variante gratuita del modelo con el sufijo :free. El modelo ID es qwen/qwen3.8-max:free y cuesta $0.00 por 1M tokens tanto de input como de output. Es la opción más straightforward: creas cuenta, generas key y usas.
Setup
- Crea una cuenta en openrouter.ai/keys
- Genera tu API key
- Usa el modelo
qwen/qwen3.8-max:free
Ejemplo con curl
curl https://openrouter.ai/api/v1/chat/completions \
-H "Authorization: Bearer $OPENROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "qwen/qwen3.8-max:free", "messages": [{"role": "user", "content": "Explica la teoria de relatividad"}]}'
Ejemplo con Python (OpenAI SDK)
from openai import OpenAI
client = OpenAI(
base_url="https://openrouter.ai/api/v1",
api_key="tu-openrouter-key"
)
response = client.chat.completions.create(
model="qwen/qwen3.8-max:free",
messages=[{"role": "user", "content": "Escribe una funcion Python para fibonacci"}]
)
print(response.choices[0].message.content)
Límites del tier gratuito en OpenRouter
| Estado de cuenta | Requests/día | Requests/minuto |
|---|---|---|
| Cuenta gratuita | 50 | 20 |
| Con $10+ en creditos | 1.000 | 20 |
Con depositar $10 en tu cuenta de OpenRouter (que puedes usar para cualquier modelo, no solo el free), subes a 1.000 requests/día. Pero el modelo :free sigue siendo $0 por token.
Ruta 2: OrcaRouter (qwen/qwen3.8-27b-free) — texto gratis sin límite explícito
Si no necesitas el Max sino una versión más ligera, OrcaRouter ofrece qwen/qwen3.8-27b-free completamente gratis. Es el modelo open-weight de 27B parámetros (Apache 2.0), self-hosteado por OrcaRouter.
Specs de Qwen3.8 27B free
| Característica | Valor |
|---|---|
| Model ID | qwen/qwen3.8-27b-free |
| Parámetros | 27B (dense) |
| Contexto | 65.536 tokens (64K) |
| Input | Texto |
| Tool calling | Sí |
| Reasoning | Sí |
| Structured outputs | Sí |
| Precio | $0 (free, rate-limited) |
| Licencia | Apache 2.0 |
Ejemplo
curl https://api.orcarouter.ai/v1/chat/completions \
-H "Authorization: Bearer $ORCAROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{"model": "qwen/qwen3.8-27b-free", "messages": [{"role": "user", "content": "Hello"}]}'
TokenRouter: la verdad sobre el "plan gratuito"
TokenRouter aparece en búsquedas con un modelo qwen/qwen3.8-max-free y un plan "Free" que dice no requerir tarjeta de crédito. Sin embargo, en la práctica requiere cargar saldo para empezar a usarlo. ¿Por qué?
TokenRouter es un gateway/router, no un provider de modelos. Su modelo de negocio es:
- Suscripción del gateway: plan Free de $0/mes (1.000 requests/mes, 2 providers conectados)
- Costo de los modelos: pagas a los providers (OpenAI, Anthropic, Qwen) sus precios reales por token. TokenRouter no añade markup.
Esto significa que aunque la suscripción al gateway sea gratis, necesitas cargar saldo o conectar tus propias API keys de los providers para que los modelos funcionen. El modelo qwen/qwen3.8-max-free aparece listado con costo $0, pero en la práctica la plataforma requiere que tengas saldo disponible en tu cuenta para procesar requests.
Conclusión sobre TokenRouter: si quieres una experiencia 100% gratuita sin depósitos, usa OpenRouter. Si ya tienes saldo en TokenRouter o quieres usarlo como gateway para múltiples providers, el modelo qwen/qwen3.8-max-free es una opción válida.
Comparación de las rutas gratuitas
| Característica | OpenRouter :free | OrcaRouter 27B free | TokenRouter free |
|---|---|---|---|
| Modelo | Qwen3.8-Max (2.4T) | Qwen3.8 27B (dense) | Qwen3.8-Max (2.4T) |
| Contexto | 1M tokens | 64K tokens | 1M tokens |
| Multimodal | Sí (texto, imagen, video) | No (solo texto) | Sí |
| Reasoning | Sí | Sí | Sí (low/medium/xhigh) |
| Tool calling | Sí | Sí | Sí |
| Requests gratis | 50/día (1.000 con $10) | Rate-limited | 1.000/mes (requiere saldo) |
| Depósito requerido | No (opcional $10 para más req) | No | Sí (cargar saldo para usar) |
| API compatible | OpenAI | OpenAI | OpenAI |
Cuál elegir
Para máxima calidad sin depósito (recomendado)
OpenRouter :free es la mejor opción. Tienes el modelo completo Qwen3.8-Max con 1M de contexto, multimodal y reasoning. 50 requests/día sin depositar nada. Si depositas $10 (usables en cualquier modelo), subes a 1.000/día.
Para alto volumen de texto
OrcaRouter 27B free es el más generoso (rate-limited pero sin límite explícito de requests). Si no necesitas multimodal ni 1M de contexto, el 27B es sorprendentemente capaz: 90.3 en LiveCodeBench v6 y 89.2 en GPQA Diamond.
Si ya tienes saldo en TokenRouter
Si ya eres usuario de TokenRouter o quieres un gateway multi-provider con budgets y rate limits, el modelo qwen/qwen3.8-max-free está disponible. Solo recuerda que necesitas saldo cargado para empezar.
Integración con coding agents
Free Claude Code (FCC)
Si usas Free Claude Code, puedes configurar OpenRouter como provider y usar qwen/qwen3.8-max:free como modelo.
OpenCode
TokenRouter tiene configuración nativa para OpenCode. En ~/.config/opencode/opencode.json:
{
"provider": {
"tokenrouter": {
"npm": "@ai-sdk/openai-compatible",
"name": "TokenRouter",
"options": {
"baseURL": "https://tokenrouter.me/v1",
"apiKey": "{env:TOKENROUTER_API_KEY}"
}
}
}
}
Para OpenRouter, simplemente usa https://openrouter.ai/api/v1 como base URL con tu OpenRouter API key.
Limitaciones a considerar
- Rate limits: las variantes gratuitas tienen límites significativos. Para producción necesitarás pagar.
- OpenRouter cuenta requests fallidos: un request que falla consume tu cuota diaria.
- TokenRouter requiere saldo: aunque el plan es "free", necesitas cargar saldo para usar los modelos.
- Open weights no disponibles aún: Alibaba prometió los pesos de Qwen3.8-Max en Hugging Face "next week" desde el 2 de agosto, pero aún no se han publicado. El 27B sí está disponible bajo Apache 2.0.
- El modelo Max es cerrado por ahora: no se puede self-hostear hasta que publiquen los pesos.
Conclusión
Qwen3.8-Max es uno de los modelos más potentes de 2026 y puedes usarlo gratis. OpenRouter es la opción más fácil: 50 requests/día con el modelo completo (1M contexto, multimodal) sin depositar nada. OrcaRouter ofrece el 27B open-weight sin costo para alto volumen de texto. TokenRouter tiene el modelo disponible pero requiere cargar saldo para empezar. Tres opciones, un modelo que compite con GPT-5.5 y Claude Opus 4.7.
Fuentes verificadas
openrouter.ai
openrouter.ai
unorouter.com
unorouter.com
docs.tokenrouter.me
docs.tokenrouter.me
www.tokenrouter.io
www.tokenrouter.io
github.com
github.com
www.orcarouter.ai
www.orcarouter.ai
www.orcarouter.ai
www.orcarouter.ai
www.eesel.ai
www.eesel.ai
tokencost.app
tokencost.app