Cómo usar MiniMax M3 con OpenCode, Claude Code y Cursor: tutorial completo de instalación y configuración
MiniMax M3: el modelo
MiniMax M3 es un modelo MoE de 428B parámetros totales, ~23B activos por token, lanzado el 1 de junio de 2026. Soporta texto, imagen y video como input, con una ventana de contexto de 1M tokens garantizada (mínimo 512K). Usa MiniMax Sparse Attention (MSA), una arquitectura que reduce el compute por token a ~1/20 de la generación anterior a 1M tokens, con 9x prefill más rápido y 15x decode más rápido.
En benchmarks de coding, M3 alcanza rendimiento frontier-adjacent: SWE-Bench Pro 59.0%, Terminal-Bench 2.1 66.0%, SWE-Bench Verified 80.5%, MCP Atlas 74.2%. Artificial Analysis le da un Intelligence Index de 55, #1 en su clase open-weight.
Pricing
| Tier | Input/1M tokens | Output/1M tokens | Cached read/1M |
|---|---|---|---|
| Standard (≤512K input) 50% off permanente | $0.30 | $1.20 | $0.06 |
| Standard (>512K input) 50% off permanente | $0.60 | $2.40 | $0.12 |
| Priority (≤512K input) 1.5x standard | $0.45 | $1.80 | $0.09 |
| OpenRouter | $0.30 | $1.20 | — |
Para contexto: Claude Sonnet 5 cobra $10/M output. M3 cuesta ~8x menos en output tokens.
Checklist de configuración (60 segundos)
Antes de empezar, esto es lo que necesitas saber:
| Setting | Valor | Notas |
|---|---|---|
| Model ID | MiniMax-M3 | Case-sensitive, con guion |
| OpenAI base URL | https://api.minimax.io/v1 | Para OpenCode, Aider, Continue, Zed |
| Anthropic base URL | https://api.minimax.io/anthropic | Para Claude Code, Cursor, Cline, Kilo Code |
| China endpoint | https://api.minimaxi.com/v1 | Auto-detectado por región de cuenta |
| API Key type | Pay-as-You-Go | Las keys de chat.minimax.io NO funcionan |
| Context window | 1.048.576 tokens | Configurar maxTokens explícitamente |
| Output máximo | 131.072 tokens | — |
Paso 1: Obtener tu API Key de MiniMax
- Ve a platform.minimax.io y crea una cuenta
- Navega a API Keys → Pay-as-You-Go
- Genera una nueva API key. El formato será
MiniMax-PAYG-... - Carga saldo en tu cuenta (mínimo $5 recomendado para testing)
Importante: Las API keys de chat.minimax.io (suscripción) NO funcionan en herramientas de coding. Necesitas sí o sí una key Pay-as-You-Go de platform.minimax.io.
Alternativa: OpenRouter
Si ya tienes cuenta en OpenRouter, puedes usar M3 sin crear cuenta en MiniMax:
- Model ID:
minimax/minimax-m3 - Base URL:
https://openrouter.ai/api/v1 - API Key: tu key de OpenRouter
- Precio: $0.30/M input, $1.20/M output
Paso 2: Configurar OpenCode
OpenCode es la forma más fácil de usar M3 porque habla OpenAI nativamente y lee el endpoint de MiniMax sin adaptador.
Ubicación del config
- macOS/Linux:
~/.config/opencode/config.json - Windows:
%APPDATA%\opencode\config.json
Configuración directa (MiniMax API)
{
"providers": {
"MiniMax": {
"apiKey": "MiniMax-PAYG-...",
"baseURL": "https://api.minimax.io/v1"
}
},
"model": {
"provider": "MiniMax",
"id": "MiniMax-M3",
"maxTokens": 1048576
}
}
El detalle crítico: maxTokens: 1048576. OpenCode por defecto cap en 200K, lo que trunca silenciosamente el contexto completo de 1M de M3. Setting a 1.048.576 desbloquea la ventana completa.
Configuración vía OpenRouter
{
"providers": {
"OpenRouter": {
"apiKey": "sk-or-v1-...",
"baseURL": "https://openrouter.ai/api/v1"
}
},
"model": {
"provider": "OpenRouter",
"id": "minimax/minimax-m3",
"maxTokens": 1048576
}
}
Configuración vía OpenCode Zen (free tier)
OpenCode Zen ofrece minimax-m3-free para testing sin costo:
{
"$schema": "https://opencode.ai/config.json",
"provider": {
"opencode": {
"npm": "@ai-sdk/openai-compatible",
"name": "OpenCode Zen",
"options": {
"baseURL": "https://opencode.ai/zen/v1",
"apiKey": "YOUR_ZEN_API_KEY"
},
"models": {
"minimax-m3-free": {
"name": "MiniMax M3 Free"
}
}
}
},
"model": "opencode/minimax-m3-free"
}
Verificar que funciona
opencode
# Dentro de OpenCode, pregunta:
> ¿Qué modelo eres?
Debería responder indicando que está usando MiniMax M3.
Paso 3: Configurar Claude Code
Claude Code es el ejemplo canónico de la compatibilidad Anthropic-SDK de M3. Set dos variables de entorno y el CLI es M3-aware sin parches.
Setup con MiniMax directo
export ANTHROPIC_BASE_URL="https://api.minimax.io/anthropic"
export ANTHROPIC_API_KEY="MiniMax-PAYG-..."
claude --model MiniMax-M3
Para hacerlas persistentes, añade a ~/.zshrc o ~/.bashrc:
echo 'export ANTHROPIC_BASE_URL="https://api.minimax.io/anthropic"' >> ~/.zshrc
echo 'export ANTHROPIC_API_KEY="MiniMax-PAYG-..."' >> ~/.zshrc
Setup vía OpenCode Zen (gratis)
Edita ~/.claude/settings.json:
{
"env": {
"ANTHROPIC_BASE_URL": "https://opencode.ai/zen",
"ANTHROPIC_MODEL": "minimax-m3-free",
"ANTHROPIC_API_KEY": "YOUR_ZEN_API_KEY",
"ENABLE_TOOL_SEARCH": "true"
},
"model": "minimax-m3-free",
"theme": "dark"
}
Verificar
claude
> Which model are you running?
Una configuración correcta debería responder que está usando MiniMax M3. Los thinking blocks, prompt caching y tool-use round-trips funcionan a través del shim de Anthropic.
Paso 4: Configurar Cursor
Requisito: Cursor Pro ($20/mes). El campo Override Base URL solo está disponible en tier Pro. En Hobby, el campo está oculto y la request se envía al endpoint default de OpenAI.
Configuración
- Ve a Cursor → Settings → Models
- En Open AI API Key, pega tu key:
MiniMax-PAYG-... - En Override OpenAI Base URL, pega:
https://api.minimax.io/anthropic - Set el model a
MiniMax-M3 - Guarda y reinicia Cursor
Nota: Cursor no mostrará M3 en el model picker hasta que el override esté correcto. Si lo ves greyed-out como "Unknown model", el override está mal.
Paso 5: Configurar Aider
Con MiniMax directo
export OPENAI_API_BASE="https://api.minimax.io/v1"
export OPENAI_API_KEY="MiniMax-PAYG-..."
aider --model openai/MiniMax-M3
Con OpenRouter
aider --model openrouter/minimax/minimax-m3
Paso 6: Configurar Continue (VS Code)
Edita .continue/config.json en tu proyecto:
{
"models": [{
"title": "MiniMax M3",
"provider": "openai",
"model": "MiniMax-M3",
"apiBase": "https://api.minimax.io/v1",
"apiKey": "MiniMax-PAYG-..."
}]
}
Paso 7: Configurar OpenClaw
OpenClaw soporta M3 vía el provider opencode. El provider ID es opencode (sin guion, sin suffix -zen):
{
"models": {
"providers": {
"opencode": {
"baseUrl": "https://opencode.ai/zen/v1",
"apiKey": "YOUR_ZEN_API_KEY",
"api": "openai-completions",
"models": [
{
"id": "minimax-m3-free",
"name": "MiniMax M3 (1M Context)",
"api": "openai-completions",
"reasoning": false,
"input": ["text", "image"],
"cost": { "input": 0, "output": 0, "cacheRead": 0, "cacheWrite": 0 },
"contextWindow": 1000000,
"maxTokens": 32000
}
]
}
}
},
"agents": {
"defaults": {
"model": {
"primary": "opencode/minimax-m3-free",
"fallbacks": ["anthropic/claude-opus-4-6"]
},
"contextTokens": 1000000
}
}
}
Error común: contextWindow dentro de agents.defaults.models es rechazado por el schema. El path válido es agents.defaults.contextTokens. Si no lo set, OpenClaw cae a un fallback hardcoded de 200K.
Troubleshooting: errores comunes
1. "Unknown model" o modelo greyed-out en Cursor
Causa: Base URL incorrecta o tier Hobby (sin override).
Fix: Verifica que tienes Cursor Pro y que el Override Base URL es https://api.minimax.io/anthropic (no /v1).
2. CORS errors en el browser
Causa: Algunos entornos browser-based bloquean requests cross-origin a api.minimax.io.
Fix: Usa un proxy local o configura CORS headers en tu entorno. En tools CLI (OpenCode, Claude Code) esto no es un problema.
3. Model ID typo
Causa: minimax-m3 vs MiniMax-M3. El ID exacto es case-sensitive.
Fix: Usa exactamente MiniMax-M3 para MiniMax API directo. En OpenRouter usa minimax/minimax-m3 (minúsculas).
4. Context truncado a 200K silenciosamente
Causa: OpenCode y OpenClaw tienen defaults de 200K que se aplican si no se configura explícitamente.
Fix: Set maxTokens: 1048576 en OpenCode o contextTokens: 1000000 en OpenClaw.
5. API key de chat.minimax.io no funciona
Causa: Las keys de suscripción de chat son diferentes de las Pay-as-You-Go de platform.
Fix: Genera una key en platform.minimax.io → API Keys → Pay-as-You-Go.
6. OpenClaw: session_status cachea 200K después de cambiar config
Causa: Hot-reload aplica la config nueva pero session_status renderiza el valor cached.
Fix: Full gateway restart + sesión nueva.
Mejores prácticas para coding agéntico con M3
1. Aprovecha el contexto de 1M
M3 brilla cuando le das contexto extenso. Pasa repositorios completos, stack traces largos, documentación técnica y logs en una sola sesión. La sparse attention hace que el costo marginal de tokens adicionales sea bajo.
2. Usa prompt caching
M3 soporta prompt caching nativo. Si envías el mismo system prompt + tool definitions repetidamente, el cached read cuesta $0.06/M (vs $0.30/M sin cache), un 80% de ahorro.
3. Configura temperature correctamente
MiniMax recomienda temperature=1.0, top_p=0.95 para mejor rendimiento general. Para coding más determinista, puedes bajar a temperature=0.7.
4. Thinking mode
M3 tiene thinking mode togglable por request. Para tareas complejas de debugging o arquitectura, actívalo. Para tareas simples de completion, desactívalo para ahorrar tokens.
5. Image y video input
M3 es multimodal nativo. Puedes pasar screenshots de UIs, diagramas de arquitectura, o video de bugs directamente como contexto. El costo de image input es $1.00/M tokens de imagen.
6. Monitorea costos en el tier >512K
El precio se duplica cuando el input supera 512K tokens. Si tu workload regularmente pasa 512K, considera si necesitas tanto contexto o si puedes particionar la tarea.
MiniMax Code: la alternativa sin setup
Si no quieres configurar nada, MiniMax lanzó una interfaz de coding dedicada en code.minimax.io. Es un entorno purpose-built optimizado para coding tasks, similar a Claude Code o Codex. Solo necesitas iniciar sesión con tu cuenta de MiniMax. No requiere configuración de API.
Comparativa: M3 vs otros modelos en tools de coding
| Modelo | Output $/M | Contexto | SWE-Bench Pro | Terminal-Bench 2.1 | Licencia |
|---|---|---|---|---|---|
| MiniMax M3 | $1.20 | 1M | 59.0% | 66.0% | MiniMax Community |
| Claude Sonnet 5 | $10.00 | — | 63.2% | 80.4% | Propietario |
| Claude Fable 5 | — | — | 80.3% | 88.0% | Propietario |
| GPT-5.6 Luna Max | — | — | — | 82.5% | Propietario |
| Hy3 (Tencent) | $0.58 | 256K | 57.9% | 71.7% | Apache 2.0 |
| Laguna S 2.1 | — | 1M | 59.4% | 70.2% | OpenMDW-1.1 |
| Qwen 3.7 Max | — | — | 60.6% | 74.5% | — |
M3 ofrece el mejor ratio costo/rendimiento para coding agéntico: a $1.20/M output, es 8x más barato que Claude Sonnet 5 y competitivo en benchmarks.
FAQ
¿Puedo usar M3 con Claude Code?
Sí. M3 es compatible con el Anthropic Messages API. Set ANTHROPIC_BASE_URL y ANTHROPIC_API_KEY y usa --model MiniMax-M3.
¿Necesito cuenta de MiniMax o puedo usar OpenRouter?
Ambas opciones funcionan. OpenRouter te da acceso a M3 con tu key existente. MiniMax directo te da acceso a pricing con descuento permanente del 50% y prompt caching.
¿M3 soporta function calling?
Sí. M3 soporta function calling, tool use, structured outputs y code execution de forma nativa.
¿Cuánto cuesta una sesión típica de coding?
Una sesión de 1 hora con ~100K input tokens y ~20K output tokens cuesta aproximadamente $0.03 + $0.024 = ~$0.05. Con prompt caching, aún menos.
¿M3 tiene pesos descargables?
Sí. Los pesos están en Hugging Face como MiniMaxAI/MiniMax-M3 bajo MiniMax Community License. A 428B parámetros, self-hosting requiere hardware significativo.
¿OpenCode Zen free tier tiene límites?
Sí, el tier free de OpenCode Zen (minimax-m3-free) tiene límites de rate y uso. Para producción, usa API directa de MiniMax u OpenRouter.
¿M3 es mejor que Claude para coding?
No es mejor que Claude Fable 5 o Sonnet 5 en benchmarks absolutos, pero ofrece un ratio costo/rendimiento significativamente mejor. Para equipos con presupuesto, M3 es una alternativa muy competitiva.
Conclusión
MiniMax M3 es una de las opciones más atractivas para coding agéntico en 2026: contexto de 1M, multimodalidad nativa, compatibilidad dual con APIs de OpenAI y Anthropic, y un precio 8x menor que Claude. La configuración con OpenCode toma menos de 5 minutos, y la compatibilidad con Claude Code, Cursor, Aider y Continue lo hace drop-in para cualquier workflow existente. Si buscas reducir costos de coding IA sin sacrificar demasiado rendimiento, M3 es una de las mejores opciones disponibles hoy.