Cómo usar Laguna S 2.1 gratis con Claude Code, OpenCode y otros agentes de coding (guía 2026)

Laguna S 2.1 gratis: qué necesitas saber
Laguna S 2.1 de Poolside es un modelo MoE de 118B parámetros totales (8B activos) diseñado para coding agéntico y trabajo long-horizon, con contexto de hasta 1M tokens. Lo mejor: es gratis de usar por tiempo limitado a través de varios proveedores, y puedes conectarlo a tus herramientas de coding favoritas en minutos.
Todas las opciones exponen APIs compatibles con OpenAI (chat completions), así que cualquier herramienta que funcione con el SDK de OpenAI funciona con Laguna S 2.1.
Rutas gratuitas disponibles
| Proveedor | Model ID | Contexto | Límite gratis | Registro |
|---|---|---|---|---|
| chat.poolside.ai | — | — | Uso web directo | Sin registro |
| OpenRouter (free) | poolside/laguna-s-2.1:free | 262K | 200 req/día | Cuenta gratis + API key |
| Vercel AI Gateway (free) | poolside/laguna-s-2.1-free | 256K | Según cuenta | Cuenta Vercel |
| NVIDIA NIM | poolside/laguna-xs-2.1 | 262K | 40 RPM | Cuenta NVIDIA |
| Ollama (local) | laguna-s-2.1 | 256K | Ilimitado (tu hardware) | No |
Nota importante: El uso en el free tier de OpenRouter puede usarse para entrenamiento. Si trabajas con código propietario o sensible, considera el endpoint pago ($0.10/M input, $0.20/M output) o self-hosting local.
Opción más rápida: chat.poolside.ai (sin registro)
Si solo quieres probar el modelo sin configurar nada, ve a chat.poolside.ai. No necesitas cuenta ni registro. Es ideal para evaluar la calidad del modelo antes de integrarlo en tu workflow.
Paso 1: Crear cuenta y API key en OpenRouter
OpenRouter es la forma más versátil de usar Laguna S 2.1 gratis con cualquier herramienta.
- Ve a openrouter.ai y crea una cuenta gratis (toma menos de un minuto)
- Navega a Keys y genera una nueva API key. Formato:
sk-or-v1-... - No necesitas tarjeta de crédito para el free tier
La misma API key funciona para todas las herramientas. El model ID gratuito es poolside/laguna-s-2.1:free (262K contexto, 200 req/día).
Paso 2: Configurar OpenCode
OpenCode es una herramienta de coding basada en terminal con TUI. Soporta providers custom vía archivo de configuración.
Ubicación del config
- macOS/Linux:
~/.config/opencode/config.json - Windows:
%APPDATA%\opencode\config.json
Configuración con OpenRouter (gratis)
{
"providers": {
"openrouter": {
"apiKey": "sk-or-v1-tu-key-aqui",
"baseURL": "https://openrouter.ai/api/v1"
}
},
"models": {
"laguna-s21": {
"provider": "openrouter",
"model": "poolside/laguna-s-2.1:free",
"maxTokens": 32768
}
},
"defaultModel": "laguna-s21"
}
Correr OpenCode
# Con el modelo default
opencode
# O especificar el modelo
opencode --model laguna-s21
Método alternativo: variables de entorno
OPENAI_API_BASE=https://openrouter.ai/api/v1 \
OPENAI_API_KEY=sk-or-v1-tu-key-aqui \
opencode --model poolside/laguna-s-2.1:free
Paso 3: Configurar Claude Code
Claude Code está optimizado para modelos Claude, pero soporta providers custom vía variables de entorno. Usar Laguna requiere routear a través del endpoint compatible con Anthropic de OpenRouter.
Método 1: OpenRouter como custom provider
export ANTHROPIC_BASE_URL="https://openrouter.ai/api/v1"
export ANTHROPIC_API_KEY="sk-or-v1-tu-key-aqui"
export CLAUDE_CODE_MODEL="poolside/laguna-s-2.1:free"
Luego corre Claude Code normalmente:
claude
Método 2: Model override flag
claude --model openrouter/poolside/laguna-s-2.1:free \
--api-key sk-or-v1-tu-key-aqui \
--provider openrouter
Limitaciones con Claude Code
Claude Code está optimizado para modelos Claude. Al usar Laguna:
- Las features de extended thinking de Anthropic no funcionan (Laguna usa su propio sistema de thinking vía
enable_thinking) - Algunos patrones de tool-use agénticos pueden ser menos confiables
- El prompt caching lo maneja OpenRouter, no el sistema nativo de Anthropic
Recomendación: Para la mejor experiencia con Laguna, OpenCode, Aider o el CLI pool son mejores opciones. Usa Claude Code con Laguna solo si ya es tu herramienta principal y quieres experimentar.
Paso 4: Configurar el CLI pool (recomendado por Poolside)
Todos los modelos Laguna se entrenan con reinforcement learning dentro del agent harness de Poolside, por lo que rinden mejor en pool, el CLI oficial de Poolside, o en cualquier cliente ACP-compatible.
# Instalar y configurar pool (documentación en docs.poolside.ai)
pool
# El CLI pool está diseñado específicamente para aprovechar
# el comportamiento agéntico y de thinking de los modelos Laguna
Si buscas el máximo rendimiento del modelo en tareas long-horizon, pool es la opción nativa que Poolside recomienda.
Paso 5: Configurar Aider
Aider soporta endpoints compatibles con OpenAI. Configúralo para Laguna:
Con OpenRouter (gratis)
export OPENROUTER_API_KEY="sk-or-v1-tu-key-aqui"
aider --model openrouter/poolside/laguna-s-2.1:free \
--api-key openrouter=$OPENROUTER_API_KEY
Configuración persistente
Añade a ~/.aider.conf.yml:
model: openrouter/poolside/laguna-s-2.1:free
openrouter-api-key: sk-or-v1-tu-key-aqui
Paso 6: Configurar Continue (VS Code / JetBrains)
Edita tu configuración de Continue:
{
"models": [
{
"title": "Laguna S 2.1 (gratis)",
"provider": "openai",
"model": "poolside/laguna-s-2.1:free",
"apiBase": "https://openrouter.ai/api/v1",
"apiKey": "sk-or-v1-tu-key-aqui"
}
]
}
Paso 7: Configurar Cline y Kilo Code
Cline y Kilo Code estuvieron disponibles desde el día del lanzamiento. Ambos usan configuración de provider compatible con OpenAI:
- Base URL:
https://openrouter.ai/api/v1 - API Key: tu key de OpenRouter
- Model ID:
poolside/laguna-s-2.1:free
En Cline: Settings → API Provider → OpenRouter → pega tu key y selecciona el modelo. En Kilo Code el flujo es idéntico.
Opción sin límites: correr Laguna S 2.1 localmente con Ollama
Si prefieres control total, privacidad y sin límites de rate, corre el modelo localmente con Ollama.
Instalar y correr
# Descargar y correr (tag por defecto: 256K contexto)
ollama run laguna-s-2.1
# Variantes disponibles:
# laguna-s-2.1:q4_k_m (75GB)
# laguna-s-2.1:q8_0 (128GB)
# laguna-s-2.1:f16 (235GB)
Conectar OpenCode a Ollama local
{
"providers": {
"ollama": {
"baseURL": "http://localhost:11434/v1"
}
},
"models": {
"laguna-local": {
"provider": "ollama",
"model": "laguna-s-2.1",
"maxTokens": 32768
}
},
"defaultModel": "laguna-local"
}
No necesitas API key para el provider de Ollama. Asegúrate de que Ollama esté corriendo y el modelo esté descargado antes de iniciar OpenCode.
Requisitos de hardware
El checkpoint BF16 completo necesita ~236GB (múltiples GPUs). Pero las variantes quantizadas reducen esto sustancialmente: la variante NVFP4 cabe en un single NVIDIA DGX Spark. Para la mayoría de usuarios, la versión gratis vía OpenRouter es más práctica que self-hosting.
Aprovechar el thinking mode
Laguna S 2.1 tiene soporte nativo de reasoning con thinking interleaved entre tool calls. El thinking mode tiene un impacto masivo en el rendimiento:
| Benchmark | Thinking OFF | Thinking MAX | Mejora |
|---|---|---|---|
| Terminal-Bench 2.1 | 60.4% | 70.2% | +9.8 pts |
| DeepSWE | 16.5% | 40.4% | +23.9 pts |
Cómo activarlo
El control es por request vía enable_thinking. En APIs compatibles con OpenAI, pásalo en chat_template_kwargs:
{
"model": "poolside/laguna-s-2.1:free",
"messages": [...],
"chat_template_kwargs": {"enable_thinking": true}
}
Importante para coding agéntico: Poolside recomienda mantener enable_thinking: true y preservar el reasoning_content de mensajes anteriores en el historial. El modelo razona antes de llamar tools y entre tool calls, pero puede dejar de razonar en pasos siguientes si se descartan los bloques de thinking previos.
Troubleshooting: errores comunes
1. Rate limit alcanzado (429) en OpenRouter free
Causa: El free tier tiene 200 req/día.
Fix: Espera al reset diario, usa el endpoint pago ($0.10/$0.20 por M), o cambia a NVIDIA NIM (40 RPM) o Ollama local.
2. Model ID incorrecto
Causa: Confundir el ID gratuito con el pago.
Fix: Gratis es poolside/laguna-s-2.1:free (con :free). Pago es poolside/laguna-s-2.1 (sin sufijo). En Vercel AI Gateway el gratis es poolside/laguna-s-2.1-free (con guion).
3. El modelo deja de razonar en tareas multi-paso
Causa: Se descartan los bloques reasoning_content del historial.
Fix: Preserva el reasoning_content de los mensajes assistant anteriores en el message history.
4. Contexto truncado
Causa: El free tier cap a 262K contexto y 32K output (vs 1M/131K del pago).
Fix: Para contexto de 1M usa el endpoint pago. Para la mayoría de tareas, 262K es más que suficiente.
5. Extended thinking no funciona en Claude Code
Causa: Laguna no usa la API de extended thinking de Anthropic.
Fix: Usa enable_thinking vía chat_template_kwargs, o cambia a OpenCode/Aider/pool para mejor soporte de thinking.
¿Qué herramienta elegir?
| Herramienta | Mejor para | Soporte de thinking |
|---|---|---|
| pool (Poolside CLI) | Máximo rendimiento, tareas long-horizon | Nativo (recomendado) |
| OpenCode | Terminal TUI, workflow general | Bueno |
| Aider | Coding con git, edits precisos | Bueno |
| Continue | Integración en VS Code/JetBrains | Bueno |
| Cline / Kilo Code | Agentes en VS Code | Bueno |
| Claude Code | Solo si ya es tu herramienta principal | Limitado |
FAQ
¿Realmente es gratis Laguna S 2.1?
Sí. Poolside lo ofrece gratis por tiempo limitado vía OpenRouter (200 req/día), Vercel AI Gateway y NVIDIA NIM. También puedes correrlo localmente sin costo con Ollama.
¿Necesito tarjeta de crédito?
No para el free tier de OpenRouter. Solo necesitas crear una cuenta gratis y generar una API key.
¿Mi código se usa para entrenamiento?
En el free tier de OpenRouter, el uso puede usarse para entrenamiento. Para código propietario, usa el endpoint pago o self-hosting local con Ollama.
¿Cuál es la diferencia entre el free y el pago?
Free: 262K contexto, 32K output, 200 req/día, posible uso para training. Pago: 1M contexto, 131K output, sin límite de requests, $0.10/M input y $0.20/M output.
¿Qué herramienta da mejor rendimiento?
El CLI pool de Poolside, porque los modelos Laguna se entrenaron dentro de su agent harness. OpenCode y Aider son excelentes alternativas.
¿Puedo usar Laguna S 2.1 comercialmente?
Sí. La licencia OpenMDW-1.1 permite uso comercial y no comercial. Los pesos están en Hugging Face.
¿Funciona con LangChain o CrewAI?
Sí. Al ser compatible con la API de OpenAI, funciona con frameworks de agentes como LangChain, CrewAI y el OpenAI Agents SDK.
Conclusión
Laguna S 2.1 es uno de los mejores modelos open weight de coding agéntico disponibles gratis en 2026. Con OpenRouter puedes empezar en menos de dos minutos: crea una cuenta, genera una API key, y conéctalo a OpenCode, Aider, Continue o Claude Code usando el model ID poolside/laguna-s-2.1:free. Para el máximo rendimiento, usa el CLI pool de Poolside, ya que los modelos Laguna se entrenaron dentro de su agent harness. Recuerda activar enable_thinking y preservar el reasoning en el historial para aprovechar el impacto masivo del thinking mode (+23.9 puntos en DeepSWE). Y si necesitas privacidad total, córrelo localmente con Ollama sin límites de rate. Sea cual sea tu workflow, tienes una ruta gratuita para probar coding agéntico frontier-adjacent hoy mismo.