Strix: el pentesting autónomo con IA open source que explota y arregla tu app (tutorial completo de instalación y uso)
¿Qué es Strix?
Strix es una herramienta de pentesting autónomo con IA, open source (Apache 2.0), que deploys agentes de IA que actúan como hackers reales: ejecutan tu código dinámicamente, encuentran vulnerabilidades y las validan con proofs-of-concept reales. No es un scanner estático que reporta falsos positivos: es un equipo de pentesters IA que intenta explotar tu app de verdad.
Con 49.500+ stars en GitHub y ~7.000 stars por semana, es uno de los repos de seguridad que crece más rápido en 2026. Creada por usestrix, la herramienta está construida para developers y security teams que necesitan testing rápido y preciso sin el overhead del pentesting manual.
¿Por qué Strix y no un scanner tradicional?
- Validación real: cada vulnerabilidad reportada incluye un working PoC (proof-of-concept), no un "potencial issue"
- Multi-agent orchestration: equipos de agentes IA especializados que colaboran como un red team
- Developer-first CLI: findings accionables con remediation guidance
- Auto-fix & reporting: genera patches y reportes compliance-ready
- Docker sandbox: los exploits corren dentro de un contenedor, no en tu host
Prerrequisitos
- Docker instalado y corriendo
- Una API key de LLM de cualquier provider soportado (OpenAI, Anthropic, Google, etc.)
- Sistema operativo: macOS, Linux o Windows (con WSL)
Instalación y primer escaneo
1. Instalar Strix
curl -sSL https://strix.ai/install | bash
2. Configurar tu provider de IA
export STRIX_LLM="openai/gpt-5.4"
export LLM_API_KEY="your-api-key"
Strix guarda tu configuración automáticamente en ~/.strix/cli-config.json, así que no necesitas re-exportar en cada run.
3. Ejecutar tu primer security assessment
strix --target ./app-directory
El primer run descarga automáticamente la Docker sandbox image. Los resultados se guardan en strix_runs/<run-name>.
Configuración de modelos
Modelos recomendados
| Provider | Modelo | String de config |
|---|---|---|
| OpenAI | GPT-5.4 | openai/gpt-5.4 |
| Anthropic | Claude Sonnet 4.6 | anthropic/claude-sonnet-4-6 |
| Gemini 3 Pro Preview | vertex_ai/gemini-3-pro-preview |
Variables de entorno opcionales
export LLM_API_BASE="your-api-base-url" # Para modelos locales (Ollama, LMStudio)
export PERPLEXITY_API_KEY="your-api-key" # Para capabilities de búsqueda
export STRIX_REASONING_EFFORT="high" # Nivel de reasoning (default: high, quick: medium)
Login con suscripción de ChatGPT (sin API key metered)
strix auth login chatgpt # Sign in con tu cuenta ChatGPT
export STRIX_LLM="chatgpt/gpt-5.4" # Usa tu suscripción en lugar de API key
strix --target ./app-directory
strix auth status # Ver el login activo
strix auth logout # Cerrar sesión
Uso básico: tipos de escaneo
Escaneo de codebase local
strix --target ./app-directory
Security review de un repo de GitHub
strix --target https://github.com/org/repo
Black-box web app assessment
strix --target https://your-app.com
API Testing (OpenAPI / Swagger / Postman)
Apunta Strix a un API contract y testea cada endpoint declarado en lugar de tener que descubrirlos crawleando. Pair el spec con la live base URL:
OpenAPI / Swagger file
strix --target ./openapi.yaml --target https://api.your-app.com
Postman collection export
strix --target ./collection.postman_collection.json --target https://api.your-app.com
Postman collection live por ID
export POSTMAN_API_KEY="PMAK-..."
strix --target postman://<collection-uuid>
# Con Postman environment para resolver {{baseUrl}} / token variables
strix --target "postman://<collection-uuid>?env=<environment-uuid>"
Escenarios avanzados
Grey-box authenticated testing
strix --target https://your-app.com \
--instruction "Perform authenticated testing using credentials: user:pass"
Multi-target testing (source code + deployed app)
strix -t https://github.com/org/app -t https://your-app.com
Targets desde archivo
strix --target-list ./targets.txt
White-box source-aware scan
strix --target ./app-directory --scan-mode standard
Focused testing con instrucciones custom
strix --target api.your-app.com \
--instruction "Focus on business logic flaws and IDOR vulnerabilities"
Instrucciones desde archivo (rules of engagement, scope, exclusions)
strix --target api.your-app.com --instruction-file ./instruction.md
PR diff-scope contra una base branch
strix -n --target ./ --scan-mode quick --scope-mode diff --diff-base origin/main
Headless mode (non-interactive)
Ejecuta Strix programáticamente sin UI interactiva usando -n / --non-interactive. Perfecto para servers y jobs automatizados. El CLI imprime findings en tiempo real y el reporte final antes de exit. Exits con código non-zero cuando encuentra vulnerabilidades.
strix -n --target https://your-app.com
CI/CD con GitHub Actions
Strix puede integrarse a tu pipeline para correr security tests en pull requests con un lightweight workflow:
name: strix-penetration-test
on:
pull_request:
jobs:
security-scan:
runs-on: ubuntu-latest
steps:
- uses: actions/checkout@v6
with:
fetch-depth: 0
- name: Install Strix
run: curl -sSL https://strix.ai/install | bash
- name: Run Strix
env:
STRIX_LLM: ${{ secrets.STRIX_LLM }}
LLM_API_KEY: ${{ secrets.LLM_API_KEY }}
run: strix -n -t ./ --scan-mode quick
Tip: En CI pull request runs, Strix automáticamente scopea los quick reviews a los archivos cambiados. Si diff-scope no resuelve, asegúrate de que checkout use full history (fetch-depth: 0) o pasa --diff-base explícitamente.
Local Web Viewer: dashboard de resultados
Cada scan escribe resultados a disk mientras corre. Ábrelos en un dashboard local con un solo comando:
# Abrir el run más reciente
strix view
# Abrir un run específico por nombre
strix view my-run-name
strix view inicia un lightweight local server (bound a 127.0.0.1 en un random port) y abre tu browser a un link privado con token. Nada sale de tu máquina: el dashboard lee los archivos del run directo del disk, sin cloud account ni upload. La UI viene prebuilt con Strix, sin extra install ni JS build step.
Qué incluye el dashboard
- Overview: run status, target y severity breakdown de todo lo encontrado
- Vulnerabilities: cada finding validado con severity, details y reproduction steps
- Agent graph: mapa live del multi-agent team, mostrando qué agente hace qué
- Steering: envía instrucciones a un scan en vivo desde el browser para redirigir agentes mid-run
- History: navega runs pasados en esta máquina
- Reports: genera reportes shareables y envíalos por email a tu team
Graph of Agents: multi-agent pentesting
Strix usa orquestación multi-agent para pentesting comprehensivo:
- Distributed Pentesting: agentes especializados para recon, exploitation y post-exploitation
- Scalable Security Testing: ejecución paralela across múltiples targets para coverage rápido
- Dynamic Coordination: los agentes comparten discoveries, chain vulnerabilities y colaboran como un red team
Toolkit de pentesting agéntico
Los agentes de Strix vienen equipados con el mismo toolkit que usan pentesters profesionales:
- HTTP Interception Proxy: manipulación full de request/response con Caido
- Browser Exploitation: browser automatizado para testing de XSS, CSRF, clickjacking y auth bypass
- Shell & Command Execution: terminal interactivo para exploit development y post-exploitation
- Custom Exploit Runtime: sandbox Python para escribir y validar PoCs
- Reconnaissance & OSINT: attack surface mapping, subdomain enumeration, fingerprinting
- Static & Dynamic Code Analysis: SAST + DAST
- Vulnerability Knowledge Base: findings estructurados con CVSS scoring y OWASP classification
Vulnerabilidades que detecta
Strix identifica, valida y explota un amplio rango de vulnerabilidades across OWASP Top 10 y más:
- Broken Access Control: IDOR, privilege escalation, auth bypass
- Injection Attacks: SQL injection, NoSQL injection, OS command injection, SSTI
- Server-Side: SSRF, XXE, insecure deserialization, RCE
- Client-Side: XSS (stored/reflected/DOM), prototype pollution, CSRF
- Business Logic Flaws: race conditions, payment manipulation, workflow bypass
- Auth & Session: JWT attacks, session fixation, credential stuffing
- Infrastructure & Cloud: misconfigurations, exposed services, cloud security issues
- API Security: broken authentication, mass assignment, rate limiting bypass
Integración con coding agents (Claude Code, Cursor, Codex)
Strix es agent-ready. Dale a Claude Code, Cursor, Codex o cualquier agente compatible con SKILL.md la capacidad de correr pentests, fixear findings y set up CI scanning:
npx skills add usestrix/strix
Esto instala cuatro skills:
- penetration-testing-with-strix: correr headless scans y leer resultados
- managed-pentesting-with-strix: drive la managed platform
app.strix.aivia REST (sin local Docker ni LLM key) - fix-security-vulnerabilities-with-strix: remediar + re-scan para verificar
- ci-security-scanning-with-strix: PR scanning en CI
Los agentes pueden correr Strix de dos formas con el mismo engine: el CLI open-source local, o la managed cloud cuando no hay infra local. Referencias: AGENTS.md para quick reference, docs.strix.ai/llms.txt para CLI docs, y docs.app.strix.ai para la API.
Strix Platform (hosted)
Si no quieres gestionar tu propia infraestructura, Strix ofrece una platforma hosted en app.strix.ai:
- Validated findings con PoCs: cada vulnerabilidad incluye exploit funcional y reproduction steps
- One-click autofix: patches generados por IA como PRs listos para merge
- Continuous pentesting: always-on scanning que sigue el ritmo de tus deploys
- DevSecOps integrations: GitHub, GitLab, Bitbucket, Slack, Jira, Linear, CI/CD
- Continuous learning: IA que aprende de findings pasados, adapta a tu codebase y reduce falsos positivos
Enterprise
- SSO (SAML/OIDC)
- Reportes compliance-ready: SOC 2, ISO 27001, PCI DSS
- Support dedicado & SLA
- Deploy options: VPC / self-hosted
- BYOK (Bring Your Own Key) model support
- Agentes IA tailored para tu environment
Costos reales: lo que necesitas saber
Costos reportados por la comunidad
| Escenario | Costo aprox. | Tiempo |
|---|---|---|
| Quick scan en small feature PR (Claude Sonnet) | ~$0.35 | ~4 min |
| Standard scan en mid-sized codebase | $8–20 | Variable |
| Black-box scan contra un sitio (10 min) | ~$17 | ~10 min |
| Continuous scanning en large monorepo (docenas de PRs/día) | 4 cifras mensual | Continuo |
Tips para controlar costos
- Set un hard spend limit en tu API key antes del primer run
- Empieza con un target pequeño y scoped, no tu monorepo entero
- Considera un modelo más barato para reconnaissance passes
- Usa
--scan-mode quickpara PR reviews - Modelos locales (Ollama, LMStudio) cortan el costo a near-zero pero reducen coverage
- ChatGPT subscription login evita API key metered (usa tu plan Plus/Pro)
Strix vs alternativas
| Aspecto | Strix (OSS) | XBOW (comercial) | Cobalt (PTaaS humano) |
|---|---|---|---|
| Licencia | Apache 2.0 open source | Comercial | Servicio |
| Stars GitHub | 49K+ | — | — |
| Validación | PoC real por finding | PoC real | PoC humano |
| Auto-fix | Sí (PRs ready-to-merge) | Sí | No |
| CI/CD | GitHub Actions (20 líneas YAML) | Sí | Manual |
| Multi-agent | Sí (Graph of Agents) | Sí | Humanos |
| Costo | Free + LLM tokens ($0.35–20/scan) | Subscription | $5K–30K/engagement |
| BYO-LLM | Sí | No | No |
| Self-hosted | Sí (Docker) | No | No |
| Compliance reports | Enterprise tier | Sí | Sí (SOC 2, ISO 27001, PCI) |
Acknowledgements
Strix se construye sobre proyectos open source increíbles:
- LiteLLM — abstraction layer para múltiples LLM providers
- Caido — HTTP interception proxy
- Nuclei — vulnerability templates
- Playwright — browser automation
- Bubble Tea — TUI framework (Go)
FAQ
¿Strix es gratis?
El CLI, sandbox, agent orchestration y toda la cobertura de vulnerabilidades son open source (Apache 2.0). Pagas por los LLM tokens que consume tu provider. La plataforma hosted app.strix.ai es un SaaS separado con pricing usage-based y tier free.
¿Es seguro correrlo en mi app?
Sí. Los exploits corren dentro de un Docker sandbox. Pero solo apúntalo a apps que posees o tienes permiso explícito. Apuntar a sistemas de terceros sin autorización es ilegal.
¿Qué modelo uso?
Para best results: GPT-5.4 (OpenAI), Claude Sonnet 4.6 (Anthropic) o Gemini 3 Pro (Google). Para ahorrar costo: modelos más baratos para recon, frontier models para exploitation. Para zero costo: modelos locales (Ollama, LMStudio) con coverage reducido.
¿Puedo usar mi suscripción de ChatGPT?
Sí. strix auth login chatgpt y luego export STRIX_LLM="chatgpt/gpt-5.4". Corre sobre tu suscripción Plus/Pro sin API key metered.
¿Cuánto cuesta un scan?
Depende del modelo y scope. Un quick scan en un PR pequeño con Claude Sonnet: ~$0.35. Un scan standard en mid-sized codebase: $8–20. Continuous scanning en large monorepo: cuatro cifras mensual. Set siempre un spend limit en tu API key.
¿Funciona con CI/CD?
Sí. GitHub Actions integration son ~20 líneas de YAML. Strix automáticamente scopea quick reviews a changed files en PRs. Exit code non-zero si encuentra vulnerabilidades, ideal para bloquear PRs.
¿Puedo integrarlo con Claude Code?
Sí. npx skills add usestrix/strix instala 4 skills que le dan a Claude Code la capacidad de correr pentests, fixear findings y set up CI scanning.
¿Strix encuentra business logic flaws?
Sí, pero es el área más difícil para black-box. Strix puede detectar race conditions, payment manipulation y workflow bypass, especialmente con --instruction custom para guiar al agente.
Conclusión
Strix representa un cambio fundamental en application security: pasar de scanners que reportan "potenciales issues" a agentes que explotan vulnerabilidades reales y te entregan el PoC. La diferencia entre "este header parece mal" y "este admin panel + credencial débil expone toda la database" es la diferencia entre noise y signal. Con 49K+ stars, Apache 2.0, integración con GitHub Actions en 20 líneas, y un costo de $0.35/scan en PRs pequeños, Strix democratiza el pentesting que antes costaba $50K por engagement. El catch es real: los agentes consumen tokens como un pentester humano consume horas, y apuntarlos a sistemas que no posees es ilegal. Pero para developers y teams que shipan código sin ninguna cobertura de pentesting, Strix es la opción más accesible y completa del ecosistema open source. Si nunca hiciste un pentest de tu app porque era demasiado caro o complejo, instala Strix, apúntalo a tu codebase local, y ten tus primeros findings validados en minutos.