Kimi Work: el agente IA local de Moonshot AI para knowledge workers (guía completa)
¿Qué es Kimi Work?
Kimi Work es el agente IA local de Moonshot AI diseñado para knowledge workers: analistas, operadores, marketers y project managers cuyo día es una pila de tareas repetitivas multi-herramienta. A diferencia de los agentes cloud que corren en un sandbox aislado, Kimi Work vive en tu máquina, trabaja con tus archivos reales y controla el navegador que ya tienes autenticado.
Lanzado para testing interno en junio de 2026 y disponible para descarga gratuita en macOS (Apple Silicon) y Windows, Kimi Work representa la apuesta opuesta a la tendencia dominante: en lugar de enviar tus datos a un sandbox en la nube, el agente trabaja donde tu trabajo ya vive. La inferencia del modelo puede routearse vía la API de Moonshot o, gracias a los open weights de K2.6, correr en hardware que controles tú.
El motor: Kimi K2.6
Kimi Work está impulsado por Kimi K2.6, el modelo agéntico multimodal nativo que Moonshot AI lanzó el 20 de abril de 2026 bajo licencia Modified MIT. K2.6 fue diseñado para tres trabajos que se mapean directamente con lo que un agente local necesita:
- Ejecución autónoma de largo horizonte
- Diseño dirigido por código
- Orquestación a gran escala de agent swarms
| Especificación | Kimi K2.6 |
|---|---|
| Arquitectura | ~1T parámetros Mixture-of-Experts, ~32B activos por token |
| Expertos | 384 expertos, 8 seleccionados por token, 61 capas |
| Ventana de contexto | 256K tokens (262.144) |
| Modalidades | Texto, imagen y video nativos |
| Agent Swarm | Hasta 300 sub-agentes, 4.000 pasos coordinados |
| Licencia | Modified MIT (open weights) |
La ventana de 256K permite a Kimi Work mantener un proyecto completo, un documento largo, una carpeta de notas o un plan multi-step en memoria de trabajo sin perder el hilo. Y los open weights importan para la historia local: K2.6 puede correr en frameworks de inferencia como vLLM, SGLang y KTransformers, abriendo la puerta a ejecutar el motor on-premises para equipos que necesitan control total.
Benchmarks de K2.6
| Benchmark | Kimi K2.6 | GPT-5.4 | Claude Opus 4.6 |
|---|---|---|---|
| SWE-Bench Pro | 58.6% | 57.7% | 53.4% |
| Humanity's Last Exam (tools) | 54.0% | ~48% | ~46% |
| Terminal-Bench 2.0 | 66.7% | ~63% | ~60% |
Características principales
Agent Swarm: 300 sub-agentes en paralelo
La característica que separa a Kimi Work de un asistente single-threaded es Agent Swarm. En lugar de un agente procesando una tarea larga paso a paso, el sistema descompone un objetivo y lanza un grupo de sub-agentes especializados que trabajan en paralelo y luego fusionan resultados.
Con K2.6, Moonshot escaló esto a hasta 300 sub-agentes coordinando hasta 4.000 pasos, frente a los 100 sub-agentes y 1.500 pasos de la generación anterior.
El modelo mental que usa Moonshot es delegación, no comando. Un agente líder actúa como manager que recluta investigadores, analistas y revisores para el trabajo específico, les asigna subtasks scoped y ensambla el output. Para un knowledge worker, esto se mapea a tareas como "investiga estos 40 competidores y construye una tabla comparativa" o "reconcilia estos tres exports y marca los desajustes".
Resultado real: en un caso documentado, un swarm de K2.6 optimizó autónomamente durante 13 horas un motor financiero de 8 años, logrando una mejora de throughput del 185%. En otro caso, un port de modelo en lenguaje Zig tomó 12 horas y resultó ~20% más rápido que LM Studio.
Aviso: 300 sub-agentes es un techo, no un default. Fan-out tan amplío consume proporcionalmente más tokens y tiempo, y agentes paralelos pueden duplicar trabajo o discrepar. Trata el swarm size como un dial que ajustas a la tarea, no como un setting que maximizas.
WebBridge: controlando tu navegador real
WebBridge es la pieza que hace "local" concreto. Combina un pequeño servicio local con una extensión de navegador. El agente envía comandos al servicio local, que usa el Chrome DevTools Protocol para navegar, hacer click, capturar screenshots y leer páginas dentro de tu Chrome o Edge existente, luego envía los resultados al agente.
Como conduce el navegador que ya usas, funciona dentro de sesiones autenticadas con tus cookies y cuentas existentes. Esto es fundamentalmente diferente de un agente cloud que lanza un navegador anónimo en un sandbox: un sandboxed browser hitting a login wall en cada herramienta interna. WebBridge pasa directo porque es tu sesión.
El agente puede:
- Pullar un reporte de un SaaS dashboard donde estás autenticado
- Comparar precios entre sitios donde tienes cuentas
- Mover datos entre dos web apps sin exportar y re-importar manualmente
- Leer contenido detrás de autenticación que un agente cloud no puede alcanzar
Motor Cron integrado
Kimi Work incluye un motor Cron para programar tareas con triggers diarios, horarios o condicionales. Un toggle "Keep Computer Awake" mantiene el equipo activo para jobs nocturnos. Esto permite automatizar flujos como "cada mañana a las 7 AM, revisa estos 5 dashboards y compila un reporte".
Capa de archivos local
El agente puede leer carpetas que montas y ejecutar Python en background. Esto permite manipular PDFs, organizar tu escritorio, compilar reportes en HTML y enviarlos por email, todo desde tu máquina local sin que los archivos salgan de tu entorno.
Datos de mercado nativos
Kimi Work trae pre-integrados datos de mercado para acciones A-shares (China), bolsa de Hong Kong y acciones de EE.UU. sin necesidad de configurar APIs. La investigación terminada se convierte directamente a PowerPoint o Excel.
Toolkit de productividad
- Deep Research: investigación web autónoma y síntesis
- Sheets & Slides: generación de datos y presentaciones con IA
- Document-to-Skills: convierte PDFs en skills reutilizables personalizados
- Claw Groups: intervención human-in-the-loop mid-swarm
- Kimi Code: CLI y integración IDE para coding agéntico
Cómo funcionan las piezas juntas
El diseño es claro: le das un objetivo al orquestador local. El orquestador usa K2.6 para razonar y Agent Swarm para paralelizar el trabajo, luego ambos actúan a través de la capa de acción local: WebBridge para el navegador y acceso directo para archivos y aplicaciones. El resultado vuelve a ti, idealmente después de que apruebes cualquier step sensible.
El orquestador y la capa de acción corren en tu máquina. La inferencia de K2.6 puede routearse vía la API de Moonshot o, gracias a los open weights, en hardware que controles tú. Ese split —acciones locales más hosting de modelo flexible— es la idea arquitectónica central de Kimi Work.
Workflows reales para knowledge workers
Investigación competitiva
Apunta un swarm a una lista de competidores, deja que los sub-agentes recopilen pricing, features y posicionamiento en paralelo, y obtén una tabla comparativa limpia sourced desde páginas en vivo.
Ensamblaje de reportes
Pulla números de un dashboard donde estás logueado, combínalos con spreadsheets locales y redacta el reporte semanal sin exportar nada a un servidor de terceros.
Reconciliación de datos
Compara exports de dos sistemas, marca desajustes y produce un archivo corregido. La ventana de 256K mantiene todo el dataset en vista en lugar de paginarlo dentro y fuera.
Data entry cross-app
Mueve records entre dos web tools donde tienes cuentas, usando WebBridge para actuar dentro de las sesiones reales en lugar de cablear una integración frágil.
Planes y precios
Kimi Work es una descarga gratuita, pero las características significativas de agente requieren un plan de pago. El acceso a features agénticas se gating a través de las membresías de Kimi:
| Plan | Precio/mes | Agent Swarm | Características |
|---|---|---|---|
| Adagio (Free) | $0 | 1 tarea concurrente, ~6 credits | Chat básico, sin Kimi Work |
| Moderato | $19 | 2 concurrentes, 25 runs beta | K2.6, Deep Research, Kimi Code 1x |
| Allegretto | $39 | 4 subtask, 50 runs | Agent Swarm, Kimi Claw, Kimi Code 5x |
| Allegro | $99 | 4 concurrentes, 120 runs | 360 credits, Kimi Code 15x |
| Vivace | $199 | 8 subtask, 240 runs | 720 credits, 300-agent swarm completo |
El Agent Swarm con sub-agentes limitados se desbloquea en Allegretto ($39/mes), mientras que el swarm completo de 300 agentes y los workflows profesionales de mayor volumen requieren Allegro ($99/mes) o Vivace ($199/mes).
API Pricing de K2.6
| Modelo | Input/M tokens | Output/M tokens |
|---|---|---|
| Kimi K2.6 | $0.60-$0.95 | $2.50-$4.00 |
| Claude Opus 4.8 | $5.00 | $25.00 |
| GPT-5.5 | $2.50 | $15.00 |
K2.6 es 8-10x más barato que Claude Opus 4.8 y ~2x más barato que GPT-5.5, lo que hace viables sesiones de agente de 13 horas sin arruinarse.
Seguridad y gobernanza para agentes locales
Un agente local que puede leer tus archivos y actuar dentro de tus sesiones autenticadas es, en términos de seguridad, una cuenta de automatización privilegiada que resulta ser controlada por un modelo de lenguaje. Antes de apuntar Kimi Work a datos de tu empresa, considera:
- Puertas de aprobación de acciones: requiere confirmación explícita antes de que el agente escriba, envíe, pague o elimine. Las acciones de lectura pueden correr libremente; las que cambian estado deben pausar para un humano.
- Permisos scoped: limita qué carpetas puede tocar el agente y qué perfiles de navegador o sitios puede controlar. Un agente que puede leer una carpeta de proyecto es mucho más seguro que uno con acceso a todo el disco.
- Defensa contra prompt injection: una página web o documento que el agente lee puede contener instrucciones ocultas que intenten secuestrarlo. Es el riesgo signature para cualquier agente que navega.
- Audit logging: guarda un registro de qué hizo el agente, qué sitios visitó, qué archivos cambió, para poder revisar y rollback. Ejecución local no debe significar ejecución invisible.
- Data boundaries: confirma qué deja el dispositivo. Incluso con acciones locales, el modelo puede recibir contenido de páginas y archivos como contexto. Sep qué se envía a la API y qué se queda en casa.
Regla de oro: da al agente local el acceso más estrecho que aún le permita terminar el trabajo, loguea todo lo que hace, y gatea cada acción irreversible detrás de una aprobación humana. Empieza con workflows read-only de bajo riesgo y amplía scope solo después de confiar en el comportamiento.
Kimi Work vs Kimi Claw vs agentes cloud
Kimi Work no existe en el vacío. Se sitúa junto a Kimi Claw (el producto cloud de Moonshot), Manus y frameworks self-hosted como OpenClaw:
| Aspecto | Kimi Work (local) | Kimi Claw (cloud) |
|---|---|---|
| Dónde corre | Tu máquina | Cloud de Moonshot |
| Uptime | Solo cuando tu PC está encendido | 24/7 siempre |
| Acceso a archivos locales | Sí, directo | No |
| Sesiones autenticadas | Sí, vía WebBridge | No, navegador anónimo |
| Agent Swarm | Hasta 300 | Limitado por plan |
| Precio mínimo | $19/mes (Moderato) | $39/mes (Allegretto) |
La conclusión honesta: agentes locales y cloud no compiten realmente por el mismo job. Un agente cloud brilla cuando quieres algo corriendo en schedule sin importar si tu laptop está abierta. Un agente local brilla cuando el trabajo toca archivos y herramientas que no deberían salir de tu entorno. Muchos equipos terminarán usando ambos: cloud para jobs background desatendidos, local para el trabajo sensible e interactivo.
Disponibilidad
Descargas para macOS (Apple Silicon) y Windows están disponibles en kimi.com. El producto está en fase de testing interno, lo que significa que algunas características pueden cambiar antes del rollout general. La versión 3.1.0 o posterior es necesaria para usar Kimi K3.
FAQ
¿Kimi Work es gratis?
La descarga es gratuita, pero las características significativas de agente requieren un plan de pago desde $19/mes (Moderato). El Agent Swarm completo de 300 sub-agentes requiere $99/mes (Allegro) o superior.
¿Kimi Work funciona sin internet?
Las acciones (lectura de archivos, control del navegador) ocurren localmente, pero la inferencia del modelo se routa vía la API de Moonshot. Sin embargo, gracias a los open weights de K2.6, es posible self-hostear el modelo en hardware propio para funcionamiento completamente offline.
¿Es seguro dejar que el agente controle mi navegador?
WebBridge usa Chrome DevTools Protocol y tus sesiones permanecen en tu máquina. Pero un agente con acceso a sesiones autenticadas puede hacer cualquier cosa que tú puedas hacer en esas sesiones. Usa puertas de aprobación, permisos scoped y nunca lo dejes correr desatendido en herramientas sensibles.
¿Kimi Work usa Kimi K3?
Kimi Work corre sobre Kimi K2.6. Sin embargo, desde el lanzamiento de K3 el 16 de julio de 2026, la versión 3.1.0+ de Kimi Work soporta K3. Verifica la configuración del modelo dentro de la app.
¿Qué pasa si cierro mi laptop?
Las tareas se detienen. Kimi Work es un agente local; necesita tu máquina activa. Si necesitas ejecución 24/7, considera Kimi Claw (cloud) o usa el toggle "Keep Computer Awake" para jobs nocturnos.
Conclusión
Kimi Work es una de las apuestas más interesantes en el espacio de agentes IA de 2026. Su diseño local-first, combinado con 300 sub-agentes en paralelo y WebBridge para controlar sesiones autenticadas, lo diferencia de todo lo que existe en el mercado cloud. Para knowledge workers cuyo trabajo toca archivos sensibles, dashboards detrás de login y múltiples herramientas web, Kimi Work ofrece algo que ningún agente cloud puede: acceso real a tus datos y sesiones sin comprometerlos a un sandbox de terceros. El tradeoff es claro: cuando cierras el laptop, todo se detiene. Pero para el trabajo interactivo del día a día, esa es exactamente la barrera de seguridad que muchos equipos necesitan.