Cargando...
Cargando...

Zhipu AI
Familia de modelos de Z.ai (antes Zhipu AI). GLM-5.3-Flash (ago 2026, antes "Ox Alpha"): MoE multimodal nativo 320B con 18B activos, 1M contexto, MIT license. GLM-5.1 y GLM-5.1 Fast para agentic engineering. Orientados a chat, agentes, coding y flujos multimodales. 10x más barato que GLM-5.2. Pesos open-source en Hugging Face.
Visitar sitio oficialDescripción
Familia de modelos de Z.ai (antes Zhipu AI). GLM-5.3-Flash (ago 2026, antes "Ox Alpha"): MoE multimodal nativo 320B con 18B activos, 1M contexto, MIT license. GLM-5.1 y GLM-5.1 Fast para agentic engineering. Orientados a chat, agentes, coding y flujos multimodales. 10x más barato que GLM-5.2. Pesos open-source en Hugging Face.
Información
Fortalezas
Casos de uso
Modelos disponibles(8 modelos)
Primer modelo multimodal nativo de la serie GLM-5 (ago 2026). Antes conocido como "Ox Alpha" en OpenRouter. MoE de 320B parámetros totales con 18B activos por token. Contexto de 1M tokens. Input de imágenes y video. 10x más barato que GLM-5.2. Supera a Claude Opus 4.8 en GDPval-AA v2. Pesos open-source bajo MIT en Hugging Face. Corrió en chips chinos de producción nacional.
Versión rápida y económica de GLM-4, ideal para aplicaciones de alta concurrencia.
Versión rápida y económica de GLM-5.1 para agentic engineering de alta concurrencia. 200K contexto. Tool calling y reasoning. Optimizado para latencia baja.
Modelo de la serie GLM-5 orientado a agentic engineering. 200K contexto. Tool calling y reasoning nativo. Mejora significativa en instrucción de herramientas y agentes vs GLM-4.6.
Modelo insignia de Zhipu AI con capacidades avanzadas de razonamiento, coding y multimodalidad. Mejora significativa en instrucción de herramientas y agentes.
Versión ligera y eficiente de GLM-4.5, diseñada para aplicaciones con menor demanda de recursos.
Modelo de lenguaje de gran escala con capacidades multimodales, optimizado para tareas de coding y razonamiento complejo.
Modelo de generación anterior con capacidades de razonamiento y coding, contexto de 128K tokens.