InclusionAI lanza Ling-3.0-flash-Sante: el MoE especializado en medicina que lidera su categoría en tres benchmarks clínicos
InclusionAI, el laboratorio de IA de Ant Group detrás de la serie Ling, anunció el 4 de septiembre de 2026 el lanzamiento de Ling-3.0-flash-Sante, un modelo MoE construido sobre Ling-3.0-flash y mejorado específicamente para salud y medicina. El nombre viene de "santé", salud en francés. Con solo 5,1B de parámetros activos por token, el equipo reporta que lidera su categoría de tamaño en tres benchmarks clínicos, y por un mes está disponible de forma gratuita a través de la API de OpenRouter —es decir, hasta el 4 de octubre—, además de su disponibilidad en Vercel.
Para qué se diseñó
Sante apunta a tareas reales de salud en cuatro frentes: razonamiento médico, tareas profesionales del ámbito sanitario, investigación profunda (deep research) y recuperación basada en evidencia. Ese último punto es el más distintivo: en medicina, la diferencia entre un modelo útil y uno peligroso rara vez está en la fluidez del texto y casi siempre en su capacidad de encontrar y anclar la respuesta en la evidencia correcta, y Sante trata la recuperación de evidencia como capacidad de primera clase.
El modelo es parte de la estrategia de variantes de dominio de la familia Ling 3.0, que este mismo mes sumó Ling-3.0-flash-Fin para finanzas —con pesos abiertos en Hugging Face de unos 127B de parámetros— y Ling-3.0-tiny de 7,9B. Para Sante, el anuncio no menciona publicación de pesos: por ahora se accede vía API.
Benchmarks: primero en su clase, con foco en seguridad
| Evaluación | Resultado | Qué mide |
|---|---|---|
| MedXpertQA-Text | 53,88 | Razonamiento clínico de nivel experto; número 1 entre modelos flash-size |
| DiagnosisArena-MCQ | 83,83 | Diagnóstico diferencial; número 1 entre modelos flash-size |
| AFUMED-Drug | 89,59 | Conocimiento farmacológico; número 1 entre modelos flash-size |
| MedEthicAlign | 82,06 | Alineación con principios éticos médicos |
| AFUSAFE-MedSCE | 78,63 | Seguridad en escenarios clínicos |
El anuncio reporta además que el modelo es competitivo en HealthBench Professional y BrowseComp —sin números publicados para esos dos— y lo describe como líder entre modelos open-source y competitivo frente a los flagships. Como siempre con benchmarks de proveedor, conviene esperar validación independiente antes de tomar decisiones de implementación sobre ellos.
Por qué importa el tamaño
Que un modelo con 5,1B de parámetros activos lidere pruebas clínicas de su categoría no es un dato menor: la inferencia en modelos MoE se cobra —y se consume— según los parámetros activos, y un modelo médico barato de correr cambia quién puede usarlo. Clínicas, hospitales públicos y proyectos de salud digital en América Latina operan con presupuestos donde un flagship a US$10 por millón de tokens de entrada no es opción; un flash-size sí. La combinación de costo bajo y especialización médica es exactamente el perfil que la salud de la región necesita para tareas de soporte: resumen de historias clínicas, apoyo documental, triaje administrativo y búsqueda de evidencia.
La apuesta por los modelos de dominio
Sante no es un experimento aislado. El catálogo reciente de InclusionAI muestra una estrategia consistente de especialización: Ling-3.0-flash-Fin para finanzas se publicó el 3 de septiembre con pesos abiertos de unos 127B de parámetros, acompañado del dataset FinFIRST para entrenar y evaluar modelos financieros; Ling-3.0-tiny de 7,9B llegó un día después como opción ligera de propósito general; y el laboratorio mantiene además la serie LLaDA de modelos de lenguaje de difusión. La idea de fondo es que un modelo pequeño y afinado en un dominio entrega más valor por dólar que un modelo general gigante, sobre todo en verticales con lenguaje propio —y pocos tienen un lenguaje más propio que la medicina, con su terminología, guías clínicas y farmacopea.
El patrón es transversal a la industria, con distinto signo: los grandes laboratorios lanzan variantes restringidas para ciberseguridad reservadas a verificados —CVP de Anthropic, Fairwind de Google, Daybreak de OpenAI—, mientras los equipos abiertos avanzan con variantes de dominio accesibles a precio de trabajo. La especialización dejó de ser un nicho y se convirtió en el eje de la competencia actual.
Cómo probarlo gratis
Durante un mes desde su lanzamiento, Sante está disponible sin costo vía OpenRouter con el identificador inclusionai/ling-3.0-flash-sante:free. El endpoint soporta streaming, uso de herramientas y reasoning, según la documentación de OpenRouter, lo que permite probarlo en flujos agénticos reales y no solo en chats de prueba. También está disponible en Vercel a través de su AI Gateway. El anuncio está dirigido a profesionales de la salud, investigadores y desarrolladores, y tras la ventana gratuita OpenRouter publicará el precio vigente en su ficha.
Las cautelas de siempre, con más razón en salud
Que un modelo lidere benchmarks clínicos no lo convierte en un producto de salud regulado. Las propias métricas de seguridad del anuncio —MedEthicAlign y AFUSAFE-MedSCE— reconocen que la alineación ética y la seguridad en escenarios clínicos son parte del problema, no un trámite. Para cualquier uso que toque pacientes —apoyo diagnóstico, decisiones clínicas, manejo de datos sensibles— aplican los marcos regulatorios locales y la validación con datos propios antes, no después. Donde sí encaja de inmediato es en el trabajo de soporte: investigación, documentación y recuperación de evidencia con supervisión profesional.
Preguntas frecuentes
¿Qué significa Sante?
Viene de "santé", la palabra francesa para salud. El nombre completo del modelo es Ling-3.0-flash-Sante y forma parte de la familia Ling 3.0 de InclusionAI, el laboratorio de IA de Ant Group.
¿Hasta cuándo es gratis?
La ventana gratuita dura un mes desde el anuncio del 4 de septiembre de 2026, es decir, hasta el 4 de octubre, a través de la API de OpenRouter con el identificador inclusionai/ling-3.0-flash-sante:free.
¿Se pueden descargar los pesos?
El anuncio no menciona publicación de pesos para Sante; por ahora se accede vía OpenRouter y Vercel. Otras variantes de la misma familia, como Ling-3.0-flash-Fin y Ling-3.0-tiny, sí están disponibles como pesos abiertos en Hugging Face.
¿Sirve para diagnosticar pacientes?
No. Los benchmarks clínicos miden capacidad en pruebas de laboratorio, no seguridad para uso asistencial. Cualquier aplicación que toque decisiones clínicas o datos de pacientes requiere validación local y cumplimiento regulatorio específico de salud.
Fuentes verificadas
Ant Ling (@AntLingAGI) — Anuncio oficial de Ling-3.0-flash-Sante
x.com · 2026-09-04
OpenRouter — inclusionai/ling-3.0-flash-sante:free (API reference)
openrouter.ai
Hugging Face — inclusionAI (catálogo de la organización)
huggingface.co