Cargando...
Cargando...

Familia de modelos de Google. Gemini 3.8 Flash (sep 2026) es su modelo Flash más inteligente: 1M de contexto, HLE-Verified 54,9% y precio introductorio de US$0,75/US$3,75 por millón; su variante Flash Cyber atiende defensores verificados vía programa Fairwind. Gemini 3.5 Transcribe para speech-to-text en 85+ idiomas y Gemini Robotics ER 2 para razonamiento corporal de robots. Nano Banana 2 (Gemini 3.1 Flash Image) para generación y edición de imágenes. Multimodal nativo (texto, imagen, video, audio, PDF). Integrado con Google Workspace, Android y Chrome.
Visitar sitio oficialDescripción
Familia de modelos de Google. Gemini 3.8 Flash (sep 2026) es su modelo Flash más inteligente: 1M de contexto, HLE-Verified 54,9% y precio introductorio de US$0,75/US$3,75 por millón; su variante Flash Cyber atiende defensores verificados vía programa Fairwind. Gemini 3.5 Transcribe para speech-to-text en 85+ idiomas y Gemini Robotics ER 2 para razonamiento corporal de robots. Nano Banana 2 (Gemini 3.1 Flash Image) para generación y edición de imágenes. Multimodal nativo (texto, imagen, video, audio, PDF). Integrado con Google Workspace, Android y Chrome.
Información
Fortalezas
Casos de uso
Modelos disponibles(34 modelos)
Variante de ciberseguridad de Gemini 3.8 Flash (Sep 2026), enfocada en defensa: prioriza el parche de vulnerabilidades por sobre la explotación. Solo para defensores verificados (gobiernos, infraestructura crítica y mantenedores) vía programa Fairwind. CWE-Bench: 47,2% pass@1 y 2,6 veces más parches correctos según Chrome Security.
El modelo Flash más inteligente de Google (Sep 2026) y su workhorse para ingeniería de software de largo horizonte y tareas agénticas. HLE-Verified: 54,9%. 1M de tokens de entrada y 64K de salida, entrada multimodal y computer use. Precio introductorio de US$0,75/US$3,75 por millón hasta el 31/12/2026. ID: gemini-3.8-flash.
Modelo Flash más reciente de Google (ago 2026). Disponible para Google AI Pro y Ultra subscribers. Inteligencia frontier optimizada para velocidad y costo. Mejora en razonamiento, code generation y ejecución agéntica. Contexto de 1M tokens.
Modelo Flash actual de Google (Jul 2026). Inteligencia frontier optimizada para tareas del mundo real a mayor velocidad y menor costo. Destaca en code generation, ejecución agéntica y razonamiento espacial. Contexto de 1M tokens.
El modelo más rápido y económico de la serie 3.5 (Jul 2026). 350 output tokens/s. Diseñado para tareas de baja latencia y alto throughput como búsqueda agéntica y procesamiento de documentos. $0.3/MTok input, $2.5/MTok output.
Modelo Flash estable de la generación 3.5 (May 2026). Balance de eficiencia y calidad para flujos agénticos a escala.
Modelo multimodal Flash (May 2026). Procesa texto, imagen, video, audio y PDF de forma unificada con salida de texto.
Modelo Flash-Lite de la generación 3.1 (May 2026). Optimizado para costo y velocidad en tareas de alto volumen.
Versión equilibrada de la generación 2.5 diseñada para rapidez extrema. Posee capacidades mejoradas de "adaptive thinking". Ideal para escalar de forma rentable.
El modelo más rápido y accesible de la generación 2.5. Sustituye al 2.0 Flash-Lite incrementando a 1.5x su velocidad, sosteniendo su gran ventana y costo ultra bajo.
Modelo de IA de nueva generación que ofrece razonamiento avanzado y comprensión multimodal.
Ofrece el nivel de razonamiento de nivel "Pro" a velocidades propias de la línea Flash. Muy veloz, costo ultra-reducido con el enorme beneficio de la base estructural 3.0 de Google.
Modelo experimental con mejoras en velocidad y rendimiento en puntos de referencia académicos clave.
Pionero como modelo multimodal "peso pluma" enfocado de lleno en altas tasas de lectura masiva de archivos proviendo inferencia constante con latencia y costos recortados.
Versión optimizada para conversaciones con mejoras en rendimiento y razonamiento avanzado.
Modelo de IA más capaz de Google, optimizado para tareas complejas como programación y razonamiento lógico.
El modelo mayor escala de la primera generación de Google, diseñado para romper el listón humano de las métricas MMLU y tareas brutales no comerciales de alta demanda de hardware.
Modelo speech-to-text más preciso de Google (ago 2026). 85+ idiomas, WER de 2.6% (no streaming) y 4% (streaming). Distingue hasta 3 hablantes con timestamps. Filtra palabras de relleno y autocorrecciones. Formato contextual (números, fechas, moneda). Integrado en Gboard, Chrome, Gemini app y AI Studio.
Modelo de razonamiento corporal (embodied reasoning) de Google DeepMind (Jul 2026). Actúa como cerebro de alto nivel para robots: comprensión continua de video (moment-finding 91,3%), orquestación nativa de herramientas y modelos VLA, colaboración multi-robot y paradas de seguridad ante personas. Disponible vía Gemini API y AI Studio.
Variante de la generación 3.0 especializada en niveles de "Thinking" u opciones de "Pensamiento Profundo" computacional, ideal para investigación y ciencias.
Modelo especializado en uso de computadora (Oct 2025). Permite a Gemini controlar interfaces de usuario, hacer clic y navegar aplicaciones de forma autónoma.
Modelo de razonamiento profundo de Gemini 2.5 (Ago 2025). Diseñado para problemas complejos que requieren análisis multi-paso extendido.
Modelo de audio de la generación 3.5 (Jun 2026). Especializado en Live Translate y tareas de audio en tiempo real.
Modelo de audio basado en Gemini 3.1 Flash (Abr 2026). Soporta Flash Live y TTS para aplicaciones de voz en tiempo real.
Modelo de generación de imágenes desde texto basado en Gemini 3.1 Flash (May 2026). Conocido como 'Nano Banana 2'. Optimizado para edición y creación de imágenes.
Modelo Pro de generación de imágenes (May 2026). Conocido como 'Nano Banana Pro'. Máxima calidad de imagen con control fino de composición.
Actualización incremental avanzada (Feb 2026). Amplía dramáticamente el puntaje de razonamiento lógico en pruebas ARC-AGI, mejorando tareas de agentes, generación de SVGs renderizados y desarrollo de software.
El modelo insignia de Google que funciona como un "thinking model" con razonamiento adaptativo profundo, soporte para Live API multimodal y procesa hasta 2 millones de tokens.
Modelo optimizado "microscópicamente" (de 1.8B a 3.25B) diseñado para operar 100% offline y de manera ultra-privada directo "On-Device", como en smartphones Pixel u ordenadores.
Revolucionaria tercera generación lanzada a fines de 2025. Procesa código, imágenes, video, audio, PDFs, Rayos X y más, todo en un solo modelo fuertemente nativo y mejorado.
Modelo inteligente que proporciona razonamiento de vanguardia y programación intuitiva.
Modelo de IA con funciones de razonamiento integradas y rendimiento excepcional en tareas complejas.
Modelo orientado 100% a la calidad sobre la velocidad. Maneja programación intrincada, razonamiento duro, y lectura total de ecosistemas con su ventana de 2M.
Primer modelo mid-size revolucionario que introdujo la capacidad pionera masiva (MoE) en contexto con procesamiento nativo de vídeo (1hr) y audio (11hr) simultáneos y sin pérdidas.