Gemini 3.6 Flash: Benchmarks, Precios, Disponibilidad y Qué Cambió
Google lanzó Gemini 3.6 Flash el 21 de julio de 2026 como el nuevo caballo de batalla de propósito general en su línea Flash. El modelo se enfoca en la codificación, el análisis multimodal, los agentes de uso de computadora y los flujos de trabajo de herramientas de varios pasos, al tiempo que reduce el consumo de tokens de salida y el precio de los tokens de salida en comparación con Gemini 3.5 Flash.
Las cifras clave son sustanciales: Google informa un 49 % en DeepSWE, un 63.9 % en MLE-Bench y un 83.0 % en OSWorld-Verified. El precio estándar de la API es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. Esta guía explica los benchmarks, los niveles de precios, la disponibilidad, los cambios de API, las herramientas compatibles y las razones prácticas para migrar.
Puntos clave
- Lanzamiento: Gemini 3.6 Flash estuvo disponible de forma general el 21 de julio de 2026.
- ID del modelo: El código del modelo de API estable de Gemini es
gemini-3.6-flash. - Precios: El precio estándar es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida.
- Eficiencia: Google informa un 17 % menos de tokens de salida en el Índice de Análisis Artificial y hasta un 65 % menos en DeepSWE que Gemini 3.5 Flash.
- Contexto: El modelo acepta hasta 1,048,576 tokens de entrada y produce hasta 65,536 tokens de salida.
- Disponibilidad: Está disponible a través de la API de Gemini, Google AI Studio, Android Studio, Google Antigravity, Gemini Enterprise y la aplicación Gemini.
Gemini 3.6 Flash de un vistazo
| Categoría | Gemini 3.6 Flash |
|---|---|
| Rol principal | Modelo rápido de razonamiento de propósito general para cargas de trabajo de agentes y multimodales |
| Identificador de API estable | gemini-3.6-flash |
| Nivel de pensamiento por defecto | Medio |
| Modalidades de entrada | Texto, imagen, video, audio y PDF |
| Modalidad de salida | Texto |
| Estado de producción | Disponible de forma general |
¿Qué es Gemini 3.6 Flash?
Gemini 3.6 Flash es un modelo propietario de razonamiento multimodal en la familia Flash de Google, centrada en la velocidad y la eficiencia. Google lo posiciona para cargas de trabajo de agentes en el mundo real: generación de código, llamadas a funciones, uso de computadora, razonamiento espacial, análisis de documentos y flujos de trabajo que pueden requerir varios pasos antes de que una respuesta final esté lista.
El modelo no es simplemente una versión 3.5 renombrada. Google dice que fue ajustado en base a los comentarios de los desarrolladores sobre verbosidad, ediciones de código no deseadas y bucles de ejecución que consumían tokens de razonamiento y llamadas a herramientas adicionales. La mejora prevista es, por lo tanto, doble: mejor calidad de tarea y menos trabajo requerido para alcanzar el resultado.
For developers starting with Google’s platform, Zerlo’s guía para obtener una clave de API de Gemini explica la configuración de la cuenta y de Google AI Studio. El nombre del modelo a seleccionar en una solicitud de API es gemini-3.6-flash.
¿Qué cambió de Gemini 3.5 Flash?
| Área | Cambio en Gemini 3.6 Flash | Efecto práctico |
|---|---|---|
| Codificación | Mayor precisión, menos cambios de archivo involuntarios y menos bucles de depuración | Mejor adaptado para migraciones y desarrollo iterativo de agentes |
| Eficiencia de tokens | Menos tokens de salida, pasos de razonamiento, turnos y llamadas a herramientas | Potencialmente menor costo por tarea completada en lugar de solo por token |
| Razonamiento multimodal | Mejor interpretación de gráficos, conversión de planos y comprensión de diseños con múltiples elementos | Flujos de trabajo documentales, visuales y espaciales más sólidos |
| Uso de computadora | Soporte nativo de herramientas, actualmente marcado como Vista previa en la documentación del modelo | Puede potenciar flujos de trabajo de automatización de navegadores e interfaces compatibles |
| Precios de salida | $7.50 por millón de tokens en lugar de $9.00 para Gemini 3.5 Flash | Una reducción del 16.7 % en la tarifa estándar de tokens de salida |
| Configuración de API | Parámetros de muestreo como temperature, top_p y top_k están obsoletos |
Las integraciones existentes requieren una revisión de configuración, no solo un cambio de ID de modelo |
Hay un matiz para el trabajo de frontend. La documentación de migración de Google dice que Gemini 3.6 Flash tiende a inspeccionar un proyecto programáticamente antes de realizar cambios. Eso puede mejorar la corrección en tareas complejas, pero puede agregar pasos exploratorios a una edición visual simple. Google también señala que los evaluadores humanos a veces prefirieron modelos anteriores para el estilo, por lo que las instrucciones de diseño explícitas siguen siendo valiosas.
Benchmarks de Gemini 3.6 Flash
Los datos de lanzamiento de Google muestran mejoras sobre Gemini 3.5 Flash en codificación, ingeniería de aprendizaje automático, trabajo de conocimiento y tareas de uso de computadora. Estos benchmarks utilizan diferentes métodos de puntuación, por lo que sus valores no deben promediarse en un porcentaje general. Cada resultado es evidencia para un tipo específico de carga de trabajo.
| Benchmark | Qué prueba | Gemini 3.5 Flash | Gemini 3.6 Flash |
|---|---|---|---|
| DeepSWE v1.1 | Agentes de ingeniería de software de largo alcance | 37% | 49% |
| MLE-Bench | Tareas de ingeniería e investigación de aprendizaje automático | 49.7% | 63.9% |
| OSWorld-Verified | Uso de computadora en entornos de escritorio reales | 78.4% | 83.0% |
| GDPval-AA v2 | Calidad de la tarea de trabajo de conocimiento | 1349 | 1421 |

Fuente: blog.google
Las mejoras publicadas más sólidas aparecen en ingeniería de software de largo alcance e ingeniería de aprendizaje automático, mientras que el rendimiento de uso de computadora también aumenta.
Cómo leer estos resultados de benchmarks
- DeepSWE es importante para la codificación autónoma: es más relevante para el trabajo a nivel de repositorio que para una pregunta de codificación independiente y corta.
- MLE-Bench mide un flujo de trabajo especializado: el resultado es útil para agentes de ciencia de datos y aprendizaje automático, pero no es una puntuación general de chatbot.
- OSWorld-Verified prueba acciones: una puntuación más alta respalda la narrativa del uso de computadora, aunque la capacidad de API relacionada todavía está marcada como Vista previa.
- GDPval-AA no es un porcentaje: es una evaluación comparativa de trabajo de conocimiento y debe leerse dentro de la metodología de ese benchmark.
La eficiencia de tokens es parte de la historia del benchmark
Las puntuaciones brutas de tareas no muestran cuántos tokens o llamadas a herramientas se necesitaron para alcanzar el resultado. Google dice que Gemini 3.6 Flash generó un 17 % menos de tokens de salida que Gemini 3.5 Flash en el Índice de Inteligencia de Análisis Artificial. En DeepSWE, la compañía informa una reducción mayor: los tokens de salida promedio por tarea cayeron de aproximadamente 276,000 a 97,000, una disminución de aproximadamente el 65%.
Artificial Analysis lista de forma independiente la configuración de alto pensamiento de Gemini 3.6 Flash con una puntuación de Índice de Inteligencia de 50 y una ventana de contexto de un millón de tokens. Los resultados de los benchmarks pueden cambiar a medida que los evaluadores actualizan los prompts, las herramientas y las versiones del modelo, por lo que las pruebas de producción con tareas representativas siguen siendo más importantes que una posición en la tabla de clasificación.

Fuente: blog.google
El uso reducido de tokens de salida puede reducir el costo de los bucles largos de agentes, especialmente cuando el modelo razona, edita archivos y llama herramientas repetidamente antes de terminar.
Precios de Gemini 3.6 Flash
La tarifa estándar publicada por Google es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. La tarifa de entrada no ha cambiado desde Gemini 3.5 Flash, mientras que la tarifa de salida cae de $9.00 a $7.50. La entrada almacenada en caché aparece a $0.15 por millón de tokens en la página de precios de la Plataforma de Agentes de Google Cloud.
| Opción de consumo | Entrada por 1M tokens | Salida por 1M tokens | Uso típico |
|---|---|---|---|
| Estándar | $1.50 | $7.50 | Tráfico normal interactivo y de API de producción |
| Prioridad | $2.70 | $13.50 | Cargas de trabajo que pagan más por capacidad de inferencia priorizada |
| Flex o Batch | $0.75 | $3.75 | Procesamiento asíncrono o tolerante a retrasos |
Ejemplos de cálculos de precios estándar
| Ejemplo de uso mensual | Costo de entrada | Costo de salida | Total estimado |
|---|---|---|---|
| 10M de tokens de entrada y 1M de salida | $15.00 | $7.50 | $22.50 |
| 50M de tokens de entrada y 5M de salida | $75.00 | $37.50 | $112.50 |
| 100M de tokens de entrada y 20M de salida | $150.00 | $150.00 | $300.00 |
Estos ejemplos cubren solo los tokens del modelo. La búsqueda contextual, el uso de computadora, la ejecución de código, los servicios externos y otros componentes de la plataforma pueden agregar costos o latencia. La métrica interna más útil es, por lo tanto, el costo por tarea completada exitosamente, incluidas las reintentos y las llamadas a herramientas, en lugar de solo la tarifa de token indicada.
Disponibilidad: ¿dónde puedes usar Gemini 3.6 Flash?
Gemini 3.6 Flash estuvo disponible desde el día del lanzamiento en las superficies de consumidor, desarrollador y empresa de Google. Los límites de uso exactos, el acceso regional y los controles de selección de modelos pueden diferir según el producto, la suscripción y la cuenta.
| Grupo de usuarios | Disponible a través de | Detalle importante |
|---|---|---|
| Desarrolladores | API de Gemini, Google AI Studio y Android Studio | Utilice el ID de modelo estable gemini-3.6-flash |
| Desarrolladores de agentes | Google Antigravity y Gemini Managed Agents | Google hizo de 3.6 Flash el modelo predeterminado para el agente administrado de Antigravity |
| Empresas | Plataforma de Agentes Gemini Enterprise y la aplicación Gemini Enterprise | Se aplican la facturación empresarial, la gobernanza y la configuración regional |
| Usuarios generales | Aplicación Gemini | El acceso y los límites de uso pueden depender de la cuenta y el nivel de suscripción |

Fuente: blog.google
Los registros y conjuntos de datos de AI Studio pueden ayudar a los equipos a comparar el comportamiento del modelo, inspeccionar solicitudes fallidas y crear conjuntos de evaluación repetibles antes de cambiar una implementación de producción.
Gemini 3.6 Flash no debe confundirse con Gemini 3.5 Flash-Lite o Gemini 3.5 Flash Cyber. Flash-Lite es la opción de alto rendimiento y menor costo. Flash Cyber es un modelo de seguridad especializado planeado para gobiernos y socios de confianza a través de un piloto de acceso limitado de CodeMender, no un reemplazo disponible de forma general para 3.6 Flash.
Ventana de contexto, entradas y herramientas compatibles
| Especificación | Gemini 3.6 Flash |
|---|---|
| Tipos de entrada | Texto, imagen, video, audio y PDF |
| Tipo de salida | Texto |
| Límite de tokens de entrada | 1,048,576 tokens |
| Límite de tokens de salida | 65,536 tokens |
| Capacidades admitidas | Caché, ejecución de código, búsqueda de archivos, llamadas a funciones, búsqueda contextual, búsqueda en Mapas, salida estructurada, pensamiento y contexto de URL |
| Uso de computadora | Soportado en Vista previa |
| Opciones de consumo | Inferencia estándar, Batch API, inferencia Flex e inferencia de Prioridad |
| No soportado | Generación de imágenes, generación de audio y la API Live |
La ventana de contexto de un millón de tokens es útil para grandes conjuntos de documentos, repositorios de código, transcripciones y registros multimodales. No garantiza un recuerdo perfecto en cada posición de un prompt largo, y enviar el contexto máximo puede aumentar el costo y la latencia. La recuperación, la búsqueda de archivos y la segmentación de prompts aún pueden producir un sistema de producción más confiable.

Fuente: blog.google
La Búsqueda de Archivos es una de las herramientas integradas compatibles con Gemini 3.6 Flash y puede basar las respuestas en documentos de proyectos indexados en lugar de colocar cada archivo directamente en cada prompt.
¿Qué herramientas integradas son más importantes?
- Búsqueda de Archivos: útil para recuperar información de documentos internos, manuales y bases de conocimiento.
- Ejecución de código: permite al modelo calcular, transformar datos y verificar partes de una respuesta programáticamente.
- Llamadas a funciones: conecta el modelo a acciones y fuentes de datos específicas de la aplicación.
- Búsqueda en Google y contexto de Mapas: agrega información actual o sensible a la ubicación donde sea compatible.
- Uso de computadora: permite la automatización de interfaces, pero sigue siendo una capacidad de Vista previa y requiere permisos y validación cuidadosos.
Lista de verificación de migración para Gemini 3.6 Flash
- Cambie el ID del modelo objetivo a
gemini-3.6-flashen un entorno de prueba. - Elimine los campos de muestreo obsoletos como
temperature,top_pytop_k. - Reemplace las configuraciones antiguas de presupuesto de pensamiento con un
thinking_levelapropiado. - Elimine los turns de modelo precargados y revise el manejo del estado multitur.
- Vuelva a probar las llamadas a funciones, las respuestas de herramientas y los esquemas de salida estructurada.
- Compare el éxito de la tarea, la latencia, los tokens de entrada, los tokens de salida, los turnos y las llamadas a herramientas con el modelo de producción actual.
- Utilice una implementación gradual y mantenga una vía de reversión hasta que las cargas de trabajo representativas sean estables.
¿Debería migrar de Gemini 3.5 Flash?
Gemini 3.6 Flash es el objetivo lógico de migración cuando una aplicación depende de agentes de codificación, uso de herramientas de varios pasos, interacción con computadoras, análisis de documentos o razonamiento visual y espacial. El menor precio de salida y la menor tendencia a entrar en bucle son especialmente relevantes para los agentes que pueden llamar al modelo repetidamente antes de completar una solicitud del usuario.
| Carga de trabajo | Mejor dirección actual | Razón |
|---|---|---|
| Agente de codificación a nivel de repositorio | Probar Gemini 3.6 Flash | Precisión de codificación mejorada y menos bucles de ejecución |
| Análisis multimodal de documentos y gráficos | Probar Gemini 3.6 Flash | Resultados multimodales y de trabajo de conocimiento publicados más sólidos |
| Clasificación o extracción de alto volumen | Comparar con Gemini 3.5 Flash-Lite | Flash-Lite está diseñado para un rendimiento de menor costo |
| Generación de imágenes | Elegir otro modelo Gemini | Gemini 3.6 Flash solo produce salida de texto |
| Aplicación de voz en tiempo real | Usar un modelo compatible con la API Live | La API Live no es compatible con Gemini 3.6 Flash |
| Pipeline heredado estable sin problemas de calidad | Evaluar antes de migrar | Un cambio es útil solo cuando la calidad, la latencia o el costo mejoran en la carga de trabajo real |
Para una perspectiva más amplia de selección de modelos, el comparador técnico Gemini vs. Claude de Zerlo explica las diferentes compensaciones entre el ecosistema de Google y los modelos de Anthropic. Los usuarios centrados en asistentes reutilizables en lugar de despliegues de API también pueden encontrar útil la guía Gemini Gems .
Preguntas frecuentes
¿Cuándo se lanzó Gemini 3.6 Flash?
Google anunció y lanzó Gemini 3.6 Flash el 21 de julio de 2026. Estuvo disponible de forma general a través de productos Gemini para desarrolladores, empresas y consumidores.
¿Cuál es el nombre del modelo API de Gemini 3.6 Flash?
El ID de modelo estable es gemini-3.6-flash. La documentación de modelos de Google lo enumera como una versión estable en lugar de un alias solo de vista previa.
¿Cuánto cuesta Gemini 3.6 Flash?
El precio estándar es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. Google Cloud también enumera tarifas Flex o Batch más bajas y tarifas de Prioridad más altas. Las herramientas y otros servicios de la plataforma pueden agregar cargos adicionales.
¿Es Gemini 3.6 Flash más barato que Gemini 3.5 Flash?
Sí, para tokens de salida estándar. El precio de entrada sigue siendo de $1.50 por millón de tokens, mientras que el precio de salida cae de $9.00 a $7.50 por millón de tokens. Google también informa un menor uso de tokens de salida en sus evaluaciones.
¿Gemini 3.6 Flash soporta imágenes, audio y video?
Acepta texto, imágenes, video, audio y documentos PDF como entrada. Su salida es texto. No soporta generación de imágenes, generación de audio ni la API Live.
¿Gemini 3.6 Flash está disponible en la aplicación Gemini?
Sí. Google incluyó la aplicación Gemini entre las superficies de lanzamiento. Los límites específicos de la cuenta, los detalles de implementación regional y los controles de selección de modelos aún pueden variar.
¿Gemini 3.6 Flash soporta el uso de computadora?
Sí, pero Google marca el uso de computadora como una capacidad de Vista previa en la documentación del modelo. Los sistemas de producción deben limitar los permisos, validar las acciones y mantener la confirmación humana para las operaciones importantes.
¿Gemini 3.6 Flash es mejor que Gemini 3.5 Flash?
Las evaluaciones publicadas por Google muestran puntuaciones más altas en codificación, ingeniería de aprendizaje automático, trabajo de conocimiento y uso de computadora, junto con un menor uso de tokens de salida. La ventaja práctica depende de la carga de trabajo, por lo que los equipos deben realizar pruebas representativas antes de cambiar el tráfico de producción.
En resumen
Gemini 3.6 Flash es una mejora significativa centrada en la eficiencia en lugar de un cambio de versión cosmético. Mejora los resultados publicados por Google en codificación de agentes, ingeniería de aprendizaje automático, trabajo de conocimiento y uso de computadora, al tiempo que reduce el precio estándar de los tokens de salida de $9.00 a $7.50 por millón de tokens. Su argumento más sólido no es simplemente que cada token es más barato, sino que muchas tareas de varios pasos pueden requerir menos tokens, turnos y llamadas a herramientas.
Los desarrolladores deberían considerarlo el candidato principal de migración para las cargas de trabajo de Gemini 3.5 Flash que dependen de código, herramientas o razonamiento multimodal. Flash-Lite sigue siendo más adecuado para la ejecución de alto volumen más económica, y Gemini 3.6 Flash no es el modelo adecuado para la generación de imágenes, la salida de audio nativa o el uso de la API Live. Las mejoras en los benchmarks son prometedoras, pero las decisiones de producción aún deben basarse en la precisión específica de la tarea, la latencia, la seguridad y el costo total.