Gemini 3.6 Flash: Benchmarks, Precios, Disponibilidad y Qué Cambió

Avatar
Lisa Ernst · 23.07.2026 · Inteligencia Artificial · 14 min de lectura

Google lanzó Gemini 3.6 Flash el 21 de julio de 2026 como el nuevo caballo de batalla de propósito general en su línea Flash. El modelo se enfoca en la codificación, el análisis multimodal, los agentes de uso de computadora y los flujos de trabajo de herramientas de varios pasos, al tiempo que reduce el consumo de tokens de salida y el precio de los tokens de salida en comparación con Gemini 3.5 Flash.

Las cifras clave son sustanciales: Google informa un 49 % en DeepSWE, un 63.9 % en MLE-Bench y un 83.0 % en OSWorld-Verified. El precio estándar de la API es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. Esta guía explica los benchmarks, los niveles de precios, la disponibilidad, los cambios de API, las herramientas compatibles y las razones prácticas para migrar.

Puntos clave

Gemini 3.6 Flash de un vistazo

Categoría Gemini 3.6 Flash
Rol principal Modelo rápido de razonamiento de propósito general para cargas de trabajo de agentes y multimodales
Identificador de API estable gemini-3.6-flash
Nivel de pensamiento por defecto Medio
Modalidades de entrada Texto, imagen, video, audio y PDF
Modalidad de salida Texto
Estado de producción Disponible de forma general

¿Qué es Gemini 3.6 Flash?

Gemini 3.6 Flash es un modelo propietario de razonamiento multimodal en la familia Flash de Google, centrada en la velocidad y la eficiencia. Google lo posiciona para cargas de trabajo de agentes en el mundo real: generación de código, llamadas a funciones, uso de computadora, razonamiento espacial, análisis de documentos y flujos de trabajo que pueden requerir varios pasos antes de que una respuesta final esté lista.

El modelo no es simplemente una versión 3.5 renombrada. Google dice que fue ajustado en base a los comentarios de los desarrolladores sobre verbosidad, ediciones de código no deseadas y bucles de ejecución que consumían tokens de razonamiento y llamadas a herramientas adicionales. La mejora prevista es, por lo tanto, doble: mejor calidad de tarea y menos trabajo requerido para alcanzar el resultado.

For developers starting with Google’s platform, Zerlo’s guía para obtener una clave de API de Gemini explica la configuración de la cuenta y de Google AI Studio. El nombre del modelo a seleccionar en una solicitud de API es gemini-3.6-flash.

¿Qué cambió de Gemini 3.5 Flash?

Área Cambio en Gemini 3.6 Flash Efecto práctico
Codificación Mayor precisión, menos cambios de archivo involuntarios y menos bucles de depuración Mejor adaptado para migraciones y desarrollo iterativo de agentes
Eficiencia de tokens Menos tokens de salida, pasos de razonamiento, turnos y llamadas a herramientas Potencialmente menor costo por tarea completada en lugar de solo por token
Razonamiento multimodal Mejor interpretación de gráficos, conversión de planos y comprensión de diseños con múltiples elementos Flujos de trabajo documentales, visuales y espaciales más sólidos
Uso de computadora Soporte nativo de herramientas, actualmente marcado como Vista previa en la documentación del modelo Puede potenciar flujos de trabajo de automatización de navegadores e interfaces compatibles
Precios de salida $7.50 por millón de tokens en lugar de $9.00 para Gemini 3.5 Flash Una reducción del 16.7 % en la tarifa estándar de tokens de salida
Configuración de API Parámetros de muestreo como temperature, top_p y top_k están obsoletos Las integraciones existentes requieren una revisión de configuración, no solo un cambio de ID de modelo

Hay un matiz para el trabajo de frontend. La documentación de migración de Google dice que Gemini 3.6 Flash tiende a inspeccionar un proyecto programáticamente antes de realizar cambios. Eso puede mejorar la corrección en tareas complejas, pero puede agregar pasos exploratorios a una edición visual simple. Google también señala que los evaluadores humanos a veces prefirieron modelos anteriores para el estilo, por lo que las instrucciones de diseño explícitas siguen siendo valiosas.

Benchmarks de Gemini 3.6 Flash

Los datos de lanzamiento de Google muestran mejoras sobre Gemini 3.5 Flash en codificación, ingeniería de aprendizaje automático, trabajo de conocimiento y tareas de uso de computadora. Estos benchmarks utilizan diferentes métodos de puntuación, por lo que sus valores no deben promediarse en un porcentaje general. Cada resultado es evidencia para un tipo específico de carga de trabajo.

Benchmark Qué prueba Gemini 3.5 Flash Gemini 3.6 Flash
DeepSWE v1.1 Agentes de ingeniería de software de largo alcance 37% 49%
MLE-Bench Tareas de ingeniería e investigación de aprendizaje automático 49.7% 63.9%
OSWorld-Verified Uso de computadora en entornos de escritorio reales 78.4% 83.0%
GDPval-AA v2 Calidad de la tarea de trabajo de conocimiento 1349 1421
Gráfico oficial de Google que compara Gemini 3.6 Flash con modelos Gemini anteriores en benchmarks de agentes

Fuente: blog.google

Las mejoras publicadas más sólidas aparecen en ingeniería de software de largo alcance e ingeniería de aprendizaje automático, mientras que el rendimiento de uso de computadora también aumenta.

Cómo leer estos resultados de benchmarks

La eficiencia de tokens es parte de la historia del benchmark

Las puntuaciones brutas de tareas no muestran cuántos tokens o llamadas a herramientas se necesitaron para alcanzar el resultado. Google dice que Gemini 3.6 Flash generó un 17 % menos de tokens de salida que Gemini 3.5 Flash en el Índice de Inteligencia de Análisis Artificial. En DeepSWE, la compañía informa una reducción mayor: los tokens de salida promedio por tarea cayeron de aproximadamente 276,000 a 97,000, una disminución de aproximadamente el 65%.

Artificial Analysis lista de forma independiente la configuración de alto pensamiento de Gemini 3.6 Flash con una puntuación de Índice de Inteligencia de 50 y una ventana de contexto de un millón de tokens. Los resultados de los benchmarks pueden cambiar a medida que los evaluadores actualizan los prompts, las herramientas y las versiones del modelo, por lo que las pruebas de producción con tareas representativas siguen siendo más importantes que una posición en la tabla de clasificación.

Gráfico oficial de Google que compara los tokens de salida promedio utilizados por Gemini 3.5 Flash y Gemini 3.6 Flash

Fuente: blog.google

El uso reducido de tokens de salida puede reducir el costo de los bucles largos de agentes, especialmente cuando el modelo razona, edita archivos y llama herramientas repetidamente antes de terminar.

Precios de Gemini 3.6 Flash

La tarifa estándar publicada por Google es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. La tarifa de entrada no ha cambiado desde Gemini 3.5 Flash, mientras que la tarifa de salida cae de $9.00 a $7.50. La entrada almacenada en caché aparece a $0.15 por millón de tokens en la página de precios de la Plataforma de Agentes de Google Cloud.

Opción de consumo Entrada por 1M tokens Salida por 1M tokens Uso típico
Estándar $1.50 $7.50 Tráfico normal interactivo y de API de producción
Prioridad $2.70 $13.50 Cargas de trabajo que pagan más por capacidad de inferencia priorizada
Flex o Batch $0.75 $3.75 Procesamiento asíncrono o tolerante a retrasos

Ejemplos de cálculos de precios estándar

Ejemplo de uso mensual Costo de entrada Costo de salida Total estimado
10M de tokens de entrada y 1M de salida $15.00 $7.50 $22.50
50M de tokens de entrada y 5M de salida $75.00 $37.50 $112.50
100M de tokens de entrada y 20M de salida $150.00 $150.00 $300.00

Estos ejemplos cubren solo los tokens del modelo. La búsqueda contextual, el uso de computadora, la ejecución de código, los servicios externos y otros componentes de la plataforma pueden agregar costos o latencia. La métrica interna más útil es, por lo tanto, el costo por tarea completada exitosamente, incluidas las reintentos y las llamadas a herramientas, en lugar de solo la tarifa de token indicada.

Disponibilidad: ¿dónde puedes usar Gemini 3.6 Flash?

Gemini 3.6 Flash estuvo disponible desde el día del lanzamiento en las superficies de consumidor, desarrollador y empresa de Google. Los límites de uso exactos, el acceso regional y los controles de selección de modelos pueden diferir según el producto, la suscripción y la cuenta.

Grupo de usuarios Disponible a través de Detalle importante
Desarrolladores API de Gemini, Google AI Studio y Android Studio Utilice el ID de modelo estable gemini-3.6-flash
Desarrolladores de agentes Google Antigravity y Gemini Managed Agents Google hizo de 3.6 Flash el modelo predeterminado para el agente administrado de Antigravity
Empresas Plataforma de Agentes Gemini Enterprise y la aplicación Gemini Enterprise Se aplican la facturación empresarial, la gobernanza y la configuración regional
Usuarios generales Aplicación Gemini El acceso y los límites de uso pueden depender de la cuenta y el nivel de suscripción
Interfaz oficial de Google AI Studio que muestra registros de API y conjuntos de datos junto a una aplicación impulsada por Gemini

Fuente: blog.google

Los registros y conjuntos de datos de AI Studio pueden ayudar a los equipos a comparar el comportamiento del modelo, inspeccionar solicitudes fallidas y crear conjuntos de evaluación repetibles antes de cambiar una implementación de producción.

Gemini 3.6 Flash no debe confundirse con Gemini 3.5 Flash-Lite o Gemini 3.5 Flash Cyber. Flash-Lite es la opción de alto rendimiento y menor costo. Flash Cyber es un modelo de seguridad especializado planeado para gobiernos y socios de confianza a través de un piloto de acceso limitado de CodeMender, no un reemplazo disponible de forma general para 3.6 Flash.

Ventana de contexto, entradas y herramientas compatibles

Especificación Gemini 3.6 Flash
Tipos de entrada Texto, imagen, video, audio y PDF
Tipo de salida Texto
Límite de tokens de entrada 1,048,576 tokens
Límite de tokens de salida 65,536 tokens
Capacidades admitidas Caché, ejecución de código, búsqueda de archivos, llamadas a funciones, búsqueda contextual, búsqueda en Mapas, salida estructurada, pensamiento y contexto de URL
Uso de computadora Soportado en Vista previa
Opciones de consumo Inferencia estándar, Batch API, inferencia Flex e inferencia de Prioridad
No soportado Generación de imágenes, generación de audio y la API Live

La ventana de contexto de un millón de tokens es útil para grandes conjuntos de documentos, repositorios de código, transcripciones y registros multimodales. No garantiza un recuerdo perfecto en cada posición de un prompt largo, y enviar el contexto máximo puede aumentar el costo y la latencia. La recuperación, la búsqueda de archivos y la segmentación de prompts aún pueden producir un sistema de producción más confiable.

Arte oficial de Google que muestra archivos fluyendo hacia la herramienta de Búsqueda de Archivos de la API de Gemini

Fuente: blog.google

La Búsqueda de Archivos es una de las herramientas integradas compatibles con Gemini 3.6 Flash y puede basar las respuestas en documentos de proyectos indexados en lugar de colocar cada archivo directamente en cada prompt.

¿Qué herramientas integradas son más importantes?

Lista de verificación de migración para Gemini 3.6 Flash

  1. Cambie el ID del modelo objetivo a gemini-3.6-flash en un entorno de prueba.
  2. Elimine los campos de muestreo obsoletos como temperature, top_p y top_k.
  3. Reemplace las configuraciones antiguas de presupuesto de pensamiento con un thinking_level apropiado.
  4. Elimine los turns de modelo precargados y revise el manejo del estado multitur.
  5. Vuelva a probar las llamadas a funciones, las respuestas de herramientas y los esquemas de salida estructurada.
  6. Compare el éxito de la tarea, la latencia, los tokens de entrada, los tokens de salida, los turnos y las llamadas a herramientas con el modelo de producción actual.
  7. Utilice una implementación gradual y mantenga una vía de reversión hasta que las cargas de trabajo representativas sean estables.

¿Debería migrar de Gemini 3.5 Flash?

Gemini 3.6 Flash es el objetivo lógico de migración cuando una aplicación depende de agentes de codificación, uso de herramientas de varios pasos, interacción con computadoras, análisis de documentos o razonamiento visual y espacial. El menor precio de salida y la menor tendencia a entrar en bucle son especialmente relevantes para los agentes que pueden llamar al modelo repetidamente antes de completar una solicitud del usuario.

Carga de trabajo Mejor dirección actual Razón
Agente de codificación a nivel de repositorio Probar Gemini 3.6 Flash Precisión de codificación mejorada y menos bucles de ejecución
Análisis multimodal de documentos y gráficos Probar Gemini 3.6 Flash Resultados multimodales y de trabajo de conocimiento publicados más sólidos
Clasificación o extracción de alto volumen Comparar con Gemini 3.5 Flash-Lite Flash-Lite está diseñado para un rendimiento de menor costo
Generación de imágenes Elegir otro modelo Gemini Gemini 3.6 Flash solo produce salida de texto
Aplicación de voz en tiempo real Usar un modelo compatible con la API Live La API Live no es compatible con Gemini 3.6 Flash
Pipeline heredado estable sin problemas de calidad Evaluar antes de migrar Un cambio es útil solo cuando la calidad, la latencia o el costo mejoran en la carga de trabajo real

Para una perspectiva más amplia de selección de modelos, el comparador técnico Gemini vs. Claude de Zerlo explica las diferentes compensaciones entre el ecosistema de Google y los modelos de Anthropic. Los usuarios centrados en asistentes reutilizables en lugar de despliegues de API también pueden encontrar útil la guía Gemini Gems .

Preguntas frecuentes

¿Cuándo se lanzó Gemini 3.6 Flash?

Google anunció y lanzó Gemini 3.6 Flash el 21 de julio de 2026. Estuvo disponible de forma general a través de productos Gemini para desarrolladores, empresas y consumidores.

¿Cuál es el nombre del modelo API de Gemini 3.6 Flash?

El ID de modelo estable es gemini-3.6-flash. La documentación de modelos de Google lo enumera como una versión estable en lugar de un alias solo de vista previa.

¿Cuánto cuesta Gemini 3.6 Flash?

El precio estándar es de $1.50 por millón de tokens de entrada y $7.50 por millón de tokens de salida. Google Cloud también enumera tarifas Flex o Batch más bajas y tarifas de Prioridad más altas. Las herramientas y otros servicios de la plataforma pueden agregar cargos adicionales.

¿Es Gemini 3.6 Flash más barato que Gemini 3.5 Flash?

Sí, para tokens de salida estándar. El precio de entrada sigue siendo de $1.50 por millón de tokens, mientras que el precio de salida cae de $9.00 a $7.50 por millón de tokens. Google también informa un menor uso de tokens de salida en sus evaluaciones.

¿Gemini 3.6 Flash soporta imágenes, audio y video?

Acepta texto, imágenes, video, audio y documentos PDF como entrada. Su salida es texto. No soporta generación de imágenes, generación de audio ni la API Live.

¿Gemini 3.6 Flash está disponible en la aplicación Gemini?

Sí. Google incluyó la aplicación Gemini entre las superficies de lanzamiento. Los límites específicos de la cuenta, los detalles de implementación regional y los controles de selección de modelos aún pueden variar.

¿Gemini 3.6 Flash soporta el uso de computadora?

Sí, pero Google marca el uso de computadora como una capacidad de Vista previa en la documentación del modelo. Los sistemas de producción deben limitar los permisos, validar las acciones y mantener la confirmación humana para las operaciones importantes.

¿Gemini 3.6 Flash es mejor que Gemini 3.5 Flash?

Las evaluaciones publicadas por Google muestran puntuaciones más altas en codificación, ingeniería de aprendizaje automático, trabajo de conocimiento y uso de computadora, junto con un menor uso de tokens de salida. La ventaja práctica depende de la carga de trabajo, por lo que los equipos deben realizar pruebas representativas antes de cambiar el tráfico de producción.

En resumen

Gemini 3.6 Flash es una mejora significativa centrada en la eficiencia en lugar de un cambio de versión cosmético. Mejora los resultados publicados por Google en codificación de agentes, ingeniería de aprendizaje automático, trabajo de conocimiento y uso de computadora, al tiempo que reduce el precio estándar de los tokens de salida de $9.00 a $7.50 por millón de tokens. Su argumento más sólido no es simplemente que cada token es más barato, sino que muchas tareas de varios pasos pueden requerir menos tokens, turnos y llamadas a herramientas.

Los desarrolladores deberían considerarlo el candidato principal de migración para las cargas de trabajo de Gemini 3.5 Flash que dependen de código, herramientas o razonamiento multimodal. Flash-Lite sigue siendo más adecuado para la ejecución de alto volumen más económica, y Gemini 3.6 Flash no es el modelo adecuado para la generación de imágenes, la salida de audio nativa o el uso de la API Live. Las mejoras en los benchmarks son prometedoras, pero las decisiones de producción aún deben basarse en la precisión específica de la tarea, la latencia, la seguridad y el costo total.

¡Comparte nuestra publicación!
Fuentes