Presentamos Gemini 3.6 Flash, 3.5 Flash-Lite y 3.5 Flash Cyber.
Los desarrolladores y clientes que crean agentes de IA para producción necesitan mayor eficiencia de tokens, menor latencia y un rendimiento más fiable. Nuestra serie de modelos Flash está diseñada para lograr el equilibrio perfecto entre eficiencia y calidad, lo que permite escalar los flujos de trabajo de los agentes. Basándonos en Gemini 3.5 Flash, presentamos nuevos modelos Gemini :
- 3.6 Flash: Nuestro modelo principal que ofrece un mejor rendimiento en codificación, trabajo de conocimiento y multimodalidad. Según el Índice de Análisis Artificial , reduce el uso de tokens de salida en un 17 % en comparación con 3.5 Flash, y en algunos benchmarks como DeepSWE de Datacurve , observamos hasta un 65 %, todo ello a un menor coste por token de salida.
- 3.5 Flash-Lite: Nuestro modelo de clase 3.5 más rápido y rentable, que ofrece 350 tokens de salida por segundo según el Índice de Análisis Artificial, y que además supera significativamente a las generaciones anteriores de Flash-Lite en flujos de trabajo basados en agentes.
- 3.5 Flash Cyber en CodeMender: Las aplicaciones de ciberseguridad exitosas requieren una orquestación cuidadosa de un modelo junto con una infraestructura de agentes. Presentamos una combinación de un nuevo modelo especializado y altamente eficiente, centrado en la ciberseguridad, junto con nuestro agente de seguridad de código CodeMender, que ofrece un rendimiento competitivo en la vanguardia.
Además de los lanzamientos de hoy, Gemini 3.5 Pro se encuentra actualmente en fase de pruebas con socios y planeamos lanzarlo al público general tan pronto como esté listo. Paralelamente, nuestro equipo ya está trabajando en la creación de la próxima generación de modelos. Hemos iniciado nuestra fase de preentrenamiento más ambiciosa hasta la fecha para Gemini 4 y estamos muy satisfechos con los resultados.
Flash 3.6: Más eficiente y mejor calidad
Gemini 3.6 Flash se basa directamente en los comentarios de desarrolladores y clientes de la versión 3.5. No solo representa un avance en la codificación y el procesamiento del conocimiento, sino que además mejora significativamente la eficiencia de los tokens. Por ejemplo, en el Índice de Análisis Artificial, observamos que 3.6 Flash consume un 17% menos de tokens de salida que 3.5 Flash. Además, requiere menos pasos de razonamiento y llamadas a herramientas para completar flujos de trabajo de varios pasos.
Esta mayor eficiencia se combina además con un precio inferior al de Flash 3.5. Con un coste de 1,50 US$ por millón de tokens de entrada y 7,50 US$ por millón de tokens de salida, Flash 3.6 reduce el coste total por tarea de agente, lo que hace que la creación y el funcionamiento de los agentes sean más rentables.
La versión 3.6 Flash muestra una mayor eficiencia en el uso de tokens y una menor verbosidad que la versión 3.5 Flash en una tarea verificada por OSWorld (API).
Aun siendo más eficiente, la versión 3.6 Flash presenta mejoras de rendimiento en comparación con la versión 3.5 Flash en todos los casos de uso:
- 3.6 Flash ofrece mayor precisión con menos ediciones de código no deseadas y bucles de ejecución reducidos, como se observa en DeepSWE (49 % frente a 37 %), y muestra una mejora significativa en ML Research, como se observa en MLE Bench (63,9 % frente a 49,7 %).
- Ha mejorado las capacidades de uso del ordenador, como se observa en OSWorld-Verified (83,0 % frente a 78,4 %). El uso del ordenador ahora es una herramienta integrada del lado del cliente a través de la API de Gemini y Gemini Enterprise.
- Supera a Flash 3.5 en tareas de gestión del conocimiento, como demuestran pruebas comparativas como GDPval-AA v2 (1421 frente a 1349). Clientes como Hebbia y Harvey lo han encontrado especialmente eficaz en tareas multimodales como el análisis de documentos, el análisis de gráficos y datos, y la redacción de informes.
3.6 Flash, mediante el uso de agentes gestionados en AIS, puede ayudar a analizar datos financieros y transcripciones de forma más eficiente y precisa que 3.5 Flash (AIS).
3.6 Flash ejecuta migraciones de código, utilizando orquestación multiagente en AGY, con menor latencia y mayor calidad que 3.5 Flash (AGY).
3.6 Flash ayuda a desarrollar un extractor de texturas fotográficas para flujos de trabajo 3D, utilizando canvas (Aplicación Gemini ).
3.6 Flash utiliza AGY y el editor sin conexión tldraw para crear estudios de temas interactivos con sus sólidas habilidades de comprensión visual (AGY).
Los clientes informan que Flash, con una calificación de 3.6, representa un avance tanto en costo como en calidad, al equilibrar la eficiencia, la precisión y la velocidad de los tokens en flujos de trabajo complejos y tareas basadas en el conocimiento:
Construido con seguridad
3.6 Flash se distribuye con medidas de seguridad Frontier Safety mejoradas en los ámbitos de la protección contra amenazas químicas, biológicas, radiológicas y nucleares (CBRN) y el uso indebido de ciberataques. Estas medidas hacen que el modelo sea considerablemente más resistente a los jailbreaks. Al mismo tiempo, el modelo ha sido entrenado para minimizar los rechazos a usos beneficiosos.
Para obtener más información, consulte la tarjeta modelo Flash 3.6 .
3.5 Flash-Lite: Diseñado para escalar flujos de trabajo basados en agentes
Además de Flash, también lanzamos Gemini 3.5 Flash-Lite, diseñado tanto para tareas de baja latencia como para tareas en las que un alto rendimiento es fundamental para los flujos de trabajo de los desarrolladores, como la búsqueda automatizada y el procesamiento de documentos.
El modelo 3.5 Flash-Lite es el más rápido de la serie 3.5. Según las mediciones de Análisis Artificial , alcanza una velocidad de 350 tokens de salida por segundo. Con un precio de 0,3 $/1 millón de tokens de entrada y 2,5 $/1 millón de tokens de salida, y con una calidad significativamente superior a la del 3.1 Flash-Lite, el 3.5 Flash-Lite ofrece una excelente relación precio-rendimiento para desarrolladores y clientes que gestionan un alto volumen de tráfico de producción.
3.5 Flash-Lite ejecuta tareas de alto volumen con una latencia menor que 3.5 Flash.
Flash-Lite 3.5 permite una escalabilidad eficiente para sistemas basados en agentes. En todos los niveles de procesamiento, el modelo supera significativamente a Flash-Lite 3.1. Según la carga de trabajo, los desarrolladores pueden configurar el modelo para priorizar la ejecución de baja latencia y bajo costo para tareas de alto volumen con niveles de procesamiento mínimos y bajos, o bien, utilizar niveles de procesamiento superiores para gestionar cargas de trabajo de subagentes de varios pasos. El modelo ahora también incorpora el uso de recursos informáticos como herramienta integrada para brindar soporte confiable a estas tareas basadas en agentes en diversas plataformas.
Se trata de un avance significativo en la codificación y las tareas de agentes, como se observa en Terminal-Bench 2.1 (54 % frente a 31 %), en el contexto extenso, como se observa en GDM-MRCR v2 (72,2 % frente a 60,1 %), y en la ejecución de tareas del mundo real, como se observa en GDPval-AA v2 (1140 frente a 642).
De hecho, en muchas evaluaciones de agentes y codificación, Flash-Lite 3.5 incluso supera a Flash 3, incluso en SWE-Bench Pro (54,2 % frente a 49,6 %) y OSWorld-Verified (74,0 % frente a 65,1 %), lo que lo convierte en una opción más rápida y capaz para cargas de trabajo tanto en Flash 2.5 como en Flash 3.
3.5 Flash-Lite extrae las características de los productos de un conjunto de datos masivo de comercio electrónico y las sintetiza.
Al funcionar junto con Flash 3.6 como agente principal, Flash-Lite 3.5 genera instantáneamente 25 conceptos de diseño web únicos y listos para explorar.
3.5 Flash-Lite puede ampliar la traducción y el resumen de recibos gracias a su comprensión multimodal.
3.5 Flash-Lite crea un juego generando e iterando instantáneamente a través de múltiples opciones.
Los primeros clientes de Flash-Lite 3.5 están destacando su combinación única de velocidad, inteligencia y rentabilidad para escalar flujos de trabajo basados en agentes y tareas de procesamiento de datos:
Para obtener más información sobre el modelo, consulte la ficha del modelo Flash-Lite 3.5 .
3.5 Flash Cyber en CodeMender: detección y corrección eficiente de vulnerabilidades
Los modelos de IA son capaces de detectar vulnerabilidades de seguridad más rápido de lo que los sistemas actuales pueden solucionarlas. Para hacer frente a esta creciente amenaza, se requiere un enfoque de seguridad de software altamente eficaz y eficiente.
El rendimiento y la eficiencia de Flash lo convierten en una base ideal para detectar, validar y corregir problemas de seguridad de código a gran escala. Gemini 3.5 Flash Cyber se basa en Flash 3.5 y está optimizado para encontrar y corregir vulnerabilidades de ciberseguridad a un precio por token inferior al de modelos más grandes.
En CodeMender, que utiliza varios agentes de Flash Cyber 3.5 que trabajan juntos para producir un único informe combinado, Flash Cyber 3.5 alcanza un rendimiento competitivo en la vanguardia del popular benchmark CyberGym.
Dada la naturaleza de doble uso de esta tecnología, hemos adoptado un enfoque intencional para el despliegue de Flash Cyber 3.5. El modelo estará disponible próximamente en exclusiva para gobiernos y socios de confianza a través de CodeMender , como parte de un programa piloto de acceso limitado. Esto permitirá a los responsables de la seguridad en primera línea detectar y corregir vulnerabilidades críticas antes de que puedan ser explotadas, a la vez que se mitiga el uso indebido generalizado.
3.6 Flash y 3.5 Flash-Lite: ¡Empieza hoy mismo!
Los modelos 3.6 Flash y 3.5 Flash-Lite están disponibles a partir de hoy:
- Para desarrolladores en la API Gemini a través de Google AI Studio y Android Studio . Flash 3.6 también está disponible en Google Antigravity . Comience con la Guía para desarrolladores .
- Para empresas en Gemini Enterprise Agent Platform . Flash 3.6 también está disponible en la aplicación Gemini Enterprise .
- Para todos a través de la aplicación Gemini . Flash Lite 3.5 también se está implementando en la Búsqueda de Google .
A medida que comience a desarrollar con 3.6 Flash y 3.5 Flash-Lite, agradecemos sus comentarios para mejorar los futuros modelos Gemini y esperamos lanzar pronto la versión 3.5 Pro.