Los desarrolladores y clientes que crean agentes de IA de producción necesitan una mayor eficiencia de token, menor latencia y un rendimiento más confiable. Nuestra serie Flash de modelos está diseñada para alcanzar el punto óptimo de eficiencia y calidad para permitir escalar flujos de trabajo agentes. Basado en Gemini 3.5 Flash, presentamos nuevos modelos Gemini:
3.6 Flash: nuestro modelo de caballo de batalla que ofrece mejor codificación, trabajo de conocimiento y rendimiento multimodal. Según el Índice de Análisis Artificial, reduce el uso de tokens de salida en un 17% en comparación con 3.5 Flash, y en algunos puntos de referencia como DeepSWE de Datacurve, observamos hasta un 65%, todo a un menor costo por token de salida. 3.5 Flash-Lite: nuestro modelo de clase 3.5 más rápido y rentable, que ofrece 350 tokens de salida por segundo según el Índice de Análisis Artificial, y también supera significativamente a las generaciones anteriores de Flash-Lite en agentes. flujos de trabajo.3.5 Flash Cyber en CodeMender: las aplicaciones de ciberseguridad exitosas requieren una orquestación cuidadosa de un modelo junto con una infraestructura de agente. Estamos introduciendo una combinación de un modelo nuevo, altamente eficiente y especializado centrado en lo cibernético junto con nuestro agente de seguridad de código CodeMender que ofrece un rendimiento competitivo en la frontera.
Más allá de los lanzamientos de hoy, Gemini 3.5 Pro se está probando actualmente con socios y planeamos ponerlo a disposición del público tan pronto como esté listo. Paralelamente, nuestro equipo ya se está centrando en construir la próxima generación de modelos. Hemos comenzado nuestra preparación previa más ambiciosa hasta el momento, para Gemini 4, y estamos entusiasmados con el progreso.
3.6 Flash: Más eficiente y de mejor calidad que 3.5 Flash
Gemini 3.6 Flash se basa directamente en los comentarios de desarrolladores y clientes de 3.5 Flash. 3.6 Flash no sólo ofrece un paso adelante en el trabajo de codificación y conocimiento, sino que lo hace al mismo tiempo que mejora significativamente la eficiencia de los tokens. Por ejemplo, en el Índice de Análisis Artificial, vemos que 3.6 Flash consume un 17% menos de tokens de salida que 3.5 Flash. También se necesitan menos pasos de razonamiento y llamadas a herramientas para lograr flujos de trabajo de varios pasos.
Esta eficiencia mejorada también se combina con un precio más bajo que 3.5 Flash. A $1,50/1 millón de tokens de entrada y $7,50/1 millón de tokens de salida, 3.6 Flash reduce el costo general por tarea de agente, lo que hace que la creación y ejecución de agentes sea más rentable.