Modelo más reciente Otros modelos
Gemini 3.6 Flash (gemini-3.6-flash) y Gemini 3.5 Flash-Lite (gemini-3.5-flash-lite) están disponibles de forma general (DG) y listos para su uso en producción.
- Gemini 3.6 Flash: Mejor rendimiento en tareas complejas de agentes y multimodales, con un menor uso de tokens y un precio más bajo que 3.5 Flash.
- Gemini 3.5 Flash-Lite: Es el modelo más rápido y económico de la familia 3.5. Supera a las generaciones anteriores de Flash-Lite en la ejecución de alta capacidad de procesamiento.
En esta guía, se explica qué novedades incluye cada modelo, qué cambios en la API afectan tu código y cómo migrar.
Gemini 3.6 Flash
Instala la habilidad:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplica la habilidad:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instala la habilidad:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplica la habilidad:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Modelos nuevos
| Modelo | ID de modelo | Nivel de razonamiento predeterminado | Precios | Descripción |
|---|---|---|---|---|
| Gemini 3.6 Flash | gemini-3.6-flash |
medium |
USD 1.50 por millón de tokens de entrada y USD 7.50 por millón de tokens de salida | Equilibra la velocidad con la inteligencia para las tareas multimodales y de agentes. |
| Gemini 3.5 Flash-Lite | gemini-3.5-flash-lite |
minimal |
USD 0.30 por millón de tokens de entrada y USD 2.50 por millón de tokens de salida | El modelo 3.5 más rápido y económico para la ejecución de alto rendimiento. |
Ambos modelos admiten la ventana de contexto de 1 millón de tokens, un máximo de 64,000 tokens de salida, el pensamiento y el conjunto completo de herramientas integradas, incluido el Uso de la computadora.
Para conocer las especificaciones completas, consulta las páginas de los modelos:
Para obtener información detallada sobre los precios, consulta la página de precios.
Guía de inicio rápido
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Write a three.js script that renders an interactive 3D robot."
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
async function main() {
const interaction = await ai.interactions.create({
model: "gemini-3.6-flash",
input: "Write a three.js script that renders an interactive 3D robot.",
});
console.log(interaction.outputText);
}
main();
REST
curl "https://generativelanguage.googleapis.com/v1beta/interactions" -H "x-goog-api-key: $GEMINI_API_KEY" -H 'Content-Type: application/json' -X POST -d '{
"model": "gemini-3.6-flash",
"input": "Write a three.js script that renders an interactive 3D robot."
}'
Novedades de Gemini 3.6 Flash
- Reducción de tokens y turnos: Completa flujos de trabajo de varios pasos con menos pasos de razonamiento, turnos conversacionales y llamadas a herramientas que Gemini 3.5. También reduce la espiralización del bucle de ejecución.
- Generación de código mejorada: Produce código listo para producción de mayor calidad con menos ediciones no deseadas y menos bucles de depuración.
- Mejor cumplimiento de las instrucciones: Reduce los cambios no deseados en los archivos durante las tareas de diagnóstico.
- Razonamiento espacial y multimodal sólido: Se mejoró el rendimiento en la interpretación de gráficos, la conversión de planos visuales y la generación de diseños web con varios elementos.
- Inspección programática inicial: Prefiere ejecutar secuencias de comandos de código de diagnóstico antes de realizar cambios con mayor frecuencia que Gemini 3.5 Flash. Esto mejora la precisión en tareas complejas, pero puede agregar pasos exploratorios adicionales en el trabajo de frontend de rutina.
- Compatibilidad con el uso de la computadora: Se admite como una herramienta integrada para la automatización de la IU basada en agentes.
- Preferencia de diseño de la IU: Es mejor para crear código funcional, aunque los evaluadores humanos prefirieron los modelos anteriores para el diseño y el estilo visual. Puedes mitigar este problema proporcionando pautas de diseño explícitas.
- Esfuerzo de pensamiento predeterminado (medio): Usa el mismo nivel de pensamiento predeterminado
mediumque Gemini 3.5 Flash. - Precios reducidos: Menores costos de los tokens de salida (USD 7.50 por millón en comparación con USD 9.00 por millón para 3.5 Flash) Los tokens de entrada siguen costando USD 1.50 por 1 M.
Novedades de Gemini 3.5 Flash-Lite
- Latencia de ejecución de tareas reducida: Mayor capacidad de procesamiento en la familia 3.5 para el análisis de datos de gran volumen y la extracción de documentos.
- Rendimiento multimodal y razonamiento mejorados: Sólida ruta de migración desde Gemini 2.5 Flash, con puntuaciones más altas en tareas de razonamiento como HLE (18.0% frente a 11.0%) y comparativas multimodales como CharXIV (74.5% frente a 63.7%).
- Organización de agentes secundarios y confiabilidad de las herramientas: Mejora la confiabilidad de la ejecución de herramientas para la ejecución de código, la búsqueda y los flujos de trabajo de MCP. Aumenta el nivel de pensamiento para la planificación autónoma y las tareas complejas de subagentes.
- Comprensión mejorada de documentos: Mejora la exactitud en el análisis de documentos y la extracción de datos estructurados. Experimenta con niveles de pensamiento mínimos y altos según la complejidad del documento.
- Programación interactiva web y procesamiento de datos tabulares: Se desempeña de manera excelente en el procesamiento de datos tabulares y JavaScript de frontend, ya que planifica con una ejecución de código liviana.
- Persistencia del chatbot y la personificación: Mejor seguimiento de instrucciones de varios turnos y coherencia de la personificación en comparación con Gemini 3.1 Flash-Lite.
- Compatibilidad con el uso de la computadora: Se admite como una herramienta integrada para la automatización de la IU basada en agentes.
Cómo elegir el modelo Flash o Flash-Lite adecuado
Usa esta tabla para seleccionar el modelo y la ruta de migración adecuados para tus cargas de trabajo.
Ambos modelos requieren que se quiten los parámetros de muestreo obsoletos (temperature, top_p, top_k) y los turnos del modelo completados previamente. Consulta Cambios en la API para obtener más detalles.
| Modelo | Casos de uso principales | Objetivo de migración recomendado |
|---|---|---|
Gemini 3.6 Flashgemini-3.6-flash |
Generación de código, razonamiento espacial o multimodal, flujos de trabajo de agentes de varios pasos | Gemini 3.5 Flash, Gemini 3 Flash (versión preliminar) o Gemini 3.1 Pro |
Gemini 3.5 Flash-Litegemini-3.5-flash-lite |
Ejecución autónoma de subagentes, análisis de datos y extracción de documentos de alto volumen, análisis de JSON estructurado | Gemini 3.1 Flash-Lite o Gemini 2.5 Flash |
Compatibilidad con el agente de Antigravity
Gemini 3.6 Flash introdujo la compatibilidad con el agente de Antigravity en los Agentes administrados de Gemini.
Para ver las muestras de código actuales y la configuración predeterminada más reciente del agente, consulta la guía del agente de Antigravity y la guía de Gemini 3.8 Flash.
Cambios en la API y actualizaciones de parámetros
A partir de Gemini 3.6 Flash y Gemini 3.5 Flash-Lite, los siguientes cambios en la API se aplican a estos modelos y a todas las versiones futuras de los modelos de Gemini.
- Baja de parámetros de muestreo: Se dieron de baja los parámetros
temperature,top_pytop_k. La API ignora estos parámetros y muestra un error en las generaciones futuras del modelo. - Validación de respuestas predefinidas del modelo: Ya no se admite la función de completar previamente las respuestas del modelo. Si el último turno no vacío de la solicitud es un turno de
model, la API devuelve un error de400.
En las siguientes secciones, se proporcionan explicaciones detalladas y muestras de código para cada cambio en la API.
1. Baja del parámetro de muestreo (temperature, top_p, top_k)
temperature, top_p y top_k están obsoletos y se ignoran. En las futuras generaciones de modelos, proporcionar estos parámetros devolverá un error HTTP 400. Quita estos parámetros de todas las solicitudes.
# ⚠️ Remove these parameters (deprecated)
generation_config = {
"temperature": 0.7,
"top_p": 0.9,
"top_k": 40,
}
Para mejorar el determinismo, define una instrucción del sistema con reglas explícitas para tu caso de uso específico.
2. Validación de la respuesta predefinida del modelo
No se permiten las solicitudes a la API que finalizan con un turno de rol del modelo no vacío y muestran un error HTTP 400.
⚠️ Evita
En las cargas útiles de REST sin procesar o de generateContent heredado, ya no se permite terminar con un turno de rol del modelo:
/* ❌ DO NOT: End payload contents with a 'model' role turn */
{
"contents": [
{"role": "user", "parts": [{"text": "Translate 'Hello world' to Spanish."}]},
{"role": "model", "parts": [{"text": "Translation:"}]} /* ❌ Returns error */
]
}
✅ Migración recomendada (API de Interactions)
En la API de Interactions, los turnos del modelo no se completan previamente de forma manual. Si tu aplicación completaba previamente un turno del modelo para suprimir preámbulos o forzar el formato JSON, usa system_instruction o Salidas estructuradas en su lugar.
# ✅ RECOMMENDED: Use system_instruction in the Interactions API to specify output format
interaction = client.interactions.create(
model="gemini-3.6-flash",
input="Translate 'Hello world' to Spanish.",
system_instruction="Output only the translation without introductory text.",
)
Lista de tareas de migración
Gemini 3.6 Flash
Instala la habilidad:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplica la habilidad:
/gemini-interactions-api migrate my app to Gemini 3.6 Flash
Gemini 3.5 Flash-Lite
Instala la habilidad:
npx skills add google-gemini/gemini-skills --skill gemini-interactions-api --globalAplica la habilidad:
/gemini-interactions-api migrate my app to Gemini 3.5 Flash-Lite
Migra a gemini-3.6-flash
- Actualiza el ID del modelo: Cambia la cadena del modelo objetivo a
gemini-3.6-flash. - Aplica actualizaciones de parámetros: Quita los parámetros de muestreo en desuso (
temperature,top_p,top_k),candidate_count(no compatible con Gemini 3 y versiones posteriores) y los giros del modelo rellenados previamente, como se detalla en Actualizaciones de parámetros y cambios en la API. - Configura el nivel de pensamiento: Reemplaza
thinking_budgetporthinking_level("medium"o"high"). - Audita las llamadas a función:
- Coloca los recursos multimodales dentro de la carga útil de la respuesta.
- Da formato a las instrucciones intercaladas con
\n\n. - Si ves errores
Malformed_Function_Callvinculados al texto previo a la herramienta, consulta Soluciones alternativas para los requisitos de texto previo a la herramienta.
- Requisitos básicos de Gemini 3.x: Para obtener información sobre las actualizaciones del SDK y la conservación de la firma de pensamiento, consulta la Lista de tareas para la migración a Gemini 3.5.
Migra a gemini-3.5-flash-lite
- Actualiza el ID del modelo: Cambia la cadena del modelo objetivo a
gemini-3.5-flash-lite. - Configura el nivel de esfuerzo de pensamiento:
- Para la extracción, el enrutamiento o la clasificación de gran volumen, deja
thinking_levelen"minimal"(predeterminado) para obtener la máxima capacidad de procesamiento. - Para los subagentes autónomos con llamadas a herramientas, ejecución de código o razonamiento de varios pasos, establece
thinking_levelen"medium"o"high"para evitar la finalización prematura de la herramienta.
- Para la extracción, el enrutamiento o la clasificación de gran volumen, deja
- Quita los parámetros obsoletos y valida la llamada a función: Aplica las mismas reglas que 3.6 Flash.
- Requisitos básicos de Gemini 3.x: Consulta la Lista de verificación de migración a Gemini 3.5.
Próximos pasos
- Revisa las especificaciones de la API en la Descripción general de los modelos.
- Explora la organización de varios agentes en la Guía de la API de Interactions.
- Probar y definir instrucciones en Google AI Studio