La API de Gemini es la ruta más rápida desde la instrucción hasta la producción con Gemini, Veo, Nano Banana y mucho más. Te permite integrar estos modelos generativos en tus aplicaciones para generar texto e imágenes, analizar entradas multimodales y compilar agentes conversacionales.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
Conoce los modelos
Ver todosGemini 3.8 Flash Nuevo
Nuestro modelo Flash más inteligente, diseñado para ingeniería de software a largo plazo, agentes autónomos y flujos de trabajo empresariales complejos.
Gemini 3.5 Flash-Lite
Modelo de alto volumen y sensible a los costos optimizado para tareas de subagentes de alta capacidad de procesamiento y baja latencia.
Gemini 3.1 Pro
Nuestro modelo más inteligente, el mejor del mundo para la comprensión multimodal, todo basado en un razonamiento de estado del arte.
Nano Banana 2 y Nano Banana Pro
Modelos de estado del arte para la generación y edición de imágenes
Gemini Omni Flash
Nuestro modelo de estado del arte para la generación y edición de videos.
Gemini 3.5 Transcribe Nuevo
Modelo de voz a texto de baja latencia con detección de idiomas basada en expresiones, identificación de interlocutores y marcas de tiempo de palabras.
Gemini Robotics
Un modelo de lenguaje de visión (VLM) que aporta las capacidades de agente de Gemini a la robótica y permite un razonamiento avanzado en el mundo físico.
Explora las funciones
Generación de imágenes
Genera y edita imágenes altamente contextuales de forma nativa con Nano Banana.
Contexto largo
Ingresa millones de tokens en los modelos de Gemini y obtén información a partir de imágenes, videos y documentos no estructurados.
Resultados estructurados
Restringe Gemini para que responda con JSON, un formato de datos estructurados adecuado para el procesamiento automatizado.
Llamadas a funciones
Crea flujos de trabajo de agentes conectando Gemini a APIs y herramientas externas.
Generación de video con Veo 3.1
Crea contenido de video de alta calidad a partir de instrucciones de texto o imágenes con nuestro modelo de estado del arte.
Agentes de voz con la API de Live
Crea aplicaciones y agentes de voz en tiempo real con la API de Live.
Herramientas
Conecta Gemini al mundo a través de herramientas integradas, como la Búsqueda de Google, el Contexto de URL, Google Maps, la Ejecución de código y el Uso de la computadora.
Comprensión de documentos
Procesa hasta 1,000 páginas de archivos PDF con comprensión multimodal completa o con otros tipos de archivos basados en texto.
Pensar
Explora cómo las capacidades de pensamiento mejoran el razonamiento para las tareas y los agentes complejos.
Crear agentes
Los agentes administrados le brindan a Gemini un espacio de trabajo para planificar y completar tareas por su cuenta. En una sola solicitud, Gemini puede escribir y ejecutar código, buscar en la Web y crear archivos en un entorno de zona de pruebas alojado. Comienza con nuestro agente Antigravity prediseñado o personalízalo con tus propias instrucciones y herramientas.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
agent="antigravity-preview-09-2026",
input=(
"Research the top 5 sustainable fashion brands, "
"compare their materials and pricing tiers, and "
"build an interactive dashboard in analysis.html."
),
environment="remote"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
agent: "antigravity-preview-09-2026",
input:
"Research the top 5 sustainable fashion brands, " +
"compare their materials and pricing tiers, and " +
"build an interactive dashboard in analysis.html.",
environment: "remote",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.AgentOption;
import com.google.genai.gaos.models.interactions.CreateAgentInteraction;
import com.google.genai.gaos.models.interactions.CreateAgentInteractionEnvironment;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateAgentInteraction params =
CreateAgentInteraction.builder()
.agent(AgentOption.of("antigravity-preview-09-2026"))
.input(
InteractionsInput.of(
"Research the top 5 sustainable fashion brands, "
+ "compare their materials and pricing tiers, and "
+ "build an interactive dashboard in analysis.html."))
.environment(CreateAgentInteractionEnvironment.of("remote"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params))
.interaction()
.get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST \
"https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"agent": "antigravity-preview-09-2026",
"input": "Research the top 5 sustainable fashion brands, compare their materials and pricing tiers, and build an interactive dashboard in analysis.html.",
"environment": "remote"
}'
API de Interactions
La API de Interactions se convirtió en nuestra interfaz predeterminada a partir de junio de 2026 y es la mejor manera de compilar con los modelos y agentes de Gemini en el futuro. Si estás comenzando un proyecto nuevo, debes usar la API de Interactions. Si bien sigue siendo compatible, la API de generateContent ahora se considera heredada.
Descripción general de las interacciones
Obtén información sobre cómo la API de Interactions administra el estado de la conversación, los mensajes y los formatos de salida.
Guía de migración
Guía paso a paso para migrar tu código de generateContent a la API de Interactions
Transmisión
Transmite tokens en tiempo real, pensamientos incrementales y eventos de llamadas a herramientas.