La API de Gemini es el camino más rápido desde la instrucción hasta la producción con Gemini, Veo, Nano Banana y mucho más. Te permite integrar estos modelos generativos en tus aplicaciones para generar texto e imágenes, analizar entradas multimodales y compilar agentes conversacionales.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
Conoce los modelos
Ver todosGemini 3.8 Flash Nuevo
Nuestro modelo Flash más inteligente, diseñado para la ingeniería de software de largo alcance, los agentes autónomos y los flujos de trabajo empresariales complejos.
Gemini 3.5 Flash-Lite
Modelo de alto volumen y sensible a los costos optimizado para tareas de agentes secundarios de alta capacidad de procesamiento y baja latencia.
Gemini 3.1 Pro
Nuestro modelo más inteligente, el mejor del mundo para la comprensión multimodal, todo basado en un razonamiento de estado del arte.
🍌 Nano Banana 2 y Nano Banana Pro
Modelos de generación y edición de imágenes de vanguardia.
Gemini Omni Flash
Nuestro modelo de generación y edición de videos de estado del arte.
speech_to_text Gemini 3.5 Transcribe Nuevo
Modelo de voz a texto de baja latencia con detección de idioma basada en expresiones, identificación de interlocutores y marcas de tiempo de palabras.
Gemini Robotics
Un modelo de lenguaje de visión (VLM) que lleva las capacidades de agente de Gemini a la robótica y permite el razonamiento avanzado en el mundo físico.
Explora las funciones
Generación de imágenes
Genera y edita imágenes altamente contextuales de forma nativa con Nano Banana.
Contexto largo
Ingresa millones de tokens en los modelos de Gemini y obtén información de imágenes, videos y documentos no estructurados.
Resultados estructurados
Restringe Gemini para que responda con JSON, un formato de datos estructurados adecuado para el procesamiento automático.
Llamadas a funciones
Compila flujos de trabajo de agentes conectando Gemini a APIs y herramientas externas.
Generación de video con Veo 3.1
Crea contenido de video de alta calidad a partir de instrucciones de texto o imágenes con nuestro modelo de estado del arte.
Agentes de voz con la API de Live
Compila aplicaciones y agentes de voz en tiempo real con la API de Live.
Herramientas
Conecta Gemini al mundo a través de herramientas integradas como la Búsqueda de Google, el contexto de URL, Google Maps, la ejecución de código y el uso de la computadora.
Comprensión de documentos
Procesa hasta 1,000 páginas de archivos PDF con comprensión multimodal completa o con otros tipos de archivos basados en texto.
Pensar
Explora cómo las capacidades de pensamiento mejoran el razonamiento para tareas y agentes complejos.
API de Interactions
La API de Interactions se convirtió en nuestra interfaz predeterminada a partir de junio de 2026 y es la mejor manera de compilar con modelos y agentes de Gemini en el futuro. Si estás comenzando un proyecto nuevo, debes usar la API de Interactions. Si bien sigue siendo compatible, la API de generateContent ahora se considera heredada.
Descripción general de Interactions
Obtén información sobre cómo la API de Interactions administra el estado de la conversación, los mensajes y los formatos de salida.
Guía de migración
Guía paso a paso para migrar tu código de generateContent a la API de Interactions.
Transmisión
Transmite tokens en tiempo real, pensamientos incrementales y eventos de llamadas a herramientas.