L'API Gemini è il percorso più rapido dal prompt alla produzione con Gemini, Veo, Nano Banana e altro ancora. Ti consente di integrare questi modelli generativi nelle tue applicazioni per generare testo e immagini, analizzare input multimodali e creare agenti conversazionali.
Python
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Explain how AI works in a few words"
)
print(interaction.output_text)
JavaScript
import { GoogleGenAI } from "@google/genai";
const ai = new GoogleGenAI({});
const interaction = await ai.interactions.create({
model: "gemini-3.8-flash",
input: "Explain how AI works in a few words",
});
console.log(interaction.output_text);
Java
import com.google.genai.Client;
import com.google.genai.gaos.models.interactions.CreateModelInteraction;
import com.google.genai.gaos.models.interactions.Interaction;
import com.google.genai.gaos.models.interactions.InteractionsInput;
import com.google.genai.gaos.models.interactions.Model;
import com.google.genai.gaos.models.operations.CreateInteractionRequestBody;
Client client = new Client();
CreateModelInteraction params =
CreateModelInteraction.builder()
.model(Model.of("gemini-3.7-flash"))
.input(InteractionsInput.of("Explain how AI works in a few words"))
.build();
Interaction interaction =
client.interactions.create(CreateInteractionRequestBody.of(params)).interaction().get();
System.out.println(interaction.outputText().orElse(""));
REST
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
Segui la nostra guida introduttiva per ottenere una chiave API ed effettuare la tua prima chiamata API in pochi minuti.
Scopri i modelli
Visualizza tuttoGemini 3.8 Flash Novità
Il nostro modello Flash più intelligente, progettato per l'ingegneria software a lungo termine, gli agenti autonomi e i workflow aziendali complessi.
Gemini 3.5 Flash-Lite
Modello ad alto volume e sensibile ai costi, ottimizzato per attività di subagenti a bassa latenza e throughput elevato.
Gemini 3.1 Pro
Il nostro modello più intelligente, il migliore al mondo per la comprensione multimodale, il tutto basato su ragionamento allo stato dell'arte.
🍌 Nano Banana 2 e Nano Banana Pro
Modelli allo stato dell'arte per la generazione e la modifica di immagini.
Gemini Omni Flash
Il nostro modello allo stato dell'arte per la generazione e la modifica di video.
speech_to_text Gemini 3.5 Transcribe Novità
Modello di trascrizione vocale a bassa latenza con rilevamento della lingua basato sull'espressione, diarizzazione degli interlocutori e timestamp delle parole.
Gemini Robotics
Un modello di visione-linguaggio (VLM) che porta le funzionalità agentiche di Gemini nella robotica e consente un ragionamento avanzato nel mondo fisico.
Esplora le funzionalità
Generazione di immagini
Genera e modifica immagini altamente contestuali in modo nativo con Nano Banana.
Contesto lungo
Inserisci milioni di token nei modelli Gemini ed estrai informazioni da immagini, video e documenti non strutturati.
Output strutturati
Limita Gemini a rispondere con JSON, un formato di dati strutturati adatto all'elaborazione automatica.
Chiamata di funzione
Crea workflow agentici collegando Gemini ad API e strumenti esterni.
Generazione di video con Veo 3.1
Crea contenuti video di alta qualità da prompt di testo o immagini con il nostro modello allo stato dell'arte.
Agenti vocali con l'API Live
Crea applicazioni e agenti vocali in tempo reale con l'API Live.
Strumenti
Collega Gemini al mondo tramite strumenti integrati come Ricerca Google, Contesto URL, Google Maps, Esecuzione di codice e Utilizzo del computer.
Comprensione dei documenti
Elabora fino a 1000 pagine di file PDF con una comprensione multimodale completa o altri tipi di file basati su testo.
Pensiero
Scopri in che modo le funzionalità di pensiero migliorano il ragionamento per attività e agenti complessi.
API Interactions
A partire da giugno 2026, l'API Interactions è diventata la nostra interfaccia predefinita ed è il modo migliore per creare con i modelli e gli agenti Gemini. Se stai iniziando un nuovo progetto, ti consigliamo di utilizzare l'API Interactions. Sebbene rimanga supportata, l'API generateContent è ora considerata legacy.
Panoramica di Interactions
Scopri in che modo l'API Interactions gestisce lo stato della conversazione, i messaggi e i formati di output.
Guida alla migrazione
Guida passo passo per la transizione del codice da generateContent all'API Interactions.
Streaming
Trasmetti in streaming token in tempo reale, pensieri incrementali ed eventi di chiamata di strumenti.