Lightweight base variant of Veo3.1 with lower computing overhead, meets basic video generation demands for low-cost bulk preview scenarios.
Il modello Gemini 3.1 Flash Lite Image è uno specialista dell’efficienza nella famiglia dei modelli di generazione di immagini, progettato per una latenza ultra-bassa e per una generazione e modifica di immagini a costi contenuti.

Core Capabilities Overview: Resolution: Up to 4K (4096×4096), on par with Pro. Reference Image Consistency: Up to 14 reference images (10 objects + 4 characters), maintaining style/character consistency. Extreme Aspect Ratios: New 1:4, 4:1, 1:8, 8:1 ratios added, suitable for long images, posters, and banners. Text Rendering: Advanced text generation, suitable for infographics and marketing poster layouts. Search Enhancement: Integrated Google Search + Image Search. Grounding: Built-in thinking process; complex prompts are reasoned before generation.
Omni is the new model that can create anything from any input — starting with video. With Omni, you can combine images, audio, video and text as input and generate high-quality videos grounded in Gemini's real-world knowledge. You can also easily edit your videos through conversation.

Gemini 3.1 Flash-Lite is a highly cost-efficient and low-latency Tier-3 model in Google’s Gemini 3 series, designed for high-volume production AI workflow where throughput and speed matter more than maximal reasoning depth. It combines a large multimodal context window with efficient inference performance at a lower cost than most flagship counterparts.

Nano Banana Pro è un modello di IA per l’assistenza di uso generale in flussi di lavoro incentrati sul testo. È adatto a prompt in stile istruzioni per generare, trasformare e analizzare contenuti con una struttura controllabile. Gli utilizzi tipici includono assistenti di chat, sintesi di documenti, domande e risposte basate sulla conoscenza e automazione dei flussi di lavoro. I dettagli tecnici pubblici sono limitati; l’integrazione è in linea con gli schemi comuni degli assistenti IA, come output strutturati, prompt arricchiti dal recupero e chiamata di strumenti o funzioni.

Gemini 3.1 Pro is the next generation in the Gemini series of models, a suite of highly-capable, natively multimodal, reasoning models. Gemini 3 Pro is now Google’s most advanced model for complex tasks, and can comprehend vast datasets, challenging problems from different information sources, including text, audio, images, video, and entire code repositories

Gemini 3 Flash is a lightweight, efficient multimodal large-scale model from Google tailored for real-world scenarios that require fast responses and low latency.

Gemini 3 Pro Preview è un modello di uso generale della famiglia Gemini, disponibile in anteprima per valutazione e prototipazione. Supporta il rispetto delle istruzioni, il ragionamento multi-turno e attività su codice e dati, con output strutturati e invocazione di strumenti/funzioni per l’automazione dei flussi di lavoro. Gli usi tipici includono assistenti di chat, sintesi e riscrittura, domande e risposte potenziate dal recupero, estrazione di dati e supporto leggero alla programmazione nelle app e nei servizi. Tra le caratteristiche tecniche principali figurano la distribuzione tramite API, risposte in streaming, controlli di sicurezza e predisposizione all’integrazione, con capacità multimodali a seconda della configurazione dell’anteprima.
Che cos'è Veo 3.1-Fast Veo 3.1-Fast è la variante di Google, ottimizzata per la velocità, della famiglia Veo 3.1 di modelli generativi di video. È esplicitamente ottimizzato per ridurre latenza e costi nella generazione di video brevi, di durata tipica dei social, pur preservando la maggiore fedeltà audiovisiva introdotta in Veo 3.1. Veo 3.1 e Veo 3.1-Fast aggiungono una generazione audio nativa più ricca, una maggiore aderenza al prompt e nuovi flussi di editing (ad esempio: interpolazione del primo/ultimo fotogramma, “ingredients to video” ed estensione della scena) rispetto alle precedenti versioni di Veo.

Veo 3.1 è l'aggiornamento incrementale ma significativo di Google alla sua famiglia Veo testo-e-immagine→video, che introduce audio nativo più ricco, output video più lunghi e più controllabili e controlli di editing più precisi e a livello di scena.
gemini-3.1-flash coming soon
coming soon
coming soon
Veo 3 di Google DeepMind rappresenta l’avanguardia della generazione da testo a video, segnando la prima volta in cui un modello di IA generativa su larga scala sincronizza perfettamente video ad alta fedeltà con l’audio corrispondente — inclusi dialoghi, effetti sonori e paesaggi sonori ambientali.
Modello di ricerca approfondita, con capacità potenziate di ricerca approfondita e di recupero dell’informazione, una scelta ideale per l’integrazione e l’analisi di conoscenze complesse.

Gemini 2.5 Flash Image (alias nano-banana), il modello di generazione e modifica di immagini più avanzato di Google. Questo aggiornamento consente di combinare più immagini in una sola, mantenere la coerenza dei personaggi per raccontare narrazioni ricche, eseguire trasformazioni mirate utilizzando il linguaggio naturale e sfruttare la conoscenza del mondo di Gemini per generare e modificare immagini.
Modello di ricerca approfondita, con capacità potenziate di ricerca approfondita e recupero delle informazioni, una scelta ideale per l’integrazione e l’analisi di conoscenze complesse.
Un modello Gemini 2.5 Flash ottimizzato per un elevato rapporto costo-efficacia e ad alto throughput. Il modello più piccolo e più conveniente in termini di costi, progettato per l'uso su larga scala.
Gemini 2.5 Pro è un modello di intelligenza artificiale fornito da Google. Dispone di capacità di elaborazione multimodale native e di una finestra di contesto ultralunga fino a 1 milione di token, offrendo un supporto potente e senza precedenti per attività complesse con sequenze lunghe. Secondo i dati di Google, Gemini 2.5 Pro offre prestazioni particolarmente elevate nelle attività complesse. Questo modello supporta una lunghezza massima del contesto di 1,048,576 token.
Gemini 2.5 Flash è un modello di intelligenza artificiale sviluppato da Google, progettato per offrire soluzioni rapide ed economicamente vantaggiose per gli sviluppatori, soprattutto per applicazioni che richiedono capacità di inferenza avanzate. Secondo l’annuncio di anteprima di Gemini 2.5 Flash, il modello è stato rilasciato in anteprima il 17 aprile 2025, supporta input multimodale e dispone di una finestra di contesto da 1 milione di token. Questo modello supporta una lunghezza massima del contesto di 65,536 token.