Lightweight base variant of Veo3.1 with lower computing overhead, meets basic video generation demands for low-cost bulk preview scenarios.
Das Modell Gemini 3.1 Flash Lite Image ist ein Effizienzspezialist in der Modellfamilie für Bildgenerierung und wurde für ultraniedrige Latenz sowie kosteneffiziente Bildgenerierung und -bearbeitung entwickelt.

Core Capabilities Overview: Resolution: Up to 4K (4096×4096), on par with Pro. Reference Image Consistency: Up to 14 reference images (10 objects + 4 characters), maintaining style/character consistency. Extreme Aspect Ratios: New 1:4, 4:1, 1:8, 8:1 ratios added, suitable for long images, posters, and banners. Text Rendering: Advanced text generation, suitable for infographics and marketing poster layouts. Search Enhancement: Integrated Google Search + Image Search. Grounding: Built-in thinking process; complex prompts are reasoned before generation.
Omni is the new model that can create anything from any input — starting with video. With Omni, you can combine images, audio, video and text as input and generate high-quality videos grounded in Gemini's real-world knowledge. You can also easily edit your videos through conversation.

Gemini 3.1 Flash-Lite is a highly cost-efficient and low-latency Tier-3 model in Google’s Gemini 3 series, designed for high-volume production AI workflow where throughput and speed matter more than maximal reasoning depth. It combines a large multimodal context window with efficient inference performance at a lower cost than most flagship counterparts.

Nano Banana Pro ist ein KI-Modell für allgemeine Unterstützung in textzentrierten Workflows. Es eignet sich für anweisungsbasiertes Prompting, um Inhalte mit kontrollierbarer Struktur zu erzeugen, zu transformieren und zu analysieren. Typische Anwendungsfälle umfassen Chat-Assistenten, Dokumentenzusammenfassungen, wissensbasiertes Question Answering (QA) und Workflow-Automatisierung. Öffentlich verfügbare technische Details sind begrenzt; die Integration orientiert sich an gängigen Mustern von KI-Assistenten wie strukturierten Ausgaben, retrieval-augmentierten Prompts sowie Tool- oder Funktionsaufrufen.

Gemini 3.1 Pro is the next generation in the Gemini series of models, a suite of highly-capable, natively multimodal, reasoning models. Gemini 3 Pro is now Google’s most advanced model for complex tasks, and can comprehend vast datasets, challenging problems from different information sources, including text, audio, images, video, and entire code repositories

Gemini 3 Flash is a lightweight, efficient multimodal large-scale model from Google tailored for real-world scenarios that require fast responses and low latency.

Gemini 3 Pro Preview ist ein Allzweckmodell aus der Gemini-Familie, das als Preview zur Evaluierung und zum Prototyping verfügbar ist. Es unterstützt das Befolgen von Anweisungen, mehrschrittiges Schlussfolgern über mehrere Runden sowie Code- und Datenaufgaben, mit strukturierten Ausgaben und Tool-/Funktionsaufrufen zur Workflow-Automatisierung. Typische Anwendungsfälle sind Chat-Assistenten, Zusammenfassung und Umformulierung, Retrieval-gestützte QA, Datenextraktion und leichtgewichtige Programmierhilfe über Apps und Dienste hinweg. Zu den technischen Highlights gehören API-basierte Bereitstellung, Streaming-Antworten, Sicherheitskontrollen und Integrationsbereitschaft, mit multimodalen Fähigkeiten je nach Preview-Konfiguration.
Was ist Veo 3.1-Fast Veo 3.1-Fast ist Googles geschwindigkeitsoptimierte Variante der Veo-3.1-Familie generativer Videomodelle. Sie ist ausdrücklich darauf abgestimmt, Latenz und Kosten bei der Erstellung kurzer Videos in Social-Media-Länge zu reduzieren, wobei die in Veo 3.1 eingeführte verbesserte audiovisuelle Wiedergabetreue erhalten bleibt. Im Vergleich zu früheren Veo-Versionen bieten Veo 3.1 und Veo 3.1-Fast eine reichhaltigere native Audiogenerierung, eine stärkere Prompt-Treue sowie neue Bearbeitungsabläufe (zum Beispiel: Interpolation des ersten/letzten Frames, "ingredients to video" und Szenenerweiterung).

Veo 3.1 ist Googles inkrementelles, aber bedeutendes Update für seine Veo-Text-und-Bild→Video-Familie, das reichhaltigeren nativen Ton, längere und besser steuerbare Videoausgaben sowie feinere Bearbeitungs- und Steuerungsmöglichkeiten auf Szenenebene hinzufügt.
gemini-3.1-flash coming soon
coming soon
coming soon
Veo 3 von Google DeepMind stellt die Speerspitze der Text-zu-Video-Generierung dar und markiert damit das erste Mal, dass ein großskaliges generatives KI-Modell Video in hoher Wiedergabetreue nahtlos mit begleitendem Audio – inklusive Dialogen, Soundeffekten und Umgebungsgeräuschen – synchronisiert.
Deep-Search-Modell mit erweiterten Deep-Search- und Information-Retrieval-Fähigkeiten – eine ideale Wahl für die Integration und Analyse komplexen Wissens.

Gemini 2.5 Flash Image (auch bekannt als nano-banana) ist Googles fortschrittlichstes Modell zur Bildgenerierung und -bearbeitung. Dieses Update ermöglicht es Ihnen, mehrere Bilder zu einem einzigen Bild zu verschmelzen, die Konsistenz von Figuren beizubehalten, um reichhaltige Geschichten zu erzählen, mithilfe natürlicher Sprache gezielte Transformationen vorzunehmen und das Weltwissen von Gemini zu nutzen, um Bilder zu generieren und zu bearbeiten.
Deep-Search-Modell mit erweiterten Deep-Search- und Information-Retrieval-Fähigkeiten, eine ideale Wahl für komplexe Wissensintegration und -analyse.
Ein optimiertes Gemini 2.5 Flash-Modell für hohe Kosteneffizienz und hohen Durchsatz. Das kleinste und kosteneffizienteste Modell, entwickelt für den Einsatz im großen Maßstab.
Gemini 2.5 Pro ist ein von Google bereitgestelltes KI-Modell. Es verfügt über native multimodale Verarbeitung und bietet mit einem ultralangen Kontextfenster von bis zu 1 Million Token eine beispiellos leistungsstarke Unterstützung für komplexe Aufgaben mit langen Sequenzen. Nach Angaben von Google schneidet Gemini 2.5 Pro insbesondere bei komplexen Aufgaben sehr gut ab. Dieses Modell unterstützt eine maximale Kontextlänge von 1,048,576 Token.
Gemini 2.5 Flash ist ein von Google entwickeltes KI-Modell, das darauf ausgelegt ist, Entwicklern schnelle und kosteneffiziente Lösungen bereitzustellen, insbesondere für Anwendungen, die erweiterte Inferenzfähigkeiten erfordern. Laut der Vorschauankündigung zu Gemini 2.5 Flash wurde das Modell am 17. April 2025 als Vorschau veröffentlicht, unterstützt multimodale Eingaben und verfügt über ein Kontextfenster von 1 Million Token. Dieses Modell unterstützt eine maximale Kontextlänge von 65,536 Token.