Lightweight base variant of Veo3.1 with lower computing overhead, meets basic video generation demands for low-cost bulk preview scenarios.
Gemini 3.1 Flash Lite Image model adalah pakar efisiensi dalam keluarga model pembuatan gambar, dirancang untuk latensi ultra rendah serta pembuatan dan modifikasi gambar yang hemat biaya.

Core Capabilities Overview: Resolution: Up to 4K (4096×4096), on par with Pro. Reference Image Consistency: Up to 14 reference images (10 objects + 4 characters), maintaining style/character consistency. Extreme Aspect Ratios: New 1:4, 4:1, 1:8, 8:1 ratios added, suitable for long images, posters, and banners. Text Rendering: Advanced text generation, suitable for infographics and marketing poster layouts. Search Enhancement: Integrated Google Search + Image Search. Grounding: Built-in thinking process; complex prompts are reasoned before generation.
Omni is the new model that can create anything from any input — starting with video. With Omni, you can combine images, audio, video and text as input and generate high-quality videos grounded in Gemini's real-world knowledge. You can also easily edit your videos through conversation.

Gemini 3.1 Flash-Lite is a highly cost-efficient and low-latency Tier-3 model in Google’s Gemini 3 series, designed for high-volume production AI workflow where throughput and speed matter more than maximal reasoning depth. It combines a large multimodal context window with efficient inference performance at a lower cost than most flagship counterparts.

Nano Banana Pro adalah model AI untuk asistensi serbaguna dalam alur kerja yang berfokus pada teks. Model ini cocok untuk prompting bergaya instruksi guna menghasilkan, mentransformasi, dan menganalisis konten dengan struktur yang dapat dikendalikan. Penggunaan umum mencakup asisten percakapan, peringkasan dokumen, tanya jawab pengetahuan, dan otomatisasi alur kerja. Rincian teknis publik terbatas; integrasinya selaras dengan pola umum asisten AI seperti output terstruktur, prompt yang diperkuat dengan retrieval, serta pemanggilan alat atau fungsi.

Gemini 3.1 Pro is the next generation in the Gemini series of models, a suite of highly-capable, natively multimodal, reasoning models. Gemini 3 Pro is now Google’s most advanced model for complex tasks, and can comprehend vast datasets, challenging problems from different information sources, including text, audio, images, video, and entire code repositories

Gemini 3 Flash is a lightweight, efficient multimodal large-scale model from Google tailored for real-world scenarios that require fast responses and low latency.

Gemini 3 Pro Preview adalah model serbaguna dalam keluarga Gemini, tersedia dalam pratinjau untuk evaluasi dan pembuatan prototipe. Model ini mendukung mengikuti instruksi, penalaran multi-putaran, serta tugas terkait kode dan data, dengan keluaran terstruktur dan pemanggilan alat/fungsi untuk otomasi alur kerja. Penggunaan umum mencakup asisten percakapan, peringkasan dan penulisan ulang, QA berbantuan retrieval, ekstraksi data, dan bantuan pengodean ringan di berbagai aplikasi dan layanan. Sorotan teknis mencakup penerapan berbasis API, respons streaming, kontrol keamanan, dan kesiapan integrasi, dengan kapabilitas multimodal bergantung pada konfigurasi pratinjau.
Apa itu Veo 3.1-Fast Veo 3.1-Fast adalah varian milik Google yang dioptimalkan untuk kecepatan dari keluarga model video generatif Veo 3.1. Model ini disetel secara khusus untuk mengurangi latensi dan biaya dalam pembuatan video pendek dengan durasi khas media sosial, sambil mempertahankan peningkatan fidelitas audiovisual yang diperkenalkan di Veo 3.1. Veo 3.1 dan Veo 3.1-Fast menambahkan kemampuan pembuatan audio native yang lebih kaya, kepatuhan terhadap prompt yang lebih kuat, serta alur penyuntingan baru (misalnya: interpolasi frame pertama/terakhir, “ingredients to video”, dan perluasan adegan) dibandingkan rilis Veo sebelumnya.

Veo 3.1 adalah pembaruan dari Google yang bertahap namun signifikan untuk keluarga Veo teks-dan-gambar→video, menambahkan audio bawaan yang lebih kaya, keluaran video yang lebih panjang dan lebih dapat dikendalikan, serta pengeditan yang lebih presisi dan kontrol pada tingkat adegan.
gemini-3.1-flash coming soon
coming soon
coming soon
Veo 3 dari Google DeepMind mewakili teknologi terdepan dalam pembuatan video dari teks, menandai untuk pertama kalinya sebuah model AI generatif skala besar mampu menyinkronkan secara mulus video berkualitas tinggi dengan audio pendamping—termasuk dialog, efek suara, dan lanskap suara ambient.
Model pencarian mendalam, dengan kemampuan pencarian mendalam dan temu kembali informasi yang ditingkatkan, merupakan pilihan ideal untuk integrasi dan analisis pengetahuan yang kompleks.

Gemini 2.5 Flash Image (aka nano-banana) adalah model pembuatan dan pengeditan gambar paling canggih dari Google. Pembaruan ini memungkinkan Anda menggabungkan beberapa gambar menjadi satu, mempertahankan konsistensi karakter untuk menyampaikan narasi yang kaya, melakukan transformasi terarah menggunakan bahasa alami, serta memanfaatkan pengetahuan dunia Gemini untuk menghasilkan dan mengedit gambar.
Model pencarian mendalam, dengan kemampuan pencarian mendalam dan temu kembali informasi yang ditingkatkan, merupakan pilihan ideal untuk integrasi dan analisis pengetahuan yang kompleks.
Model Gemini 2.5 Flash yang dioptimalkan untuk efisiensi biaya tinggi dan throughput tinggi. Model terkecil, paling hemat biaya, dirancang untuk penggunaan skala besar.
Gemini 2.5 Pro adalah model kecerdasan buatan yang disediakan oleh Google. Model ini memiliki kemampuan pemrosesan multimodal bawaan serta jendela konteks ultra-panjang hingga 1 juta token, sehingga memberikan dukungan yang sangat kuat dan belum pernah ada sebelumnya bagi tugas-tugas kompleks dengan urutan panjang. Menurut data Google, Gemini 2.5 Pro berkinerja sangat baik dalam tugas-tugas kompleks. Model ini mendukung panjang konteks maksimum sebesar 1,048,576 token.
Gemini 2.5 Flash adalah model AI yang dikembangkan oleh Google, yang dirancang untuk menyediakan solusi cepat dan hemat biaya bagi para pengembang, terutama untuk aplikasi yang memerlukan kapabilitas Inference yang ditingkatkan. Menurut pengumuman pratinjau Gemini 2.5 Flash, model ini dirilis dalam pratinjau pada 17 April 2025, mendukung input Multimodal, dan memiliki jendela konteks sebesar 1 juta token. Model ini mendukung panjang konteks maksimum sebesar 65,536 token.