Lightweight base variant of Veo3.1 with lower computing overhead, meets basic video generation demands for low-cost bulk preview scenarios.
O modelo Gemini 3.1 Flash Lite Image é um especialista em eficiência na família de geração de imagens, projetado para gerar e modificar imagens com latência ultrabaixa e excelente relação custo-benefício.

Core Capabilities Overview: Resolution: Up to 4K (4096×4096), on par with Pro. Reference Image Consistency: Up to 14 reference images (10 objects + 4 characters), maintaining style/character consistency. Extreme Aspect Ratios: New 1:4, 4:1, 1:8, 8:1 ratios added, suitable for long images, posters, and banners. Text Rendering: Advanced text generation, suitable for infographics and marketing poster layouts. Search Enhancement: Integrated Google Search + Image Search. Grounding: Built-in thinking process; complex prompts are reasoned before generation.
Omni is the new model that can create anything from any input — starting with video. With Omni, you can combine images, audio, video and text as input and generate high-quality videos grounded in Gemini's real-world knowledge. You can also easily edit your videos through conversation.

Gemini 3.1 Flash-Lite is a highly cost-efficient and low-latency Tier-3 model in Google’s Gemini 3 series, designed for high-volume production AI workflow where throughput and speed matter more than maximal reasoning depth. It combines a large multimodal context window with efficient inference performance at a lower cost than most flagship counterparts.

Nano Banana Pro é um modelo de IA para assistência de uso geral em fluxos de trabalho centrados em texto. É adequado para prompts no estilo de instruções para gerar, transformar e analisar conteúdo com estrutura controlável. Os usos típicos incluem assistentes de chat, resumo de documentos, QA de conhecimento e automação de fluxos de trabalho. Os detalhes técnicos públicos são limitados; a integração se alinha a padrões comuns de assistentes de IA, como saídas estruturadas, prompts com recuperação aumentada e chamada de ferramentas ou funções.

Gemini 3.1 Pro is the next generation in the Gemini series of models, a suite of highly-capable, natively multimodal, reasoning models. Gemini 3 Pro is now Google’s most advanced model for complex tasks, and can comprehend vast datasets, challenging problems from different information sources, including text, audio, images, video, and entire code repositories

Gemini 3 Flash is a lightweight, efficient multimodal large-scale model from Google tailored for real-world scenarios that require fast responses and low latency.

O Gemini 3 Pro Preview é um modelo de uso geral da família Gemini, disponível em prévia para avaliação e prototipagem. Ele oferece suporte ao seguimento de instruções, raciocínio em múltiplas etapas e tarefas com código e dados, com saídas estruturadas e invocação de ferramentas/funções para automação de fluxos de trabalho. Os usos típicos incluem assistentes de chat, resumo e reescrita, perguntas e respostas aprimoradas por recuperação, extração de dados e ajuda leve de programação em aplicativos e serviços. Os destaques técnicos incluem implantação baseada em API, respostas em streaming, controles de segurança e prontidão para integração, com recursos multimodais dependendo da configuração da prévia.
O que é o Veo 3.1-Fast O Veo 3.1-Fast é a variante otimizada para velocidade da família Veo 3.1 de modelos generativos de vídeo do Google. Ele é explicitamente ajustado para reduzir a latência e o custo na geração de vídeos curtos, de duração típica de redes sociais, preservando a fidelidade audiovisual aprimorada introduzida no Veo 3.1. Veo 3.1 e Veo 3.1-Fast adicionam uma geração de áudio nativa mais rica, maior aderência ao prompt e novos fluxos de edição (por exemplo: interpolação do primeiro/último quadro, “ingredientes para vídeo” e extensão de cena) em comparação com versões anteriores do Veo.

Veo 3.1 é a atualização incremental, porém significativa, da família Veo de texto e imagem→vídeo do Google, adicionando áudio nativo mais rico, saídas de vídeo mais longas e mais controláveis e controles de edição e em nível de cena mais refinados.
gemini-3.1-flash coming soon
coming soon
coming soon
O Veo 3 da Google DeepMind representa o estado da arte da geração de texto para vídeo, marcando a primeira vez que um modelo de IA generativa em larga escala sincroniza perfeitamente vídeo de alta fidelidade com áudio correspondente — incluindo diálogos, efeitos sonoros e paisagens sonoras ambientais.
Modelo de busca profunda, com capacidades aprimoradas de busca profunda e recuperação de informações, uma escolha ideal para a integração e análise de conhecimento complexo.

Gemini 2.5 Flash Image (também conhecido como nano-banana), o modelo de geração e edição de imagens mais avançado do Google. Esta atualização permite que você mescle várias imagens em uma única, mantenha a consistência dos personagens para contar histórias ricas, realize transformações específicas usando linguagem natural e aproveite o conhecimento de mundo do Gemini para gerar e editar imagens.
Modelo de pesquisa profunda, com capacidades aprimoradas de pesquisa profunda e recuperação de informação, uma escolha ideal para integração e análise de conhecimentos complexos.
Um modelo Gemini 2.5 Flash otimizado para alta relação custo-benefício e alta taxa de processamento. O menor modelo, com o melhor custo-benefício, desenvolvido para uso em larga escala.
Gemini 2.5 Pro é um modelo de inteligência artificial fornecido pelo Google. Ele possui capacidades nativas de processamento multimodal e uma janela de contexto ultralonga de até 1 milhão de tokens, oferecendo um suporte poderoso e sem precedentes para tarefas complexas e de sequências longas. Segundo dados do Google, o Gemini 2.5 Pro apresenta desempenho particularmente bom em tarefas complexas. Este modelo suporta um comprimento máximo de contexto de 1,048,576 tokens.
Gemini 2.5 Flash é um modelo de IA desenvolvido pelo Google, projetado para oferecer soluções rápidas e com bom custo-benefício para desenvolvedores, especialmente para aplicações que exigem capacidades de inferência aprimoradas. De acordo com o anúncio da prévia do Gemini 2.5 Flash, o modelo foi lançado em prévia em 17 de abril de 2025, suporta entrada multimodal e possui uma janela de contexto de 1 milhão de tokens. Este modelo suporta um comprimento máximo de contexto de 65,536 tokens.