Lightweight base variant of Veo3.1 with lower computing overhead, meets basic video generation demands for low-cost bulk preview scenarios.
Gemini 3.1 Flash Lite Image model は、画像生成ファミリーにおける効率のエキスパートで、超低レイテンシかつ費用対効果の高い画像の生成および編集のために設計されています。

Core Capabilities Overview: Resolution: Up to 4K (4096×4096), on par with Pro. Reference Image Consistency: Up to 14 reference images (10 objects + 4 characters), maintaining style/character consistency. Extreme Aspect Ratios: New 1:4, 4:1, 1:8, 8:1 ratios added, suitable for long images, posters, and banners. Text Rendering: Advanced text generation, suitable for infographics and marketing poster layouts. Search Enhancement: Integrated Google Search + Image Search. Grounding: Built-in thinking process; complex prompts are reasoned before generation.
Omni is the new model that can create anything from any input — starting with video. With Omni, you can combine images, audio, video and text as input and generate high-quality videos grounded in Gemini's real-world knowledge. You can also easily edit your videos through conversation.

Gemini 3.1 Flash-Lite is a highly cost-efficient and low-latency Tier-3 model in Google’s Gemini 3 series, designed for high-volume production AI workflow where throughput and speed matter more than maximal reasoning depth. It combines a large multimodal context window with efficient inference performance at a lower cost than most flagship counterparts.

Nano Banana Pro は、テキスト中心のワークフローにおける汎用支援向けのAIモデルです。制御可能な構造でコンテンツを生成・変換・分析するためのインストラクション型プロンプトに適しています。典型的な用途には、チャットアシスタント、文書要約、ナレッジQA、ワークフロー自動化が含まれます。公開されている技術的詳細は限られていますが、統合は構造化出力、検索拡張型プロンプト、ツールまたは関数呼び出しといった一般的なAIアシスタントのパターンに整合します。

Gemini 3.1 Pro is the next generation in the Gemini series of models, a suite of highly-capable, natively multimodal, reasoning models. Gemini 3 Pro is now Google’s most advanced model for complex tasks, and can comprehend vast datasets, challenging problems from different information sources, including text, audio, images, video, and entire code repositories

Gemini 3 Flash is a lightweight, efficient multimodal large-scale model from Google tailored for real-world scenarios that require fast responses and low latency.

Gemini 3 Pro Preview は Gemini ファミリーに属する汎用モデルで、評価およびプロトタイピング向けのプレビューとして提供されています。指示追従、マルチターン推論、コードおよびデータ関連のタスクをサポートし、構造化出力やワークフロー自動化のためのツール/関数呼び出しに対応しています。主なユースケースには、チャットアシスタント、要約および書き換え、検索拡張型QA、データ抽出、アプリやサービス横断の軽量なコーディング支援などが含まれます。技術的な特長として、APIベースのデプロイ、ストリーミング応答、安全対策、統合準備性が挙げられ、プレビュー構成に応じてマルチモーダル機能にも対応します。
Veo 3.1-Fast とは Veo 3.1-Fast は、生成動画モデルである Veo 3.1 ファミリーの Google による速度最適化版です。ソーシャルメディア向けの短尺動画生成におけるレイテンシとコストを削減するよう明示的にチューニングされており、同時に Veo 3.1 で導入された映像・音声の忠実度向上を維持します。Veo 3.1 および Veo 3.1-Fast は、従来の Veo リリースと比べて、より豊かなネイティブ音声生成、プロンプトへの追従性の強化、そして新しい編集フロー(例: 先頭/最終フレーム補間、“ingredients to video”、シーン拡張)を追加しています。

Veo 3.1 は、Google の Veo テキストおよび画像→動画ファミリーに対する段階的だが重要なアップデートで、より豊かなネイティブオーディオ、より長くより制御しやすい動画出力、そしてより細かな編集やシーンレベルのコントロールを追加します。
gemini-3.1-flash coming soon
coming soon
coming soon
Google DeepMind の Veo 3 はテキストから動画への生成の最先端を体現しており、高忠実度の映像と付随音声(対話、効果音、環境音)をシームレスに同期できる大規模生成AIモデルとしては初めてです。
強化された深層検索および情報検索機能を備えた深層検索モデルは、複雑な知識の統合と分析に最適な選択肢です。

Gemini 2.5 Flash Image(別名: nano-banana)は、Google の最先端の画像生成・編集モデルです。このアップデートにより、複数の画像を1つにブレンドし、キャラクターの一貫性を維持して豊かなストーリーを語り、自然言語でターゲットを絞った変換を行い、Gemini の世界知識を活用して画像を生成・編集できるようになります。
ディープサーチモデルは、強化されたディープサーチおよび情報検索機能を備え、複雑な知識の統合と分析に最適な選択肢です。
高い費用対効果と高スループットに最適化された Gemini 2.5 Flash モデル。 大規模利用向けに設計された、最小で最も費用対効果の高いモデル。
Gemini 2.5 Pro は Google が提供する人工知能モデルです。ネイティブなマルチモーダル処理能力と最大 1 million tokens の超長コンテキストウィンドウを備え、複雑な長シーケンスのタスクに対して前例のない強力なサポートを提供します。Google のデータによれば、Gemini 2.5 Pro は複雑なタスクで特に優れた性能を発揮します。このモデルは最大 1,048,576 tokens のコンテキスト長をサポートしています。
Gemini 2.5 Flash は Google が開発した AI モデルで、特に強化された推論機能を必要とするアプリケーション向けに、開発者に高速かつコスト効率の高いソリューションを提供するよう設計されています。Gemini 2.5 Flash のプレビュー発表によれば、このモデルは 2025年4月17日にプレビューとしてリリースされ、マルチモーダル入力をサポートし、コンテキストウィンドウは100万トークンです。このモデルは最大コンテキスト長として65,536トークンをサポートします。