Технические характеристики Gemini 3.6 Flash
| Пункт | Gemini 3.6 Flash |
|---|---|
| Провайдер | Google DeepMind |
| Идентификатор модели | gemini-3.6-flash |
| Семейство моделей | Gemini 3.x |
| Доступность | Общая доступность (GA) |
| Типы ввода | Текст, Изображение, Видео, Аудио, PDF |
| Типы вывода | Текст |
| Контекстное окно | 1,048,576 токенов |
| Максимальный вывод | 65,536 токенов |
| Thinking | Поддерживается (medium / high) |
| Function calling | Yes |
| Code execution | Yes |
| File Search | Yes |
| URL Context | Yes |
| Search Grounding | Yes |
| Computer Use | Preview |
| Structured Output | Yes |
| Caching | Supported |
Источник: документация Google Gemini API.
Что такое Gemini 3.6 Flash?
Gemini 3.6 Flash — новейшая производственная модель серии Flash от Google, разработанная для предоставления интеллекта на передовом уровне при сохранении низкой задержки и экономичности, которыми известна серия Flash. Она оптимизирована для программирования, мультимодального понимания, рассуждения и агентных рабочих процессов.
По сравнению с Gemini 3.5 Flash модель улучшает качество генерации кода, точность рассуждений, использование инструментов и эффективность по токенам, одновременно поддерживая огромное контекстное окно в 1 миллион токенов. Google позиционирует её как модель по умолчанию для разработчиков, создающих AI-агентов и сложные системы автоматизации.
Основные возможности Gemini 3.6 Flash
- Поддержка длинного контекста на 1M токенов.
- Нативные мультимодальные входы: текст, изображения, видео, аудио и PDF-документы.
- Значительные улучшения в генерации кода и задачах программной инженерии.
- Встроенная поддержка Function Calling, File Search, URL Context, Search Grounding и Computer Use.
- Более эффективная по токенам, чем Gemini 3.5 Flash, снижает стоимость инференса при более высоком качестве.
- Спроектирована для многошаговых AI-агентов и автономных рабочих процессов.
Производительность в бенчмарках
Google сообщает, что Gemini 3.6 Flash обеспечивает более сильную производительность в программировании, рассуждениях и мультимодальных задачах, чем Gemini 3.5 Flash, при этом использует значительно меньше токенов в выводе. Компания отмечает улучшения на внутренних бенчмарках по коду и агентным сценариям и заявляет, что модель может снизить использование токенов вывода до 65% на некоторых оценках по программной инженерии, таких как DeepSWE, уменьшая общие затраты на инференс. Для этого релиза Google не опубликовала полноценные публичные таблицы бенчмарков (например, MMLU, GPQA, SWE-bench Verified).

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Аспект | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Релиз | 21 июля 2026 (GA) | Ранее в 2026 году | ~февраль 2026 (предпросмотр) |
| Позиционирование | Эффективная «рабочая лошадка» для агентов, кодинга, мультимодальности | Предыдущая агентная Flash-модель | Продвинутые рассуждения уровня Pro |
| Ценообразование (на 1M токенов) | Ввод: $1.50Вывод: $7.50 | Ввод: $1.50Вывод: $9.00 | Выше (например, ~$2 ввод / $12 вывод) |
| Эффективность по токенам | На 17% меньше токенов вывода по сравнению с 3.5 Flash; меньше шагов/вызовов инструментов | Базовый уровень | Менее эффективна в агентных рабочих процессах |
| Скорость | Высокая (семейство Flash) | Высокая | Медленнее, чем модели Flash |
| Контекстное окно | 1M токенов | 1M токенов | Вероятно аналогично |
| Сильные стороны | Кодинг, работа с знаниями, мультимодальность (диаграммы/документы), computer use, агентная эффективность | Хороший баланс агентности и кодинга | Более глубокие рассуждения на сложных задачах |
Краткое резюме
- 3.6 Flash → Лучший общий выбор для большинства пользователей сейчас: быстрее, дешевле на задачу, более эффективна, чем 3.5 Flash, и превосходит 3.1 Pro на многих практических/агентных бенчмарках.
- 3.5 Flash → Крепкий предшественник; всё ещё способен, но уступает 3.6 Flash (выше стоимость токенов вывода, меньше эффективность).
- 3.1 Pro → Сильнее в некоторых сценариях глубоких рассуждений, но медленнее, дороже и в целом уступает новым моделям Flash по скорости, эффективности и многим реалистичным/агентным задачам.
Ограничения
- Генерация изображений напрямую не поддерживается.
- Генерация аудио недоступна.
- Computer Use остаётся в статусе Preview.
- Некоторые устаревшие параметры генерации (
temperature,top_p,top_k) удалены из нового интерфейса API. - Лучшая производительность достигается через последний Gemini Interactions API.
Как получить доступ к Gemini 3.6 Flash API
Шаг 1: Получите доступ к API
Войдите в cometAPI. Если вы ещё не наш пользователь, сначала зарегистрируйтесь. Авторизуйтесь в вашей консоли CometAPI. Получите ключ доступа (API key) интерфейса. Нажмите “Add Token” в разделе API token в личном кабинете, получите ключ токена: sk-xxxxx и отправьте.

Шаг 2: Отправьте запросы к Gemini 3.6 Flash API
Выберите эндпоинты “ gemini-3.6-flash" "gemini-3.6-flash-thinking” для отправки API-запроса и задайте тело запроса. Метод и тело запроса берутся из нашей документации по API на сайте. На нашем сайте также доступен тест в Apifox для вашего удобства. Замените <YOUR_API_KEY> на ваш фактический ключ CometAPI из учётной записи. base url is Gemini Generating Content
Вставьте ваш вопрос или запрос в поле content — именно на него ответит модель. Обработайте ответ API, чтобы получить сгенерированный результат.
Шаг 3: Обработка ответов
API возвращает структурированные ответы-кандидаты, включая сгенерированный текст, цитаты, метаданные по безопасности и необязательные результаты инструментов.