Gemini 3 Pro (Preview) — Gemini 3 тобына жататын, Google/DeepMind ұсынған ең жаңа флагмандық көпмодальды пайымдау моделі. Ол олардың «бүгінге дейінгі ең ақылды моделі» ретінде позицияланады және терең пайымдауға, агенттік жұмыс процестеріне, жетілдірілген кодтауға және ұзақ контексті көпмодальды түсінуге (мәтін, кескіндер, аудио, видео, код және құрал интеграциялары) арналған.
Негізгі мүмкіндіктер
- Модальдар: Мәтін, кескін, видео, аудио, PDF файлдары (және құрылымданған құрал шығыстары).
- Агенттік/құралдар: Кіріккен функция шақыру, search-as-tool, код орындау, URL контексті және көпқадамды агенттерді оркестрациялауды қолдау. Thought-signature тетігі шақырулар арасында көпқадамды пайымдауды сақтайды.
- Кодтау және “vibe coding”: Фронт-энд генерациясына, интерактивті UI генерациясына және агенттік кодтауға оңтайландырылған (Google хабарлаған тиісті көшбасшылар тізімдерінде алда). Бұл олардың осы уақытқа дейінгі ең қуатты “vibe-coding” моделі ретінде ұсынылады.
- Жаңа әзірлеуші басқарымдары:
thinking_level(low|high) — құн/кідіріс пен пайым тереңдігі арасындағы компромисті реттеу үшін, жәнеmedia_resolution— әрбір кескін не видео кадры бойынша көпмодальды айқындықты басқару үшін. Бұлар өнімділік, кідіріс және құн арасындағы теңгерімді табуға көмектеседі.
Бенчмарк көрсеткіштері
- Gemini3Pro LMARE-де 1501 балмен бірінші орынға шықты, Grok-4.1-thinking-тің 1484 ұпайынан асып, сондай-ақ Claude Sonnet 4.5 пен Opus 4.1-ді басып озды.
- Сондай-ақ WebDevArena бағдарламалау аренасында 1487 балмен бірінші орын алды.
- Humanity’s Last Exam академиялық пайымдауында 37.5% (құралсыз) көрсетті; GPQA Diamond ғылымында — 91.9%; MathArena Apex математика сайысында — 23.4%, жаңа рекорд орнатты.
- Көпмодальды мүмкіндіктерде MMMU-Pro бойынша — 81%; ал Video-MMMU видео түсінуінде — 87.6%.

Техникалық деректер мен архитектура
- “Thinking level” параметрі: Gemini 3 әзірлеушілерге ішкі пайымдау тереңдігін кідіріс/құнға қарсы теңгеруге мүмкіндік беретін
thinking_levelбасқарымын ашады. Модельthinking_level-ді қадамдап ішкі пайымдауға берілетін салыстырмалы лимит ретінде қарайды, қатаң токен кепілдігі ретінде емес. Әдетте Pro үшін әдепкі мәні —high. Бұл көпқадамды жоспарлау мен ой тізбегінің тереңдігін баптауға арналған әзірлеушілерге арналған айқын жаңа басқарым. - Құрылымданған шығыстар және құралдар: Модель құрылымданған JSON шығыстарын қолдайды және кіріккен құралдармен (Google Search grounding, URL контексті, код орындау және т.б.) біріктіруге болады. Құрылымданған-шығыс+құралдар мүмкіндіктерінің кейбірі тек
gemini-3-pro-previewүшін preview режимінде қолжетімді. - Көпмодальды және агенттік интеграциялар: Gemini 3 Pro агенттік жұмыс процестері үшін арнайы жасалған (құралдар + код/терминал/браузер бойынша бірнеше агент).
Шектеулер және белгілі ескертпелер
- Дәлдік мінсіз емес — галлюцинациялар әлі де мүмкін. Google мәлімдеген дәлдік жақсартуларына қарамастан, жоғары тәуекел салаларында (құқық, медицина, қаржы) негізделген валидация және адам тексеруі әлі де қажет.
- Ұзақ контексттегі өнімділік тапсырмаға қарай өзгереді. 1M енгізу терезесін қолдау — нақты мүмкіндік, бірақ өте ұзын жағдайларда кейбір бенчмарктерде эмпирикалық тиімділік төмендеуі мүмкін (кейбір ұзақ-контекст тесттерінде 1M-де нүктелік құлдыраулар байқалды).
- Құн мен кідіріс арасындағы компромистер. Үлкен контексттер мен жоғары
thinking_levelбаптаулары есептеуді, кідірісті және құнын арттырады; баға деңгейлері токен көлеміне негізделеді. Құнды басқару үшінthinking_levelжәне бөліктеу стратегияларын қолданыңыз. - Қауіпсіздік және контент сүзгілері. Google қауіпсіздік саясаттары мен модерация қабаттарын қолдануды жалғастыруда; белгілі бір контент пен әрекеттер шектеулі қалады немесе бас тарту режимдерін іске қосады.
Gemini 3 Pro Preview басқа үздік модельдермен салыстыру
Жоғары деңгейлі салыстыру (preview → сапалық):
Gemini 2.5 Pro-мен салыстырғанда: Пайымдау, агенттік құрал қолдану және көпмодальды интеграцияда секірісті жақсартулар; әлдеқайда үлкен контекстті өңдеу және ұзақ мәтінді жақсы түсіну. DeepMind академиялық пайымдау, кодтау және көпмодальды тапсырмалар бойынша тұрақты өсім көрсетеді.
GPT-5.1 және Claude Sonnet 4.5-пен салыстырғанда (есеп бойынша): Google/DeepMind ұсынған бенчмарк жиынтығында Gemini 3 Pro агенттік, көпмодальды және ұзақ контекст метрикаларының бірқатарында алда ретінде көрсетіледі (қараңыз: Terminal-Bench, MMMU-Pro, AIME). Салыстырмалы нәтижелер тапсырмаға байланысты өзгереді.
Әдеттегі және жоғары құндылықтағы қолдану сценарийлері
- Үлкен құжат/кітапты қысқаша мазмұндау және Q&A: ұзақ контекст қолдауы оны құқықтық, зерттеу және сәйкестік командалары үшін тартымды етеді.
- Репо ауқымында кодты түсіну және генерациялау: кодтау құрал тізбектерімен интеграция және жақсартылған пайым ірі код базаларын рефакторлеуге және кодты автоматты шолуға көмектеседі.
- Көпмодальды өнім ассистенттері: кескін + мәтін + аудио жұмыс ағындары (скриншоттар, қоңырау үзінділері және құжаттарды қабылдайтын қолдау қызметі).
- Медиа генерациясы және өңдеу (фото → видео): Gemini отбасының бұрынғы мүмкіндіктеріне енді Veo / Flow-стиліндегі фото→видео қабілеттері кіреді; preview прототиптер мен медиа жұмыс ағындары үшін тереңірек мультимедиа генерациясын меңзейді.