Gemini 3 Pro (Preview), Gemini 3 ailesindeki Google/DeepMind’in en yeni amiral gemisi çok modlu akıl yürütme modelidir. En “şimdiye kadarki en zeki modeli” olarak konumlandırılan bu model, derin akıl yürütme, ajanik iş akışları, ileri düzey kodlama ve uzun bağlamlı çok modlu anlama (metin, görseller, ses, video, kod ve araç entegrasyonları) için tasarlanmıştır.
Temel özellikler
- Modaliteler: Metin, görsel, video, ses, PDF’ler (ve yapılandırılmış araç çıktıları).
- Ajanik/araçlar: Yerleşik fonksiyon çağırma, araç olarak arama, kod yürütme, URL bağlamı ve çok adımlı ajanları orkestre etmek için destek. “Thought-signature” mekanizması, çağrılar arasında çok adımlı akıl yürütmeyi korur.
- Kodlama ve “vibe coding”: Ön uç üretimi, etkileşimli UI üretimi ve ajanik kodlama için optimize edilmiştir (Google’ın bildirdiği ilgili liderlik tablolarında zirvededir). Şimdiye kadarki en güçlü “vibe-coding” modelleri olarak pazarlanmaktadır.
- Yeni geliştirici denetimleri:
thinking_level(low|high) ile maliyet/gecikme ve akıl yürütme derinliği arasında seçim yapma, vemedia_resolutionile her görsel veya video karesi için çok modlu doğruluğu kontrol etme. Bunlar performans, gecikme ve maliyet arasında denge kurmaya yardımcı olur.
Kıyaslama performansı
- Gemini3Pro, LMARE’de 1501 puanla birinciliği elde etti; Grok-4.1-thinking’in 1484 puanını geride bıraktı ve ayrıca Claude Sonnet 4.5 ile Opus 4.1’in önünde yer aldı.
- WebDevArena programlama arenasında da 1487 puanla birincilik elde etti.
- Humanity’s Last Exam akademik muhakemesinde 37.5% (araçsız); GPQA Diamond biliminde 91.9%; MathArena Apex matematik yarışmasında 23.4% başarım elde ederek yeni bir rekor kırdı.
- Çok modlu yeteneklerde, MMMU-Pro’da 81%; Video-MMMU video anlama alanında 87.6% elde etti.

Teknik ayrıntılar ve mimari
- “Thinking level” parametresi: Gemini 3, geliştiricilerin içsel akıl yürütme derinliği ile gecikme/maliyet arasında seçim yapmasına olanak veren
thinking_levelkontrolünü sunar. Model,thinking_level’ı kesin bir token garantisi yerine içsel çok adımlı akıl yürütme için göreli bir tahsis olarak ele alır. Varsayılan, Pro için genelliklehigh’dır. Bu, geliştiricilerin çok adımlı planlama ve chain-of-thought derinliğini ayarlaması için açık bir yeni denetimdir. - Yapılandırılmış çıktılar ve araçlar: Model, yapılandırılmış JSON çıktıları destekler ve yerleşik araçlarla (Google Search dayandırma, URL bağlamı, kod yürütme vb.) birlikte çalışabilir. Bazı structured-output+tools özellikleri yalnızca
gemini-3-pro-previewiçin önizlemededir. - Çok modlu ve ajanik entegrasyonlar: Gemini 3 Pro, ajanik iş akışları (araç kullanımı + kod/terminaller/tarayıcı üzerinde birden çok ajan) için özellikle inşa edilmiştir.
Sınırlamalar ve bilinen uyarılar
- Mükemmel olgusallık yok — halüsinasyonlar mümkün. Google’ın belirttiği güçlü olgusallık iyileştirmelerine rağmen, yüksek riskli alanlarda (hukuk, tıp, finans) doğrulama ve insan incelemesi hâlâ gereklidir.
- Uzun bağlam performansı göreve göre değişir. 1M giriş penceresi desteği sert bir yetenek olsa da, aşırı uzunluklarda bazı kıyaslamalarda ampirik etkinlik düşebilir (bazı uzun bağlam testlerinde 1M’de noktasal düşüşler gözlenmiştir).
- Maliyet ve gecikme dengeleri. Büyük bağlamlar ve daha yüksek
thinking_levelayarları hesaplama, gecikme ve maliyeti artırır; fiyatlandırma katmanları token hacimlerine göre uygulanır. Maliyetleri yönetmek içinthinking_levelve parçalama stratejilerini kullanın. - Güvenlik ve içerik filtreleri. Google güvenlik politikaları ve moderasyon katmanlarını uygulamaya devam etmektedir; belirli içerikler ve eylemler kısıtlanmıştır veya reddetme modlarını tetikleyebilir.
Gemini 3 Pro Preview diğer üst düzey modellerle nasıl karşılaştırılır
Yüksek düzey karşılaştırma (önizleme → nitel):
Gemini 2.5 Pro’ya karşı: Akıl yürütme, ajanik araç kullanımı ve çok modlu entegrasyonda basamak niteliğinde iyileştirmeler; çok daha büyük bağlam işleme ve uzun biçimli anlama. DeepMind, akademik muhakeme, kodlama ve çok modlu görevlerde tutarlı kazanımlar gösteriyor.
GPT-5.1 ve Claude Sonnet 4.5’e karşı (bildirildiği üzere): Google/DeepMind’ın kıyas setinde Gemini 3 Pro, çeşitli ajanik, çok modlu ve uzun bağlam metriklerinde önde sunulmaktadır (bkz. Terminal-Bench, MMMU-Pro, AIME). Karşılaştırmalı sonuçlar göreve göre değişir.
Tipik ve yüksek değerli kullanım senaryoları
- Büyük belge/kitap özetleme ve soru-cevap: Uzun bağlam desteği, hukuk, araştırma ve uyum ekipleri için cazip kılar.
- Depo ölçeğinde kod anlama ve üretimi: Kodlama araç zincirleriyle entegrasyon ve geliştirilmiş akıl yürütme, büyük kod tabanlarında yeniden düzenleme ve otomatik kod inceleme iş akışlarına yardımcı olur.
- Çok modlu ürün asistanları: Görsel + metin + ses iş akışları (ekran görüntüleri, çağrı parçaları ve belgeleri alan müşteri destek sistemleri).
- Medya üretimi ve düzenleme (fotoğraf → video): Gemini ailesinin önceki özellikleri artık Veo / Flow tarzı fotoğraf→video yeteneklerini içeriyor; önizleme, prototipler ve medya iş akışları için daha derin çoklu ortam üretimine işaret ediyor.