Spesifikasi Teknis Gemini 3.6 Flash
| Item | Gemini 3.6 Flash |
|---|---|
| Penyedia | Google DeepMind |
| ID Model | gemini-3.6-flash |
| Keluarga Model | Gemini 3.x |
| Ketersediaan | Ketersediaan Umum (GA) |
| Jenis Input | Teks, Gambar, Video, Audio, PDF |
| Jenis Output | Teks |
| Jendela Konteks | 1,048,576 tokens |
| Output Maksimum | 65,536 tokens |
| Pemikiran | Didukung (sedang / tinggi) |
| Function Calling | Ya |
| Eksekusi Kode | Ya |
| File Search | Ya |
| URL Context | Ya |
| Search Grounding | Ya |
| Computer Use | Pratinjau |
| Output Terstruktur | Ya |
| Caching | Didukung |
Sumber: Dokumentasi API Google Gemini.
Apa itu Gemini 3.6 Flash?
Gemini 3.6 Flash adalah model Flash produksi terbaru dari Google, dirancang untuk memberikan kecerdasan tingkat terdepan sambil mempertahankan latensi rendah dan efisiensi biaya yang menjadi ciri seri Flash. Model ini dioptimalkan untuk pengkodean, pemahaman multimodal, penalaran, dan alur kerja agentic.
Dibandingkan dengan Gemini 3.5 Flash, model ini meningkatkan kualitas generasi kode, akurasi penalaran, penggunaan alat, dan efisiensi token sekaligus mendukung jendela konteks 1 juta token. Google memposisikannya sebagai model andalan default bagi pengembang yang membangun agen AI dan sistem otomasi kompleks.
Fitur Utama Gemini 3.6 Flash
- Mendukung pemrosesan konteks panjang 1M-token.
- Input multimodal native termasuk teks, gambar, video, audio, dan dokumen PDF.
- Peningkatan signifikan dalam pembuatan kode dan tugas rekayasa perangkat lunak.
- Dukungan bawaan untuk Function Calling, File Search, URL Context, Search Grounding, dan Computer Use.
- Lebih efisien dalam token dibandingkan Gemini 3.5 Flash, mengurangi biaya inferensi sambil menjaga kualitas lebih tinggi.
- Dirancang untuk agen AI multi-langkah dan alur kerja otonom.
Performa Benchmark
Google melaporkan bahwa Gemini 3.6 Flash memberikan performa pengkodean, penalaran, dan multimodal yang lebih kuat daripada Gemini 3.5 Flash sambil menggunakan token keluaran yang jauh lebih sedikit. Perusahaan menyoroti peningkatan performa pada benchmark internal pengkodean dan agentic serta menyatakan bahwa model ini dapat mengurangi penggunaan token keluaran hingga 65% pada evaluasi rekayasa perangkat lunak tertentu seperti DeepSWE, menurunkan biaya inferensi keseluruhan. Google belum menerbitkan tabel benchmark publik komprehensif (misalnya, MMLU, GPQA, SWE-bench Verified) untuk rilis ini.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Aspek | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Rilis | 21 Juli 2026 (GA) | Awal 2026 | ~Feb 2026 (Pratinjau) |
| Posisi | Andalan efisien untuk agen, pengkodean, multimodal | Model Flash agentic sebelumnya | Penalaran tingkat lanjut kelas Pro |
| Harga (per 1M token) | Input: $1.50Output: $7.50 | Input: $1.50Output: $9.00 | Lebih tinggi (mis. ~$2 input / $12 output) |
| Efisiensi Token | 17% lebih sedikit token keluaran vs 3.5 Flash; lebih sedikit langkah/pemanggilan tool | Dasar | Kurang efisien dalam alur kerja agentic |
| Kecepatan | Tinggi (keluarga Flash) | Tinggi | Lebih lambat daripada model Flash |
| Jendela Konteks | 1M token | 1M token | Kemungkinan serupa |
| Keunggulan | Pengkodean, pekerjaan pengetahuan, multimodal (bagan/dokumen), computer use, efisiensi agentic | Keseimbangan agentic/pengkodean yang baik | Penalaran lebih dalam pada masalah kompleks |
Ringkasan Singkat
- 3.6 Flash → Pilihan terbaik untuk sebagian besar pengguna saat ini: lebih cepat, lebih murah per tugas, lebih efisien daripada 3.5 Flash, dan melampaui 3.1 Pro pada banyak benchmark praktis/agentic.
- 3.5 Flash → Pendahulu yang solid; masih mumpuni tetapi digantikan oleh 3.6 Flash (biaya token keluaran lebih tinggi, kurang efisien).
- 3.1 Pro → Lebih kuat pada beberapa skenario penalaran mendalam tetapi lebih lambat, lebih mahal, dan umumnya tertinggal dari model Flash terbaru dalam kecepatan, efisiensi, dan banyak tugas dunia nyata/agentic.
Keterbatasan
- Pembuatan gambar tidak didukung secara langsung.
- Pembuatan audio tidak tersedia.
- Computer Use tetap dalam Pratinjau.
- Beberapa parameter generasi lama (
temperature,top_p,top_k) telah dihapus dari antarmuka API baru. - Kinerja terbaik dicapai melalui Gemini Interactions API terbaru.
Cara Mengakses Gemini 3.6 Flash API
Langkah 1: Dapatkan Akses API
Masuk ke cometAPI. Jika Anda belum menjadi pengguna kami, silakan daftar terlebih dahulu. Masuk ke konsol CometAPI. Dapatkan kredensial akses kunci API dari antarmuka. Klik “Add Token” pada token API di pusat pribadi, dapatkan kunci token: sk-xxxxx dan kirimkan.

Langkah 2: Kirim Permintaan ke Gemini 3.6 Flash API
Pilih endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” untuk mengirim permintaan API dan atur request body. Metode permintaan dan request body diperoleh dari dokumentasi API di situs kami. Situs kami juga menyediakan uji Apifox untuk kenyamanan Anda. Ganti <YOUR_API_KEY> dengan kunci CometAPI Anda yang sebenarnya dari akun Anda. URL dasar adalah Gemini Generating Content
Masukkan pertanyaan atau permintaan Anda ke dalam field content—ini yang akan direspons oleh model. Proses respons API untuk mendapatkan jawaban yang dihasilkan.
Langkah 3: Proses Respons
API mengembalikan respons kandidat terstruktur termasuk teks yang dihasilkan, sitasi, metadata keselamatan, dan output alat opsional.