Thông số kỹ thuật của Gemini 3.6 Flash
| Mục | Gemini 3.6 Flash |
|---|---|
| Nhà cung cấp | Google DeepMind |
| ID mô hình | gemini-3.6-flash |
| Dòng mô hình | Gemini 3.x |
| Tình trạng phát hành | Phát hành chính thức (GA) |
| Kiểu đầu vào | Văn bản, Hình ảnh, Video, Âm thanh, PDF |
| Kiểu đầu ra | Văn bản |
| Cửa sổ ngữ cảnh | 1,048,576 token |
| Đầu ra tối đa | 65,536 token |
| Tư duy | Được hỗ trợ (trung bình / cao) |
| Gọi hàm | Có |
| Thực thi mã | Có |
| Tìm kiếm tệp | Có |
| Ngữ cảnh URL | Có |
| Grounding tìm kiếm | Có |
| Sử dụng máy tính | Bản xem trước |
| Đầu ra có cấu trúc | Có |
| Bộ nhớ đệm | Được hỗ trợ |
Nguồn: Tài liệu API Google Gemini.
Gemini 3.6 Flash là gì?
Gemini 3.6 Flash là mô hình Flash mới nhất đã sẵn sàng sản xuất của Google, được thiết kế để cung cấp trí tuệ cấp độ tiên tiến đồng thời duy trì độ trễ thấp và hiệu quả chi phí vốn là đặc trưng của dòng Flash. Mô hình được tối ưu cho lập trình, hiểu đa phương thức, suy luận và các quy trình tác tử.
So với Gemini 3.5 Flash, mô hình cải thiện chất lượng sinh mã, độ chính xác suy luận, khả năng sử dụng công cụ và hiệu quả token, đồng thời hỗ trợ cửa sổ ngữ cảnh khổng lồ 1 triệu token. Google định vị đây là mô hình chủ lực mặc định cho nhà phát triển xây dựng tác tử AI và hệ thống tự động hóa phức tạp.
Tính năng chính của Gemini 3.6 Flash
- Hỗ trợ xử lý ngữ cảnh dài 1M-token.
- Đầu vào đa phương thức gốc gồm văn bản, hình ảnh, video, âm thanh và tài liệu PDF.
- Cải thiện mạnh mẽ về sinh mã và tác vụ kỹ thuật phần mềm.
- Hỗ trợ tích hợp Gọi hàm, Tìm kiếm tệp, Ngữ cảnh URL, Grounding tìm kiếm và Sử dụng máy tính.
- Hiệu quả token cao hơn Gemini 3.5 Flash, giảm chi phí suy luận đồng thời duy trì chất lượng cao hơn.
- Thiết kế cho tác tử AI đa bước và quy trình tự động.
Hiệu năng đánh giá chuẩn
Google cho biết Gemini 3.6 Flash mang lại hiệu năng lập trình, suy luận và đa phương thức mạnh hơn Gemini 3.5 Flash trong khi sử dụng đáng kể ít token đầu ra hơn. Công ty nhấn mạnh hiệu năng cải thiện trên các tiêu chuẩn nội bộ về lập trình và tác tử, và cho biết mô hình có thể giảm mức sử dụng token đầu ra tới 65% trên một số đánh giá kỹ thuật phần mềm như DeepSWE, qua đó giảm chi phí suy luận tổng thể. Google chưa công bố bảng điểm chuẩn công khai toàn diện (ví dụ: MMLU, GPQA, SWE-bench Verified) cho phiên bản này.

Gemini 3.6 Flash vs Gemini 3.5 Flash vs Gemini 3.1 Pro
| Khía cạnh | Gemini 3.6 Flash | Gemini 3.5 Flash | Gemini 3.1 Pro |
|---|---|---|---|
| Phát hành | 21/07/2026 (GA) | Đầu 2026 | ~02/2026 (Bản xem trước) |
| Định vị | Mô hình chủ lực hiệu quả cho tác tử, lập trình, đa phương thức | Mô hình Flash tác tử tiền nhiệm | Lập luận cấp Pro nâng cao |
| Giá (mỗi 1M token) | Nhập: $1.50Xuất: $7.50 | Nhập: $1.50Xuất: $9.00 | Cao hơn (ví dụ, ~$2 đầu vào / $12 đầu ra) |
| Hiệu quả token | Ít token đầu ra hơn 17% so với 3.5 Flash; ít bước/cuộc gọi công cụ hơn | Mốc chuẩn | Kém hiệu quả hơn trong quy trình tác tử |
| Tốc độ | Cao (dòng Flash) | Cao | Chậm hơn các mô hình Flash |
| Cửa sổ ngữ cảnh | 1M token | 1M token | Có khả năng tương tự |
| Thế mạnh | Lập trình, công việc tri thức, đa phương thức (biểu đồ/tài liệu), sử dụng máy tính, hiệu quả tác tử | Cân bằng tốt giữa tác tử/lập trình | Suy luận sâu hơn trên vấn đề phức tạp |
Tóm tắt nhanh
- 3.6 Flash → Lựa chọn tổng thể tốt nhất cho hầu hết người dùng hiện nay: nhanh hơn, rẻ hơn theo tác vụ, hiệu quả hơn 3.5 Flash và vượt 3.1 Pro trên nhiều tiêu chuẩn thực tiễn/tác tử.
- 3.5 Flash → Tiền nhiệm vững vàng; vẫn có năng lực nhưng đang được thay thế bởi 3.6 Flash (chi phí token đầu ra cao hơn, kém hiệu quả hơn).
- 3.1 Pro → Mạnh hơn ở một số kịch bản suy luận sâu nhưng chậm hơn, đắt hơn và nhìn chung thua các mô hình Flash mới về tốc độ, hiệu quả và nhiều tác vụ thực tế/tác tử.
Hạn chế
- Không hỗ trợ tạo hình ảnh trực tiếp.
- Không có tính năng tạo âm thanh.
- Sử dụng máy tính vẫn ở trạng thái Bản xem trước.
- Một số tham số sinh thế hệ cũ (
temperature,top_p,top_k) đã được loại khỏi giao diện API mới. - Hiệu năng tốt nhất đạt được thông qua Gemini Interactions API mới nhất.
Cách truy cập API Gemini 3.6 Flash
Bước 1: Nhận quyền truy cập API
Đăng nhập cometAPI. Nếu bạn chưa là người dùng của chúng tôi, vui lòng đăng ký trước. Đăng nhập vào CometAPI console. Lấy khóa thông tin truy cập API. Nhấp “Add Token” tại mục token API trong trung tâm cá nhân, lấy khóa token: sk-xxxxx và gửi.

Bước 2: Gửi yêu cầu tới API Gemini 3.6 Flash
Chọn endpoint “ gemini-3.6-flash" "gemini-3.6-flash-thinking” để gửi yêu cầu API và thiết lập nội dung yêu cầu. Phương thức yêu cầu và nội dung yêu cầu được lấy từ tài liệu API trên website của chúng tôi. Website cũng cung cấp Apifox để bạn thử nghiệm tiện lợi. Thay thế <YOUR_API_KEY> bằng khóa CometAPI thực tế từ tài khoản của bạn. base url là Gemini Generating Content
Chèn câu hỏi hoặc yêu cầu của bạn vào trường content—đây là nội dung mô hình sẽ phản hồi. Xử lý phản hồi API để lấy câu trả lời được tạo.
Bước 3: Xử lý phản hồi
API trả về các phản hồi ứng viên có cấu trúc bao gồm văn bản tạo ra, trích dẫn, siêu dữ liệu an toàn và đầu ra công cụ tùy chọn.