Thông số kỹ thuật của GLM-5.2
| Hạng mục | GLM-5.2 |
|---|---|
| Nhà cung cấp | Zhipu AI |
| Ngày phát hành | 13 tháng 6, 2026 |
| Loại mô hình | LLM Mixture-of-Experts (MoE) có trọng số mở |
| Tổng số tham số | ~744B |
| Tham số kích hoạt | ~40B mỗi token |
| Cửa sổ ngữ cảnh | 1,000,000 tokens |
| Đầu ra tối đa | 131,072 tokens |
| Chế độ suy luận | High, Max |
| Giấy phép | MIT |
| Trọng tâm chính | Lập trình theo hướng tác tử, kỹ nghệ phần mềm, suy luận tầm xa |
| Khả dụng API | Nền tảng Z.ai và các nhà cung cấp tương thích |
| Trọng số mở | Có |
GLM-5.2 là mẫu chủ lực mới nhất thuộc dòng GLM của Zhipu AI. Khác với các mô hình tiên tiến đa dụng, GLM-5.2 được định vị chủ yếu như một mô hình ưu tiên lập trình và định hướng tác tử, được thiết kế cho kỹ nghệ phần mềm quy mô kho mã, quy trình tự động và suy luận với ngữ cảnh cực dài. Năng lực nổi bật của nó là cửa sổ ngữ cảnh gốc 1 triệu token, khiến nó trở thành một trong những cửa sổ ngữ cảnh công khai lớn nhất trong số các mô hình có trọng số mở.
Các tính năng chính của GLM-5.2
- Cửa sổ ngữ cảnh 1M-token cho toàn bộ kho mã, bộ tài liệu dài và quy trình tác tử đa phiên.
- Tối ưu hóa ưu tiên lập trình tập trung vào tái cấu trúc, gỡ lỗi, sinh mã và các tác vụ kỹ nghệ phần mềm.
- Hỗ trợ quy trình tác tử cho các công cụ như Claude Code, Cline, Roo Code, OpenCode và các tác tử lập trình tương tự.
- Phát hành trọng số mở theo giấy phép MIT, cho phép tự lưu trữ và tinh chỉnh.
- Hai chế độ suy luận (High và Max) cho phép đánh đổi giữa độ trễ và độ sâu suy luận.
- Kiến trúc MoE lớn với khoảng 744B tham số tổng, chỉ kích hoạt ~40B mỗi token để đạt hiệu suất.
Hiệu năng trên benchmark của GLM-5.2
Zhipu không công bố các kết quả benchmark chính thức toàn diện khi ra mắt, khiến việc so sánh trực tiếp kém chắc chắn hơn so với các mô hình như GPT-5 hoặc Claude. Nhiều báo cáo trong ngành ghi nhận sự thiếu vắng các công bố benchmark được kiểm chứng độc lập.
| Benchmark | Điểm báo cáo |
|---|---|
| Terminal-Bench 2.1 | 81.0 |
| SWE-Bench Pro | 62.1 |
| NL2Repo | 48.9 |
| AIME 2026 | 99.2 |

GLM-5.2 so với GLM-5.1 và Claude Opus 4.8
| Thông số | GLM-5.2 | GLM-5.1 | Claude Opus 4.8 |
|---|---|---|---|
| Ngày phát hành | 2026-06-13 | 2026 | 2026 |
| Cửa sổ ngữ cảnh | 1,000,000 | ~200,000 | 1,000,000 |
| Trọng số mở | Có (MIT) | Có | Không |
| Chế độ suy luận | High, Max | Standard | Extended Thinking |
| Tổng số tham số | 744B | 744B | Không tiết lộ |
| Tham số kích hoạt | 40B | 40B | Không tiết lộ |
| Dữ liệu benchmark chính thức | Chưa công bố | Công bố khi ra mắt | Đã công bố |
Nâng cấp được ghi nhận chính của GLM-5.2 so với GLM-5.1 là mở rộng lên cửa sổ ngữ cảnh 1M-token và giới thiệu các chế độ suy luận có thể chọn High và Max. Khi ra mắt, Z.ai không công bố các kết quả benchmark chính thức như SWE-Bench, LiveCodeBench, HumanEval hay tương tự, vì vậy các so sánh hiệu năng với Claude Opus 4.8, GPT-5, DeepSeek hoặc Qwen vẫn chưa được xác thực.
So với các mô hình mở khác, điểm khác biệt chính của GLM-5.2 là sự kết hợp giữa cửa sổ ngữ cảnh rất lớn, chuyên môn hóa cho lập trình và giấy phép MIT. Sức hấp dẫn mạnh nhất của nó là cho kỹ nghệ phần mềm ở quy mô kho mã hơn là các ứng dụng trò chuyện chung.
Vì sao nên dùng GLM-5.2 qua CometAPI?
CometAPI cho phép nhà phát triển tích hợp GLM-5.2 bằng cùng giao diện được sử dụng cho hàng chục mô hình AI hàng đầu.
Lợi ích gồm:
- Xác thực thống nhất trên nhiều nhà cung cấp
- Tích hợp API tương thích với OpenAI
- Đơn giản hóa thanh toán và quản lý sử dụng
- Thử nghiệm nhanh với các mô hình thay thế
- Dễ dàng chuyển đổi giữa các mô hình về lập trình, suy luận, hình ảnh, âm thanh và video
- Giảm phụ thuộc vào nhà cung cấp cho hệ thống sản xuất
Dù bạn đang xây dựng một IDE AI, trợ lý kỹ thuật nội bộ, hay nền tảng tự động hóa doanh nghiệp, CometAPI giúp giảm thiểu công sức tích hợp mà vẫn giữ được tính linh hoạt.
Cách truy cập API GLM-5.2 trên CometAPI
Bắt đầu với sản phẩm của chúng tôi chỉ với vài bước đơn giản...
Bước 1: Đăng ký khóa API GLM-5.2 của bạn
Tạo tài khoản trên CometAPI và đi tới bảng điều khiển API để tạo khóa API GLM-5.2 của bạn. Khóa này xác thực mọi yêu cầu và cho bạn quyền truy cập ngay vào đầy đủ khả năng của API GLM-5.2, bao gồm cửa sổ ngữ cảnh 1M token và 128k token đầu ra.
Bước 2: Gửi yêu cầu tới API GLM-5.2
Sử dụng khóa API GLM-5.2 của bạn để gửi các yêu cầu POST tới điểm cuối CometAPI. Truyền prompt của bạn, đặt các tham số mô hình như mức độ nỗ lực và số token tối đa, và API GLM-5.2 sẽ xử lý yêu cầu của bạn — xử lý mọi thứ từ tạo mã đến phân tích tài liệu cho tới sử dụng công cụ theo tác tử.
Bước 3: Nhận kết quả và tích hợp API GLM-5.2
API GLM-5.2 trả về các phản hồi có cấu trúc, bao gồm văn bản hoàn thành, hướng dẫn gọi công cụ và siêu dữ liệu về sử dụng token. API hỗ trợ cả phản hồi đồng bộ tiêu chuẩn và truyền phát thời gian thực qua Server-Sent Events (SSE) khi cấu hình stream: true. Điểm cuối có thể dễ dàng tích hợp vào quy trình hiện có bằng các HTTP client tiêu chuẩn hoặc SDK tương thích OpenAI bằng cách định tuyến yêu cầu qua url(//api.cometapi.com/v1) với Bearer Token của bạn.