Tổng quan về API Claude Opus 5
Claude Opus 5 API là mô hình lớp Opus của Anthropic dành cho lập trình tác tử phức tạp, tự động hóa doanh nghiệp, suy luận sâu, phân tích ngữ cảnh dài và công việc tri thức có giá trị cao. Anthropic phát hành Claude Opus 5 vào ngày 24 tháng 7 năm 2026, với ID mô hình API claude-opus-5, cửa sổ ngữ cảnh 1M token, đầu ra đồng bộ tối đa 128k, adaptive thinking bật theo mặc định, cùng các điều khiển mới cho effort, fallback, bộ nhớ đệm prompt và thay đổi công cụ.
Thông số kỹ thuật
| Hạng mục | Thông số |
|---|---|
| Tên mô hình | Claude Opus 5 |
| ID mô hình API | claude-opus-5 |
| Nhà cung cấp | Anthropic |
| Endpoint CometAPI gốc | POST /v1/messages |
| Endpoint CometAPI tương thích OpenAI | POST /v1/chat/completions |
| Loại đầu vào | Đầu vào văn bản và hình ảnh |
| Loại đầu ra | Đầu ra văn bản |
| Cửa sổ ngữ cảnh | 1M token |
| Số token đầu ra tối đa | 128k token trên Messages API đồng bộ; lên tới 300k token đầu ra trên các yêu cầu Message Batches API được hỗ trợ với header beta output-300k-2026-03-24 của Anthropic |
| Adaptive thinking | Có; bật theo mặc định |
| Kiểm soát effort | low, medium, high, xhigh, và max; high là mặc định trên Claude API và Claude Code |
| Giá chính thức của Anthropic | $5 trên mỗi triệu input token và $25 trên mỗi triệu output token |
| Giá bộ nhớ đệm prompt | $6.25 trên mỗi triệu ghi cache 5 phút, $10 trên mỗi triệu ghi cache 1 giờ, và $0.50 trên mỗi triệu cache hit |
| Giá niêm yết trên CometAPI | $4 trên mỗi triệu input token và $20 trên mỗi triệu output token, theo trang mô hình Claude Opus 5 trên CometAPI được kiểm tra vào ngày 26 tháng 7 năm 2026 |
| Mốc kiến thức đáng tin cậy | Tháng 5 năm 2026 |
Claude Opus 5 là gì và có gì mới?
Claude Opus 5 là thế hệ Opus tiếp theo sau Claude Opus 4.8. Anthropic định vị đây là mô hình nên bắt đầu cho lập trình tác tử phức tạp và công việc doanh nghiệp, trong khi Claude Fable 5 vẫn là lựa chọn có năng lực cao hơn cho khối lượng công việc nơi trí tuệ đỉnh cao quan trọng hơn giá cả hoặc độ trễ. Khác biệt thực tế là giá–hiệu năng: Anthropic cho biết Opus 5 tiệm cận năng lực của Fable 5 với một nửa giá token chính thức và cải thiện đáng kể so với Opus 4.8 ở cùng mức giá chính thức.
Thay đổi lớn nhất đối với nhà phát triển là Claude Opus 5 không chỉ là một chuỗi mô hình mạnh hơn. Hành vi API của nó thay đổi theo cách ảnh hưởng đến tích hợp production. Adaptive thinking được bật theo mặc định, và tham số effort giờ là cách chính để đánh đổi độ sâu so với tốc độ và mức tiêu thụ token. Mô hình cũng hỗ trợ ngưỡng tối thiểu bộ nhớ đệm prompt thấp hơn là 512 token, thay đổi công cụ giữa cuộc hội thoại ở chế độ beta, hành vi fallback phía máy chủ ở chế độ beta và Fast mode trên Claude API. Lưu ý rằng việc tắt thinking ở mức xhigh hoặc max sẽ trả về lỗi 400; nếu một ứng dụng buộc phải tắt thinking, nên dùng mức high hoặc thấp hơn.
Hiệu năng benchmark của Claude Opus 5
Claude Opus 5 có hỗ trợ benchmark mạnh từ Anthropic, ARC Prize và Artificial Analysis. Anthropic báo cáo rằng Opus 5 vượt hơn gấp đôi Claude Opus 4.8 trên Frontier-Bench v0.1 với chi phí trên mỗi tác vụ thấp hơn, đạt trong khoảng 0,5% so với điểm CursorBench 3.2 đỉnh của Claude Fable 5 ở mức effort tối đa, và vượt các mô hình khác trong một số so sánh giá–hiệu năng cho công việc tri thức và sử dụng máy tính.
Các nhà cung cấp benchmark độc lập đưa ra con số cụ thể hơn. ARC Prize báo cáo Claude Opus 5 High đạt 30,16% trên ARC-AGI-3, trong khi Opus 5 Max đạt 97,5% trên ARC-AGI-1 và 90,4% trên ARC-AGI-2 Semi-Private. Artificial Analysis báo cáo điểm Intelligence Index là 61 cho Claude Opus 5 Max, 89% trên Terminal-Bench v2.1 ở mức effort tối đa, 1861 Elo trên GDPval-AA v2, và 1720 Elo trên AA-Briefcase.
| Benchmark hoặc chỉ số | Kết quả Claude Opus 5 |
|---|---|
| ARC-AGI-3 Public Demo, mức High | 30,16% |
| ARC-AGI-1, mức Max | 97,5% |
| ARC-AGI-2 Semi-Private, mức Max | 90,4% |
| Artificial Analysis Intelligence Index, mức Max | 61 |
| Terminal-Bench v2.1, mức Max | 89% |
| GDPval-AA v2, mức Max | 1861 Elo |
| AA-Briefcase, mức Max | 1720 Elo |
| Tốc độ đầu ra, mức Max | 52,6 token mỗi giây |
| Thời gian đến token trả lời đầu tiên, mức Max | 68,04 giây |
Những kết quả này cho thấy Claude Opus 5 mạnh nhất khi quy trình làm việc thưởng cho lập kế hoạch, xác minh, sử dụng công cụ, hoàn thành nhiều bước và suy luận với ngữ cảnh dài. Chúng cũng cho thấy đánh đổi về độ trễ ở các thiết lập suy luận cao, vì vậy đội ngũ sản phẩm nên đánh giá chi phí trên mỗi tác vụ thành công thay vì chỉ dựa vào thứ hạng benchmark.
Tính năng và điểm nổi bật của Claude Opus 5
Ngữ cảnh 1M token cho khối công việc lớn
Claude Opus 5 hỗ trợ cửa sổ ngữ cảnh 1M token như cả giá trị mặc định và kích thước tối đa. Điều đó phù hợp cho lập trình quy mô kho mã, hợp đồng pháp lý dài, nghiên cứu đa tài liệu, sổ làm việc tài chính, dòng thời gian sự cố, lịch sử hỗ trợ khách hàng và phân tích cơ sở tri thức doanh nghiệp.
Tư duy thích ứng mặc định
Khác với Claude Opus 4.8, vốn cần bật rõ ràng adaptive thinking, Claude Opus 5 chạy với adaptive thinking theo mặc định. Mô hình quyết định chi bao nhiêu thinking mỗi lượt, trong khi nhà phát triển dùng effort để tinh chỉnh hành vi.
Mức effort để kiểm soát chi phí–chất lượng
Claude Opus 5 hỗ trợ các mức low, medium, high, xhigh, và max. Anthropic khuyến nghị bắt đầu ở mặc định high, giảm xuống khi chất lượng vẫn đảm bảo, và tăng lên cho các tác vụ lập trình dài hạn khó nhất hoặc tác vụ tác tử.
Lập trình tác tử và kiểm chứng mạnh hơn
Anthropic mô tả Opus 5 là bước nhảy so với Opus 4.8 cho lập trình tác tử, tác vụ dài hạn, review code và tìm lỗi. Trên thực tế, đây là lớp mô hình nên thử khi một tác tử AI phải kiểm tra tệp, gọi công cụ, chạy kiểm tra, sửa sai và hoàn thành công việc nhiều tệp thay vì chỉ nháp đoạn mã.
Kinh tế bộ nhớ đệm prompt tốt hơn cho ngữ cảnh ngắn hơn
Độ dài prompt tối thiểu có thể lưu cache giảm từ 1.024 token trên Claude Opus 4.8 xuống 512 token trên Claude Opus 5. Với các phiên tác tử lặp lại, system prompt dùng chung, manifest công cụ, hoặc ngữ cảnh dự án dài, bộ nhớ đệm prompt có thể giảm chi phí đầu vào lặp lại vì cache hit có giá thấp hơn so với token đầu vào mới.
Thay đổi công cụ giữa cuộc hội thoại
Claude Opus 5 hỗ trợ thay đổi công cụ giữa cuộc hội thoại ở chế độ beta. Nhà phát triển có thể thêm hoặc bớt công cụ khả dụng giữa các lượt trong khi vẫn giữ được bộ nhớ đệm prompt, hữu ích khi tác tử chuyển từ nghiên cứu sang lập trình, từ lập trình sang kiểm thử, hoặc từ phân tích sang triển khai.
Fallback phía máy chủ cho các trường hợp từ chối
Tham số fallbacks ở chế độ beta của Anthropic có thể dùng chế độ fallback mặc định cho các danh mục từ chối của trình phân loại an toàn. Đây không phải là hệ thống khả dụng chung hoặc retry do giới hạn tốc độ; nó được thiết kế cho các trường hợp Anthropic có mô hình fallback được khuyến nghị cho một danh mục từ chối.
Claude Opus 5 so với Claude Sonnet 5, Opus 4.8 và Fable 5
| Chiều so sánh | Claude Opus 5 | Claude Sonnet 5 | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|
| Vai trò tốt nhất | Lập trình tác tử phức tạp và công việc doanh nghiệp | Công việc sản xuất thông minh cao với tốc độ nhanh | Chuẩn Opus trước đây và phương án fallback khi di trú | Năng lực Claude cao nhất được phát hành rộng rãi |
| ID mô hình API | claude-opus-5 | claude-sonnet-5 | claude-opus-4-8 | claude-fable-5 |
| Giá chính thức Anthropic | $5/M input, $25/M output | $2/M input và $10/M output đến hết ngày 31 tháng 8, 2026; $3/M input và $15/M output từ 1 tháng 9, 2026 | $5/M input, $25/M output | $10/M input, $50/M output |
| Độ trễ tương đối | Vừa phải | Nhanh | Không liệt kê trong bảng so sánh mô hình mới nhất; trước đây là chuẩn của tầng Opus | Chậm hơn |
| Tư duy thích ứng | Bật theo mặc định | Bật theo mặc định | Khả dụng nhưng không mặc định trừ khi chỉ định | Luôn bật |
| Hỗ trợ effort | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max |
| Mốc kiến thức | Tháng 5 năm 2026 | Tháng 1 năm 2026 | Không hiển thị trong bảng mô hình mới nhất của Anthropic | Tháng 1 năm 2026 |
| Khi nào nên chọn | Dùng khi độ chính xác mức Opus quan trọng nhưng Fable 5 quá đắt hoặc chậm | Dùng cho lưu lượng sản xuất khối lượng lớn về lập trình, hỗ trợ, tài liệu và tác tử | Giữ để cố định hành vi kế thừa, fallback, hoặc so sánh khi di trú | Dùng khi năng lực Claude cao nhất sẵn có xứng đáng với chi phí cao hơn |
Ngoài ra, kích thước đầu vào tối đa và cửa sổ ngữ cảnh của chúng là như nhau.
Claude Opus 5 là lựa chọn cao cấp cân bằng nhất trong nhóm này. Claude Sonnet 5 tốt hơn cho lưu lượng sản xuất nhạy cảm về khối lượng, Claude Opus 4.8 chủ yếu là chuẩn kế thừa sau khi Opus 5 ra mắt, và Claude Fable 5 là lựa chọn năng lực cao nhất khi chi phí là thứ yếu.
Cách dùng API Claude Opus 5 trên CometAPI
Bước 1: Tạo khóa CometAPI
Đăng nhập CometAPI, mở trang khóa API, tạo một khóa và lưu vào biến môi trường như COMETAPI_KEY. Không đặt khóa API production trong mã phía client, kho công khai, ảnh chụp màn hình hoặc phiếu hỗ trợ.
Bước 2: Gọi endpoint Messages gốc của Anthropic
Dùng tuyến /v1/messages gốc khi bạn muốn hành vi đặc thù Claude như adaptive thinking, điều khiển effort, bộ nhớ đệm prompt, sử dụng công cụ, tìm kiếm web, streaming và các khối nội dung phản hồi kiểu Anthropic.
Bước 3: Dùng endpoint tương thích OpenAI cho định tuyến linh hoạt
Dùng /v1/chat/completions khi ứng dụng của bạn đã sử dụng SDK tương thích OpenAI hoặc khi bạn muốn so sánh Claude Opus 5 với GPT, Gemini, DeepSeek, Kimi, Qwen và các mô hình khác sau một lớp định tuyến.
Đối với production, hãy thử cả hai endpoint với prompt thực tế, ghi lại input token, output token, hành vi cache, mức effort, độ trễ, hành vi từ chối và tỷ lệ thành công cuối cùng của tác vụ. Dùng tài liệu chính thức của Anthropic làm nguồn thẩm quyền cho các tham số đặc thù Claude và tài liệu CometAPI cho cách hình dạng yêu cầu đó được chuyển tiếp.
Có thể làm gì với Claude Opus 5
Claude Opus 5 phù hợp nhất cho các ứng dụng nơi tính đúng đắn và khả năng theo đuổi đến cùng quan trọng hơn câu trả lời một bước rẻ. Nhà phát triển có thể xây dựng tác tử lập trình quy mô kho mã, trợ lý di trú, công cụ điều tra lỗi, hệ thống review code, trợ lý nghiên cứu ngữ cảnh dài, bộ phân tích tài liệu pháp lý và tài chính, quy trình xử lý tài liệu khoa học, bot leo thang hỗ trợ kỹ thuật, công cụ tạo bảng tính và slide, và trợ lý vận hành tự động.
Nó cũng hữu ích như mô hình leo thang trong kiến trúc đa mô hình. Sản phẩm có thể định tuyến lưu lượng hỗ trợ thông thường hoặc trích xuất sang Claude Sonnet 5 hoặc các mô hình chi phí thấp hơn, sau đó leo thang những lượt mơ hồ, rủi ro hoặc giá trị cao lên Claude Opus 5. Mẫu hình này giữ mô hình cao cấp tập trung vào công việc nơi suy luận sâu làm thay đổi kết quả.
Dùng Claude Opus 5 API cho tác tử lập trình khó, gỡ lỗi nguyên nhân gốc, tái cấu trúc nhiều tệp, review code, phân tích tài liệu doanh nghiệp, mô hình tài chính, rà soát pháp lý, suy luận khoa học, nghiên cứu ngữ cảnh dài, tạo báo cáo chuyên nghiệp và tự động hóa vận hành. Trên CometAPI, mẫu triển khai mạnh nhất là leo thang chọn lọc: thử Claude Opus 5 so với Claude Sonnet 5, Claude Fable 5 và các lựa chọn không phải Claude, rồi định tuyến từng khối công việc theo chi phí trên mỗi kết quả được chấp nhận thay vì chỉ theo danh tiếng mô hình.
Vì sao dùng CometAPI cho Claude Opus 5?
CometAPI hữu ích cho Claude Opus 5 khi đội ngũ muốn một khóa API, hóa đơn hợp nhất, so sánh mô hình và di chuyển dễ dàng hơn giữa các nhà cung cấp. CometAPI cung cấp tài liệu cho cả endpoint Messages gốc của Anthropic và endpoint Chat Completions tương thích OpenAI, nên đội ngũ có thể chọn điều khiển kiểu Claude cho quy trình nâng cao hoặc giữ một hình thức tích hợp dễ di chuyển cho định tuyến đa mô hình.
Hạn chế
Claude Opus 5 là mô hình suy luận cao cấp, không phải lựa chọn mặc định cho mọi yêu cầu. Ở các thiết lập effort cao, nó có thể tiêu thụ nhiều token hơn và tạo độ trễ đến token đầu tiên cao hơn so với mô hình nhẹ. Artificial Analysis báo cáo 68,04 giây đến token trả lời đầu tiên cho phép đo effort tối đa, khiến việc định tuyến và chọn effort trở nên quan trọng cho ứng dụng hướng người dùng.
Nhà phát triển cũng nên tránh giả định hành vi không được hỗ trợ. Anthropic chưa công bố số lượng tham số của mô hình, và trọng số mô hình là sở hữu độc quyền. Fast mode đang ở giai đoạn nghiên cứu trên Claude API, không phải trên mọi nền tảng đám mây. Fallback phía máy chủ và thay đổi công cụ giữa cuộc hội thoại là tính năng beta. Với quy trình bảo mật, Anthropic nêu rằng Opus 5 có thể hỗ trợ các trường hợp sử dụng tìm lỗ hổng mang tính hữu ích nhưng áp dụng biện pháp bảo vệ cho các tác vụ rủi ro cao như quét lỗ hổng dựa trên binary, kiểm thử xâm nhập và tạo khai thác.