Claude Opus 5 API 概覽
Claude Opus 5 API 是 Anthropic 的 Opus 級模型,面向複雜的代理式編碼、企業自動化、深度推理、長上下文分析與高價值知識型工作。Anthropic 已於 2026 年 7 月 24 日發佈 Claude Opus 5,API 模型 ID 為 claude-opus-5,提供 1M-token 上下文視窗、同步最大輸出 128k、預設開啟自適應思考,並新增針對 effort、回退、提示快取與工具變更的控制項。
技術規格
| 項目 | 規格 |
|---|---|
| 模型名稱 | Claude Opus 5 |
| API 模型 ID | claude-opus-5 |
| 供應商 | Anthropic |
| 原生 CometAPI 端點 | POST /v1/messages |
| 相容 OpenAI 的 CometAPI 端點 | POST /v1/chat/completions |
| 輸入類型 | 文字與圖片輸入 |
| 輸出類型 | 文字輸出 |
| 上下文視窗 | 1M tokens |
| 最大輸出 tokens | Messages API 同步模式 128k tokens;在支援的 Message Batches API 請求上,搭配 Anthropic 的 output-300k-2026-03-24 beta header 可達最多 300k 輸出 tokens |
| 自適應思考 | 是;預設開啟 |
| Effort 控制 | low, medium, high, xhigh, 和 max;在 Claude API 與 Claude Code 上預設為 high |
| Anthropic 官方定價 | 每百萬輸入 tokens $5、每百萬輸出 tokens $25 |
| 提示快取定價 | 每百萬 5 分鐘快取寫入 $6.25、每百萬 1 小時快取寫入 $10、每百萬快取命中 $0.50 |
| CometAPI 列示價格 | 每百萬輸入 tokens $4、每百萬輸出 tokens $20,依 2026 年 7 月 26 日查閱之 CometAPI Claude Opus 5 模型頁面所示 |
| 可靠知識截止 | 2026 年 5 月 |
Claude Opus 5 是什麼?有哪些新變化?
Claude Opus 5 是承接 Claude Opus 4.8 的下一代 Opus 模型。Anthropic 將其定位為處理複雜代理式編碼與企業級工作的首選模型,而當更重視峰值智能而非價格或延遲時,Claude Fable 5 仍是更高能力的選項。實務差異在於性價比:Anthropic 表示 Opus 5 以官方代幣價格的一半接近 Fable 5 的能力,並在保持與 Opus 4.8 相同官方價格下顯著提升。
對開發者而言,最大的變化不僅是模型字串更強。其 API 行為也改變,影響到正式環境整合。自適應思考預設啟用,effort 參數成為在深度、速度與 token 使用間取捨的主要手段。該模型也支援更低的提示快取最小值(512 tokens)、beta 的對話中途工具變更、beta 的伺服器端回退行為,以及 Claude API 的 Fast mode。另需注意,若在 xhigh 或 max effort 下停用思考會返回 400 錯誤;若應用必須停用思考,應使用 high 或以下的 effort。
Claude Opus 5 的基準測試表現
Claude Opus 5 獲得來自 Anthropic、ARC Prize 與 Artificial Analysis 的強力基準數據支持。Anthropic 報告顯示,Opus 5 在 Frontier-Bench v0.1 上以更低的單任務成本達到超過 Claude Opus 4.8 的兩倍分數;在 max effort 下,其 CursorBench 3.2 峰值成績與 Claude Fable 5 的差距僅 0.5%,並在部分知識型工作與電腦操作的成本效益比較中勝過其他模型。
獨立的基準供應商提供了更具體的數字。ARC Prize 報告 Claude Opus 5 High 在 ARC-AGI-3 取得 30.16%,而 Opus 5 Max 在 ARC-AGI-1 與 ARC-AGI-2 Semi-Private 分別取得 97.5% 與 90.4%。Artificial Analysis 報告 Claude Opus 5 Max 的 Intelligence Index 分數為 61,在 Terminal-Bench v2.1 於 max effort 下為 89%,在 GDPval-AA v2 為 1861 Elo,在 AA-Briefcase 為 1720 Elo。
| 基準或指標 | Claude Opus 5 結果 |
|---|---|
| ARC-AGI-3 Public Demo,High effort | 30.16% |
| ARC-AGI-1,Max effort | 97.5% |
| ARC-AGI-2 Semi-Private,Max effort | 90.4% |
| Artificial Analysis Intelligence Index,Max effort | 61 |
| Terminal-Bench v2.1,Max effort | 89% |
| GDPval-AA v2,Max effort | 1861 Elo |
| AA-Briefcase,Max effort | 1720 Elo |
| 輸出速度,Max effort | 每秒 52.6 個 token |
| 首個答案 token 所需時間,Max effort | 68.04 秒 |
這些結果表明,當工作流程重視規劃、驗證、工具使用、多步驟完成與長上下文推理時,Claude Opus 5 表現最強。同時也顯示在高推理設定下存在延遲取捨,因此產線團隊應評估每個成功任務的成本,而非僅看基準排名。
Claude Opus 5 的功能與亮點
面向大型工作負載的 1M-token 上下文
Claude Opus 5 的上下文視窗在預設與最大值皆為 1M tokens。這使其適合代碼倉庫規模的編碼、冗長法務合約、多文件研究、財務工作簿、事故時間線、客戶支援歷史,以及企業知識庫分析。
預設啟用自適應思考
不同於必須顯式啟用自適應思考的 Claude Opus 4.8,Claude Opus 5 預設即啟用自適應思考。模型會自行決定每回合投入多少思考,開發者則使用 effort 來調整行為。
用於成本-品質控制的 Effort 等級
Claude Opus 5 支援 low、medium、high、xhigh 與 max 的 effort 等級。Anthropic 建議從預設的 high 開始;當品質維持時可下調,遇到最困難的長期程式設計或代理任務再上調。
更強的代理式編碼與驗證
Anthropic 指出,相較 Opus 4.8,Opus 5 在代理式編碼、長期任務、程式碼審查與錯誤查找方面是躍升式的。在實務上,當 AI 代理需要檢查檔案、呼叫工具、執行檢查、修正錯誤,並完成多檔案工作而非僅撰寫片段程式碼時,這是應該測試的模型等級。
較短上下文的提示快取經濟性更佳
可快取的提示最小長度從 Claude Opus 4.8 的 1,024 tokens 降至 Claude Opus 5 的 512 tokens。對於重複的代理工作階段、共用的 system 提示、工具清單或大型專案上下文,提示快取可降低重複輸入成本,因為快取命中的定價低於新輸入 tokens。
對話中途工具變更
Claude Opus 5 支援 beta 的對話中途工具變更。開發者可在回合間新增或移除可用工具,同時保留提示快取;這對於代理從研究轉向編碼、從編碼轉向測試、或從分析轉向部署的情境特別有用。
針對拒絕情境的伺服器端回退
Anthropic 的 beta fallbacks 參數可對安全分類器的拒絕類別使用預設回退模式。這並非一般可用性或速率限制重試系統;其設計用於 Anthropic 對特定拒絕類別有建議回退模型的情況。
Claude Opus 5 vs Claude Sonnet 5 vs Opus 4.8 vs Fable 5
| 面向 | Claude Opus 5 | Claude Sonnet 5 | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|
| 最佳定位 | 複雜代理式編碼與企業級工作 | 更快速的高智慧正式生產工作 | 先前的 Opus 基線與遷移回退 | 廣泛釋出的最高級 Claude 能力 |
| API 模型 ID | claude-opus-5 | claude-sonnet-5 | claude-opus-4-8 | claude-fable-5 |
| Anthropic 官方價格 | $5/M input、$25/M output | 至 2026 年 8 月 31 日為 $2/M input、$10/M output;自 2026 年 9 月 1 日起為 $3/M input、$15/M output | $5/M input、$25/M output | $10/M input、$50/M output |
| 相對延遲 | 中等 | 快速 | 目前最新模型比較表未列出;先前 Opus 層級基線 | 較慢 |
| 自適應思考 | 預設開啟 | 預設開啟 | 可用,但除非指定否則請求預設不啟用 | 永遠開啟 |
| Effort 支援 | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max |
| 知識截止 | 2026 年 5 月 | 2026 年 1 月 | 未在 Anthropic 目前最新模型表中顯示 | 2026 年 1 月 |
| 何時選用 | 當需要 Opus 級準確性,但 Fable 5 過於昂貴或緩慢時 | 用於高流量的編碼、支援、文檔與代理工作流程 | 保留作為固定的舊版行為、回退或遷移比較 | 當最高可用 Claude 能力能證明其更高價格合理時使用 |
此外,它們的最大輸入與上下文視窗相同。
Claude Opus 5 是此組合中最均衡的高階選擇。Claude Sonnet 5 更適合對量敏感的正式生產流量,Claude Opus 4.8 在 Opus 5 發佈後主要作為舊版基線,而當成本次要時,Claude Fable 5 是更高能力的選擇。
如何在 CometAPI 上使用 Claude Opus 5 API
Step 1: 建立 CometAPI 金鑰
登入 CometAPI,開啟 API 金鑰頁面,建立金鑰,並將其儲存在如 COMETAPI_KEY 的環境變數中。切勿將正式環境的 API 金鑰放在前端程式碼、公開版本庫、截圖或支援票單中。
Step 2: 呼叫 Anthropic 原生 Messages 端點
當你需要 Claude 特有行為(如自適應思考、effort 控制、提示快取、工具使用、網頁搜尋、串流,以及 Anthropic 風格的回應內容區塊)時,請使用原生的 /v1/messages 路由。
Step 3: 使用相容 OpenAI 的端點以便可攜式路由
當你的應用已使用相容 OpenAI 的 SDK,或希望在同一層路由中將 Claude Opus 5 與 GPT、Gemini、DeepSeek、Kimi、Qwen 等模型比較時,請使用 /v1/chat/completions。
在正式環境中,請以真實提示同時測試兩個端點,記錄輸入 tokens、輸出 tokens、快取行為、effort 等級、延遲、拒絕行為與最終任務成功率。針對 Claude 特定參數以 Anthropic 官方文件為準,並參考 CometAPI 的文件了解該請求格式如何被轉發。
使用 Claude Opus 5 的可能性
當正確性與執行到底比便宜的一次性回答更重要時,Claude Opus 5 最為適合。開發者可打造代碼倉庫規模的編碼代理、遷移助理、錯誤調查工具、程式碼審查系統、長上下文研究助理、法務與財務文件分析器、科學文獻工作流、技術支援升級機器人、試算表與簡報生成工具,以及自動化營運助理。
它也適合作為多模型架構中的升級模型。產品可將一般支援或抽取流量導向 Claude Sonnet 5 或更低成本模型,遇到模糊、風險高或高價值回合再升級到 Claude Opus 5。此模式讓高階模型聚焦於更深層推理能改變結果的工作。
在硬核編碼代理、根因除錯、多檔案重構、程式碼審查、企業文件分析、財務建模、法務審查、科學推理、長上下文研究、專業報告生成與營運自動化等場景使用 Claude Opus 5 API。於 CometAPI 上,最強的部署模式是選擇性升級:以每個被接受結果的成本而非模型名望來路由,將 Claude Opus 5 與 Claude Sonnet 5、Claude Fable 5 及非 Claude 替代品進行對照測試。
為何在 CometAPI 上使用 Claude Opus 5?
當團隊需要單一 API 金鑰、統一計費、模型比較與更容易在供應商間遷移時,CometAPI 對 Claude Opus 5 很有用。CometAPI 同時提供原生的 Anthropic Messages 端點與相容 OpenAI 的 Chat Completions 端點,因此團隊可在進階工作流中選擇 Claude 原生控制項,或以可攜式整合形態進行多模型路由。
侷限
Claude Opus 5 是高階推理模型,並非每個請求的預設選擇。在較高的 effort 設定下,它可能消耗更多 tokens,且相較輕量模型有更高的首字延遲。Artificial Analysis 報告其在 max effort 測量下首個答案 token 需時 68.04 秒,這使得路由與 effort 選擇對使用者導向的應用尤為重要。
開發者也應避免假設模型支援未宣告的行為。Anthropic 未披露模型參數量,且模型權重為專有。Fast mode 在 Claude API 上屬研究預覽,並非所有雲端平台皆可用。伺服器端回退與對話中途工具變更為 beta 功能。對於安全工作流,Anthropic 表示 Opus 5 可支援有益的弱點發掘用例,但會對二進位弱點掃描、滲透測試與漏洞利用生成等風險較高的任務施加防護。