Panoramica dell'API di Claude Opus 5
Claude Opus 5 API è il modello di classe Opus di Anthropic per coding agentico complesso, automazione enterprise, deep reasoning, analisi a lungo contesto e lavori di conoscenza ad alto valore. Anthropic ha rilasciato Claude Opus 5 il 24 luglio 2026, con ID modello API claude-opus-5, una finestra di contesto da 1M token, output sincrono massimo di 128k, pensiero adattivo attivo per impostazione predefinita e nuovi controlli per sforzo, fallback, caching del prompt e modifiche degli strumenti.
Specifiche tecniche
| Voce | Specifiche |
|---|---|
| Nome del modello | Claude Opus 5 |
| ID modello API | claude-opus-5 |
| Fornitore | Anthropic |
| Endpoint nativo CometAPI | POST /v1/messages |
| Endpoint CometAPI compatibile OpenAI | POST /v1/chat/completions |
| Tipi di input | Input di testo e immagine |
| Tipo di output | Output di testo |
| Finestra di contesto | 1M token |
| Token massimi di output | 128k token sulla Messages API sincrona; fino a 300k token di output su richieste supportate della Message Batches API con header beta output-300k-2026-03-24 di Anthropic |
| Pensiero adattivo | Sì; attivo per impostazione predefinita |
| Controllo dello sforzo | low, medium, high, xhigh e max; high è il predefinito sulla Claude API e su Claude Code |
| Prezzi ufficiali Anthropic | $5 per milione di token in input e $25 per milione di token in output |
| Prezzi della cache del prompt | $6.25 per milione per scritture di cache a 5 minuti, $10 per milione per scritture a 1 ora e $0.50 per milione per cache hit |
| Prezzi riportati da CometAPI | $4 per milione di token in input e $20 per milione di token in output, secondo la pagina del modello Claude Opus 5 di CometAPI verificata il 26 luglio 2026 |
| Cutoff della conoscenza affidabile | Maggio 2026 |
Che cos'è Claude Opus 5 e novità principali?
Claude Opus 5 è il successore di Claude Opus 4.8 nella linea Opus. Anthropic lo posiziona come il modello da cui partire per coding agentico complesso e lavoro enterprise, mentre Claude Fable 5 resta l’opzione di capacità superiore per carichi di lavoro in cui l’intelligenza di picco conta più di prezzo o latenza. La differenza pratica è il rapporto prezzo-prestazioni: Anthropic afferma che Opus 5 si avvicina alla capacità di Fable 5 a metà del prezzo ufficiale per token e migliora sostanzialmente rispetto a Opus 4.8 allo stesso prezzo ufficiale.
Il cambiamento più grande per gli sviluppatori è che Claude Opus 5 non è solo una stringa di modello più forte. Il suo comportamento API cambia in modi che influenzano le integrazioni in produzione. Il pensiero adattivo è abilitato per impostazione predefinita e il parametro effort è ora il modo principale per scambiare profondità con velocità e uso di token. Il modello supporta anche una soglia minima più bassa per la cache del prompt di 512 token, modifiche agli strumenti a metà conversazione in beta, fallback lato server in beta e Fast mode sulla Claude API. Disabilitare il thinking a sforzo xhigh o max restituisce un errore 400; se un’applicazione deve disabilitare il thinking, dovrebbe usare sforzo high o inferiore.
Prestazioni di Claude Opus 5 nei benchmark
Claude Opus 5 ha un forte supporto di benchmark da Anthropic, ARC Prize e Artificial Analysis. Anthropic riporta che Opus 5 più che raddoppia Claude Opus 4.8 su Frontier-Bench v0.1 a un costo per task inferiore, si avvicina entro lo 0,5% al punteggio di picco di Claude Fable 5 su CursorBench 3.2 con sforzo massimo e supera altri modelli su confronti selezionati di rapporto costo-prestazioni per knowledge work e computer use.
Fornitori indipendenti di benchmark aggiungono numeri più concreti. ARC Prize riporta che Claude Opus 5 High ha ottenuto il 30.16% su ARC-AGI-3, mentre Opus 5 Max ha ottenuto il 97.5% su ARC-AGI-1 e il 90.4% su ARC-AGI-2 Semi-Private. Artificial Analysis riporta un punteggio di Intelligence Index di 61 per Claude Opus 5 Max, 89% su Terminal-Bench v2.1 a sforzo massimo, 1861 Elo su GDPval-AA v2 e 1720 Elo su AA-Briefcase.
| Benchmark o metrica | Risultato di Claude Opus 5 |
|---|---|
| ARC-AGI-3 Public Demo, sforzo high | 30.16% |
| ARC-AGI-1, sforzo max | 97.5% |
| ARC-AGI-2 Semi-Private, sforzo max | 90.4% |
| Artificial Analysis Intelligence Index, sforzo max | 61 |
| Terminal-Bench v2.1, sforzo max | 89% |
| GDPval-AA v2, sforzo max | 1861 Elo |
| AA-Briefcase, sforzo max | 1720 Elo |
| Velocità di output, sforzo max | 52.6 token al secondo |
| Tempo al primo token di risposta, sforzo max | 68.04 secondi |
Questi risultati suggeriscono che Claude Opus 5 è più forte quando un flusso di lavoro premia pianificazione, verifica, uso di strumenti, completamento multi-step e ragionamento su contesti lunghi. Mostrano anche un compromesso di latenza a impostazioni di ragionamento elevate, quindi i team di produzione dovrebbero valutare il costo per task riuscito piuttosto che solo la posizione nel benchmark.
Funzionalità e punti salienti di Claude Opus 5
Contesto da 1M token per carichi di lavoro grandi
Claude Opus 5 supporta una finestra di contesto da 1M token sia come predefinita sia come massima. Ciò lo rende adatto a coding a livello di repository, contratti legali lunghi, ricerche multi-documento, workbook finanziari, timeline di incidenti, storici dell’assistenza clienti e analisi di basi di conoscenza aziendali.
Pensiero adattivo per impostazione predefinita
A differenza di Claude Opus 4.8, che richiedeva l’abilitazione esplicita del pensiero adattivo, Claude Opus 5 lo esegue per impostazione predefinita. Il modello decide quanta riflessione impiegare per turno, mentre gli sviluppatori usano effort per regolare il comportamento.
Livelli di sforzo per il controllo costo-qualità
Claude Opus 5 supporta i livelli di sforzo low, medium, high, xhigh e max. Anthropic raccomanda di iniziare dal predefinito high, scalare verso il basso quando la qualità regge e aumentare per i task più difficili a lungo orizzonte o per agent.
Coding agentico e verifica più robusti
Anthropic descrive Opus 5 come un salto rispetto a Opus 4.8 per coding agentico, task a lungo orizzonte, code review e individuazione di bug. In pratica, è la classe di modelli da testare quando un agente AI deve ispezionare file, chiamare strumenti, eseguire controlli, correggere errori e completare lavori multi-file, non solo abbozzare snippet di codice.
Economia migliore del caching del prompt per contesti più brevi
La lunghezza minima del prompt cacheabile scende da 1,024 token su Claude Opus 4.8 a 512 token su Claude Opus 5. Per sessioni di agent ripetute, system prompt condivisi, manifest degli strumenti o contesto di progetto lungo, il caching del prompt può ridurre i costi di input ripetuti perché i cache hit hanno un prezzo inferiore ai token di input freschi.
Modifiche agli strumenti a metà conversazione
Claude Opus 5 supporta in beta modifiche agli strumenti a metà conversazione. Gli sviluppatori possono aggiungere o rimuovere strumenti disponibili tra i turni preservando la cache del prompt, utile quando un agente passa da ricerca a coding, da coding a test o da analisi a deployment.
Fallback lato server per casi di rifiuto
Il parametro beta fallbacks di Anthropic può usare una modalità di fallback predefinita per categorie di rifiuto del safety classifier. Non è un sistema di retry per disponibilità generale o rate limit; è progettato per i casi in cui Anthropic ha un modello di fallback raccomandato per una categoria di rifiuto.
Claude Opus 5 vs Claude Sonnet 5 vs Opus 4.8 vs Fable 5
| Dimensione | Claude Opus 5 | Claude Sonnet 5 | Claude Opus 4.8 | Claude Fable 5 |
|---|---|---|---|---|
| Ruolo ideale | Coding agentico complesso e lavoro enterprise | Lavoro produttivo ad alta intelligenza più veloce | Precedente baseline Opus e fallback/migrazione | Massima capacità Claude ampiamente rilasciata |
| ID modello API | claude-opus-5 | claude-sonnet-5 | claude-opus-4-8 | claude-fable-5 |
| Prezzo ufficiale Anthropic | $5/M input, $25/M output | $2/M input e $10/M output fino al 31 agosto 2026; $3/M input e $15/M output dal 1 settembre 2026 | $5/M input, $25/M output | $10/M input, $50/M output |
| Latenza comparativa | Moderata | Veloce | Non elencata nell’attuale tabella dei modelli più recenti; baseline Opus precedente | Più lenta |
| Pensiero adattivo | Attivo per impostazione predefinita | Attivo per impostazione predefinita | Disponibile ma non predefinito per le richieste se non specificato | Sempre attivo |
| Supporto sforzo | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max | low, medium, high, xhigh, max |
| Cutoff della conoscenza | Maggio 2026 | Gennaio 2026 | Non mostrato nell’attuale tabella dei modelli più recenti di Anthropic | Gennaio 2026 |
| Quando sceglierlo | Usare quando l’accuratezza livello Opus conta ma Fable 5 è troppo costoso o lento | Usare per coding, supporto, documenti e workflow di agent ad alto volume | Tenere per comportamento legacy fissato, fallback o confronto di migrazione | Usare quando la massima capacità Claude disponibile giustifica il prezzo più alto |
Inoltre, il loro input massimo e la finestra di contesto sono gli stessi.
Claude Opus 5 è la scelta premium più equilibrata in questo gruppo. Claude Sonnet 5 è migliore per traffico produttivo sensibile al volume, Claude Opus 4.8 è principalmente una baseline legacy dopo il lancio di Opus 5 e Claude Fable 5 è la scelta di capacità superiore quando il costo è secondario.
Come usare l'API di Claude Opus 5 su CometAPI
Passaggio 1: Crea una chiave CometAPI
Accedi a CometAPI, apri la pagina delle chiavi API, crea una chiave e salvala in una variabile d’ambiente come COMETAPI_KEY. Non inserire chiavi API di produzione nel codice client-side, repository pubblici, screenshot o ticket di supporto.
Passaggio 2: Chiama l'endpoint nativo Anthropic Messages
Usa la route nativa /v1/messages quando desideri comportamento specifico di Claude come pensiero adattivo, controllo dello sforzo, cache del prompt, uso di strumenti, ricerca web, streaming e blocchi di contenuto di risposta in stile Anthropic.
Passaggio 3: Usa l'endpoint compatibile OpenAI per un routing portabile
Usa /v1/chat/completions quando la tua applicazione usa già SDK compatibili con OpenAI o quando vuoi confrontare Claude Opus 5 con GPT, Gemini, DeepSeek, Kimi, Qwen e altri modelli dietro un unico livello di routing.
Per la produzione, testa entrambi gli endpoint con prompt reali, registra token di input, token di output, comportamento della cache, livello di sforzo, latenza, comportamento di rifiuto e successo finale del task. Usa la documentazione ufficiale di Anthropic come autorità per i parametri specifici di Claude e la documentazione di CometAPI per come quella forma di richiesta viene inoltrata.
Cosa è possibile con Claude Opus 5
Claude Opus 5 è più adatto ad applicazioni in cui correttezza e follow-through contano più di una risposta economica one-shot. Gli sviluppatori possono costruire agent di coding a livello di repository, assistenti di migrazione, strumenti per investigazione di bug, sistemi di code review, assistenti di ricerca a lungo contesto, analizzatori di documenti legali e finanziari, workflow su letteratura scientifica, bot per escalation del supporto tecnico, strumenti per la generazione di fogli di calcolo e slide e assistenti per operazioni autonome.
È utile anche come modello di escalation in un’architettura multi-modello. Un prodotto può instradare il traffico di supporto ordinario o di estrazione a Claude Sonnet 5 o a modelli a costo inferiore, quindi eseguire l’escalation di turni ambigui, rischiosi o ad alto valore a Claude Opus 5. Questo schema mantiene il modello premium focalizzato sul lavoro in cui un ragionamento più profondo cambia l’esito.
Usa la Claude Opus 5 API per agent di coding difficili, debug della causa radice, refactor multi-file, code review, analisi di documenti enterprise, modellazione finanziaria, revisione legale, ragionamento scientifico, ricerca a lungo contesto, generazione di report professionali e automazione delle operazioni. Su CometAPI, lo schema di distribuzione più forte è l’escalation selettiva: testa Claude Opus 5 rispetto a Claude Sonnet 5, Claude Fable 5 e alternative non-Claude, quindi instrada ogni carico di lavoro in base al costo per risultato accettato piuttosto che alla sola reputazione del modello.
Perché usare CometAPI per Claude Opus 5?
CometAPI è utile per Claude Opus 5 quando un team desidera una sola chiave API, fatturazione unificata, confronto tra modelli e migrazione più semplice tra provider. CometAPI documenta sia un endpoint nativo Anthropic Messages sia un endpoint Chat Completions compatibile con OpenAI, così i team possono scegliere i controlli nativi di Claude per workflow avanzati o mantenere una forma di integrazione portabile per routing multi-modello.
Limitazioni
Claude Opus 5 è un modello di ragionamento premium, non la scelta predefinita per ogni richiesta. A impostazioni di sforzo più alte, può consumare più token e produrre una latenza maggiore del tempo al primo token rispetto a modelli più leggeri. Artificial Analysis riporta 68.04 secondi al primo token di risposta per la sua misurazione a sforzo massimo, il che rende importante l’instradamento e la selezione dello sforzo per le app rivolte agli utenti.
Gli sviluppatori dovrebbero anche evitare di assumere comportamenti non supportati. Anthropic non ha divulgato il numero di parametri del modello e i pesi del modello sono proprietari. Fast mode è in anteprima di ricerca sulla Claude API, non su tutte le piattaforme cloud. Fallback lato server e modifiche agli strumenti a metà conversazione sono funzionalità beta. Per i workflow di sicurezza, Anthropic afferma che Opus 5 può supportare casi d’uso benefici di individuazione di vulnerabilità ma applica salvaguardie ai task a rischio più elevato come scansione di vulnerabilità basata su binari, penetration testing e generazione di exploit.