GPT-4.1 nano è un modello di intelligenza artificiale fornito da OpenAI. gpt-4.1-nano: Presenta una finestra di contesto più ampia—supporta fino a 1 million token di contesto ed è in grado di sfruttare meglio tale contesto grazie a una comprensione migliorata dei contesti lunghi. Dispone di un limite di conoscenza aggiornato a giugno 2024. Questo modello supporta una lunghezza massima del contesto di 1,047,576 token.

seedance-2-0

Il modello di generazione di immagini più avanzato di OpenAI, con resa del testo quasi perfetta in più lingue, fino alla risoluzione 4K, e la Thinking Mode basata sul ragionamento. Progettato per flussi di lavoro in produzione che richiedono accuratezza, velocità e output visivo in linea con il brand.
.jpeg&w=3840&q=75)
Il modello di punta più intelligente e intuitivo di OpenAI, progettato per programmazione complessa, flussi di lavoro basati su agenti, uso del computer, analisi dei dati e ricerca approfondita. Offre un’intelligenza all’avanguardia con la stessa bassa latenza di GPT-5.4, completando le attività con una maggiore efficienza nell’uso dei token. Il modello di riferimento per carichi di lavoro professionali e aziendali impegnativi.

Il modello più avanzato di OpenAI, progettato per i compiti più difficili e per flussi di lavoro agentici di lunga durata. GPT-5.5 Pro eccelle nella programmazione complessa, nell’uso del computer, nella ricerca approfondita, nell’analisi dei dati e nel ragionamento scientifico — offrendo un’intelligenza di livello di frontiera con la latenza di GPT-5.4 e una maggiore efficienza nell’uso dei token. Ideale per casi d’uso aziendali e professionali che richiedono il massimo standard di accuratezza e un’esecuzione autonoma dei compiti.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro è il nostro modello di generazione di contenuti multimediali più avanzato e potente, in grado di generare video con audio sincronizzato. Può creare clip video dettagliate e dinamiche a partire da linguaggio naturale o immagini.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

Modello di generazione di video estremamente potente, con effetti sonori e supporto per il formato chat.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat è un modello linguistico conversazionale ottimizzato tramite istruzioni per chat, ragionamento e scrittura di uso generale. Supporta conversazioni a più turni, sintesi, redazione di bozze, QA su basi di conoscenza e assistenza al codice leggera per assistenti in-app, automazione del supporto e copiloti per i flussi di lavoro. Le principali caratteristiche tecniche includono allineamento ottimizzato per la chat, output controllabili e strutturati e percorsi di integrazione per l'invocazione di strumenti e i flussi di lavoro di recupero, quando disponibili.
GPT-5.1 è un modello linguistico general-purpose messo a punto per seguire istruzioni, focalizzato sulla generazione di testo e sul ragionamento nei flussi di lavoro di prodotto. Supporta conversazioni multi-turno, formattazione di output strutturati e attività orientate al codice come stesura, refactoring e spiegazione. Gli utilizzi tipici includono assistenti conversazionali, QA potenziato dal recupero, trasformazione dei dati e automazione in stile agente con strumenti o API, se supportati. I punti salienti tecnici includono una modalità incentrata sul testo, il rispetto delle istruzioni, output in stile JSON e compatibilità con le chiamate di funzione nei comuni framework di orchestrazione.
Versione a costo ottimizzato di GPT Image 1. È un modello linguistico multimodale nativo che accetta input sia di testo sia di immagini e genera output di immagini.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5 è il modello di programmazione più potente di OpenAI fino ad oggi. Mostra miglioramenti significativi nella generazione di front-end complessi e nel debug di grandi codebase. Può trasformare le idee in realtà con risultati intuitivi ed esteticamente gradevoli, creando siti web, applicazioni e giochi belli e responsive, con uno spiccato senso dell'estetica, tutto a partire da un unico prompt. I primi tester hanno inoltre notato le sue scelte di design, con una comprensione più profonda di elementi come spaziatura, tipografia e spazio bianco.
GPT-5 Nano è un modello di intelligenza artificiale fornito da OpenAI.
GPT-5 mini è il membro della famiglia GPT-5 ottimizzato per costi e latenza di OpenAI, progettato per offrire gran parte dei punti di forza multimodali e di aderenza alle istruzioni di GPT-5 a un costo notevolmente inferiore per l’uso in produzione su larga scala. Si rivolge ad ambienti in cui la capacità di elaborazione, la prevedibilità dei prezzi per token e la rapidità delle risposte sono i vincoli principali, pur offrendo solide capacità generali.
GPT-5 Chat (latest) è un modello di intelligenza artificiale fornito da OpenAI.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro è una variante “pro” del modello di ragionamento o3, progettata per pensare più a lungo e fornire le risposte più affidabili impiegando un apprendimento per rinforzo della catena di ragionamento privata e stabilendo nuovi benchmark allo stato dell’arte in ambiti come la scienza, la programmazione e il business — integrando al contempo in modo autonomo strumenti quali la ricerca sul web, l’analisi dei file, l’esecuzione di Python e il ragionamento visivo all’interno dell’API.
Una versione economica del GPT in tempo reale—capace di rispondere agli input audio e testuali in tempo reale tramite connessioni WebRTC, WebSocket o SIP.

Sintesi vocale di OpenAI

Da parlato a testo, creazione di traduzioni
GPT-4o mini TTS è un modello neurale di sintesi vocale progettato per una generazione della voce naturale e a bassa latenza nelle applicazioni rivolte agli utenti. Converte il testo in parlato dal suono naturale con voci selezionabili, output multiformato e sintesi in streaming per esperienze reattive. Gli usi tipici includono assistenti vocali, IVR e flussi di contatto, lettura ad alta voce dei contenuti di prodotto e narrazione di contenuti multimediali. I principali aspetti tecnici includono lo streaming basato su API e l’esportazione nei formati audio più comuni, come MP3 e WAV.
GPT-4o Transcribe è un modello di trascrizione da audio a testo per il riconoscimento vocale multilingue a bassa latenza. Supporta lo streaming in tempo reale e la trascrizione in modalità batch dai formati audio comuni, con punteggiatura e segmentazione in frasi. Gli usi tipici includono sottotitoli in tempo reale, input per assistenti vocali, note di riunione e trascrizione di contenuti multimediali o di registrazioni di chiamate. Tra i punti salienti tecnici figurano il supporto della modalità audio, l’elaborazione di contenuti di lunga durata e API adatte a flussi di lavoro interattivi e lato server.
GPT-4o mini Audio Preview è un modello multimodale compatto per creare applicazioni audio conversazionali. Supporta input e output vocali insieme al testo, abilitando il riconoscimento vocale, la sintesi vocale e dialoghi misti testo-audio con chiamate a strumenti/funzioni per azioni strutturate. Gli usi tipici includono assistenti vocali, trascrizione in streaming con riepilogo, flussi di lavoro IVR e call-bot e assistenti in-app con funzionalità audio. I punti salienti tecnici includono I/O audio, risposte in streaming, rispetto delle istruzioni e integrazione tramite le API di chat e degli strumenti.
GPT-4o mini Realtime Preview è un modello multimodale in tempo reale per esperienze vocali e visive interattive. Gestisce voce, testo e immagini con input e output in streaming, oltre all’invocazione di strumenti/funzioni per azioni ancorate al contesto. Gli utilizzi tipici includono assistenti vocali, gestione di chiamate in tempo reale, sottotitolazione in tempo reale e question answering visivo sui contenuti della fotocamera o dello schermo. Le principali caratteristiche tecniche includono audio bidirezionale, comprensione visiva, risposte in streaming e output strutturati tramite funzioni.

GPT-4o mini Audio è un modello multimodale per interazioni vocali e testuali. Esegue riconoscimento vocale, traduzione e sintesi vocale, segue le istruzioni e può richiamare strumenti per azioni strutturate con risposte in streaming. Gli usi tipici includono assistenti vocali in tempo reale, sottotitolazione e traduzione in tempo reale, riassunto delle chiamate e applicazioni controllate dalla voce. Le caratteristiche tecniche principali includono input e output audio, risposte in streaming, chiamata di funzioni e output JSON strutturato.
La Realtime API consente agli sviluppatori di creare esperienze multimodali a bassa latenza, inclusa la funzionalità da parlato a parlato. Il testo e l'audio elaborati dalla Realtime API sono tariffati separatamente. Questo modello supporta una lunghezza massima del contesto di 128,000 token.
Questo modello supporta una lunghezza massima del contesto di 128,000 token.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini è un modello di intelligenza artificiale fornito da OpenAI.
O3-mini è un modello di intelligenza artificiale fornito da OpenAI.
O3 è un modello di intelligenza artificiale fornito da OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini è un modello di intelligenza artificiale fornito da OpenAI.
<div>GPT-4o è il modello multimodale più avanzato di OpenAI, più veloce ed economico di GPT-4 Turbo, con capacità visive più avanzate. Questo modello dispone di un contesto di 128K e di un limite di conoscenza fissato a ottobre 2023. I modelli della serie 1106 e successive supportano tool_calls e function_call.</div> Questo modello supporta una lunghezza massima del contesto di 128,000 token.
GPT-4.1 mini è un modello di intelligenza artificiale fornito da OpenAI. gpt-4.1-mini: Un salto significativo nelle prestazioni dei modelli di piccole dimensioni, superando persino GPT-4o in molti benchmark. Eguaglia o supera GPT-4o nei test di intelligenza, riducendo al contempo la latenza di quasi la metà e il costo dell'83%. Questo modello supporta una lunghezza massima del contesto di 1,047,576 token.
GPT-4.1 è un modello di intelligenza artificiale fornito da OpenAI. gpt-4.1-nano: Presenta una finestra di contesto più ampia—supporta fino a 1 milione di token di contesto ed è in grado di sfruttare meglio tale contesto grazie a una comprensione migliorata dei contesti lunghi. Ha un limite di conoscenza aggiornato a giugno 2024. Questo modello supporta una lunghezza massima del contesto di 1,047,576 token.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon