GPT-4.1 nano est un modèle d’intelligence artificielle fourni par OpenAI. gpt-4.1-nano: Propose une fenêtre de contexte plus large — prenant en charge jusqu’à 1 million de jetons de contexte et capable d’exploiter plus efficacement ce contexte grâce à une meilleure compréhension des longs contextes. Dispose d’une date de coupure des connaissances actualisée à juin 2024. Ce modèle prend en charge une longueur de contexte maximale de 1,047,576 jetons.

seedance-2-0

Le modèle de génération d’images le plus performant d’OpenAI, avec un rendu de texte quasi parfait dans de multiples langues, jusqu’à une résolution 4K, et un Thinking Mode alimenté par le raisonnement. Conçu pour des flux de production exigeant la précision, la rapidité et des résultats visuels conformes à la marque.
.jpeg&w=3840&q=75)
Le modèle phare le plus intelligent et le plus intuitif d’OpenAI, conçu pour la programmation complexe, les flux de travail pilotés par des agents, l’utilisation de l’ordinateur, l’analyse de données et la recherche approfondie. Offre une intelligence de pointe avec la même faible latence que GPT-5.4, tout en exécutant les tâches avec une efficacité d’utilisation des jetons accrue. Le modèle de référence pour les charges de travail professionnelles et d’entreprise les plus exigeantes.

Le modèle le plus performant d'OpenAI, conçu pour les tâches les plus difficiles et des workflows agentiques de longue durée. GPT-5.5 Pro excelle en programmation complexe, utilisation de l'ordinateur, recherche approfondie, analyse de données et raisonnement scientifique — offrant une intelligence de pointe avec la latence de GPT-5.4 et une meilleure efficacité des jetons. Idéal pour les cas d'usage en entreprise et professionnels exigeant le plus haut niveau de précision et une exécution autonome des tâches.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro est notre modèle de génération de médias le plus avancé et le plus puissant, capable de générer des vidéos avec audio synchronisé. Il peut créer des clips vidéo détaillés et dynamiques à partir de langage naturel ou d’images.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

Modèle de génération vidéo ultra-puissant, avec des effets sonores, prend en charge le format conversationnel.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat est un modèle de langage conversationnel affiné sur des instructions, destiné au chat, au raisonnement et à la rédaction à usage général. Il prend en charge les dialogues multi-tours, la synthèse, la rédaction de brouillons, les questions-réponses sur une base de connaissances, ainsi qu’une assistance légère au codage pour les assistants intégrés aux applications, l’automatisation du support et les copilotes de flux de travail. Parmi ses points forts techniques figurent un alignement optimisé pour le chat, des sorties contrôlables et structurées, ainsi que des voies d’intégration pour l’invocation d’outils et les flux de travail de récupération lorsqu’ils sont disponibles.
GPT-5.1 est un modèle de langage généraliste entraîné à suivre des instructions, axé sur la génération de texte et le raisonnement à travers les flux de travail liés aux produits. Il prend en charge les dialogues multi-tours, le formatage de sorties structurées et des tâches orientées code telles que la rédaction, la refactorisation et l’explication. Les usages typiques incluent des assistants conversationnels, des questions-réponses augmentées par recherche, la transformation de données et une automatisation de type agent avec des outils ou des API lorsque cela est pris en charge. Ses points forts techniques incluent une modalité centrée sur le texte, le suivi d’instructions, des sorties au format JSON et la compatibilité avec l’appel de fonctions dans les frameworks d’orchestration courants.
Version optimisée en termes de coûts de GPT Image 1. Il s’agit d’un modèle de langage multimodal natif qui accepte à la fois des entrées de texte et d’image et génère des images en sortie.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5 est, à ce jour, le modèle de codage le plus puissant d'OpenAI. Il présente des améliorations significatives dans la génération d’interfaces front-end complexes et le débogage de larges bases de code. Il peut transformer des idées en réalité, avec des résultats intuitifs et esthétiquement plaisants, en créant des sites web, des applications et des jeux beaux et adaptatifs, avec un sens aigu de l’esthétique, le tout à partir d’un seul prompt. Les premiers testeurs ont également relevé ses choix de design, ainsi qu’une compréhension plus approfondie d’éléments comme l’espacement, la typographie et les espaces blancs.
GPT-5 Nano est un modèle d'intelligence artificielle fourni par OpenAI.
GPT-5 mini est le membre de la famille GPT-5 d’OpenAI optimisé pour le coût et la latence, conçu pour offrir une grande partie des atouts multimodaux et de suivi d’instructions de GPT-5 à un coût nettement inférieur pour une utilisation en production à grande échelle. Il vise des environnements où le débit, une tarification prévisible par jeton et des réponses rapides constituent les principales contraintes, tout en fournissant de solides capacités polyvalentes.
GPT-5 Chat (dernière version) est un modèle d'intelligence artificielle fourni par OpenAI.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro est une variante « pro » du modèle de raisonnement o3, conçue pour réfléchir plus longtemps et fournir les réponses les plus fiables en employant un apprentissage par renforcement sur des chaînes de raisonnement privées et en établissant de nouvelles références de pointe dans des domaines tels que la science, la programmation et l’entreprise—tout en intégrant de manière autonome des outils tels que la recherche web, l’analyse de fichiers, l’exécution Python et le raisonnement visuel au sein de l’API.
Une version économique du GPT en temps réel — capable de répondre en temps réel aux entrées audio et textuelles via des connexions WebRTC, WebSocket ou SIP.

OpenAI Text-to-Speech

Conversion de la parole en texte, création de traductions
GPT-4o mini TTS est un modèle neuronal de synthèse vocale conçu pour une génération vocale naturelle et à faible latence dans des applications destinées aux utilisateurs finaux. Il convertit le texte en parole au rendu naturel, avec des voix sélectionnables, une sortie multi-format et une synthèse en streaming pour des expériences réactives. Les cas d’utilisation typiques incluent les assistants vocaux, les SVI et les flux de contacts, la lecture à voix haute de produits et la narration pour les médias. Parmi les points techniques clés figurent le streaming basé sur API et l’exportation vers des formats audio courants tels que MP3 et WAV.
GPT-4o Transcribe est un modèle de transcription audio en texte pour une reconnaissance vocale multilingue à faible latence. Il prend en charge le streaming en temps réel et la transcription par lots à partir de formats audio courants, avec ponctuation et segmentation des phrases. Les cas d’usage typiques incluent les sous-titres en direct, la saisie pour assistants vocaux, la prise de notes de réunion, et la transcription de médias ou d’enregistrements d’appels. Les points forts techniques incluent la prise en charge de la modalité audio, le traitement de contenus longs, et des API adaptées aux flux de travail interactifs et côté serveur.
GPT-4o mini Audio Preview est un modèle multimodal compact pour créer des applications audio conversationnelles. Il prend en charge l’entrée et la sortie vocales en plus du texte, permettant la reconnaissance vocale, la synthèse vocale et des dialogues mixtes texte-audio avec des appels d’outils et de fonctions pour des actions structurées. Les cas d’utilisation typiques incluent les assistants vocaux, la transcription en streaming avec résumé, les workflows IVR et de call-bot, ainsi que des assistants intégrés aux applications compatibles audio. Parmi les points techniques clés figurent l’E/S audio, les réponses en streaming, le suivi d’instructions et l’intégration via les API de chat et d’outils.
GPT-4o mini Realtime Preview est un modèle multimodal en temps réel pour des expériences vocales et visuelles interactives. Il prend en charge la parole, le texte et les images avec des entrées et des sorties en streaming, ainsi que l’appel d’outils/de fonctions pour des actions ancrées. Les cas d’usage typiques incluent les assistants vocaux, la gestion d’appels en direct, le sous-titrage en temps réel et le question-réponse visuel sur le contenu de la caméra ou de l’écran. Les points forts techniques incluent l’audio bidirectionnel, la compréhension visuelle, des réponses en streaming et des sorties structurées via des fonctions.

GPT-4o mini Audio est un modèle multimodal pour les interactions vocales et textuelles. Il effectue la reconnaissance vocale, la traduction et la synthèse vocale, suit les instructions et peut appeler des outils pour des actions structurées avec des réponses en streaming. Les cas d’utilisation typiques comprennent les assistants vocaux en temps réel, le sous-titrage et la traduction en direct, le résumé d’appels et les applications contrôlées par la voix. Les points forts techniques comprennent l’entrée et la sortie audio, des réponses en streaming, l’appel de fonctions et une sortie JSON structurée.
La Realtime API permet aux développeurs de créer des expériences multimodales à faible latence, y compris une fonctionnalité de parole à parole. Le texte et l'audio traités par la Realtime API sont facturés séparément. Ce modèle prend en charge une longueur de contexte maximale de 128,000 jetons.
Ce modèle prend en charge une longueur de contexte maximale de 128,000 jetons.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini est un modèle d'intelligence artificielle fourni par OpenAI.
O3-mini est un modèle d’intelligence artificielle fourni par OpenAI.
O3 est un modèle d'intelligence artificielle fourni par OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini est un modèle d'intelligence artificielle fourni par OpenAI.
<div>GPT-4o est le modèle multimodal le plus avancé d'OpenAI, plus rapide et moins coûteux que GPT-4 Turbo, avec des capacités visuelles plus performantes. Ce modèle dispose d'un contexte de 128K et d'une date de coupure des connaissances en octobre 2023. Les modèles de la série 1106 et ultérieures prennent en charge tool_calls et function_call.</div> Ce modèle prend en charge une longueur de contexte maximale de 128,000 jetons.
GPT-4.1 mini est un modèle d’intelligence artificielle fourni par OpenAI. gpt-4.1-mini : Un bond significatif des performances des petits modèles, surpassant même GPT-4o sur de nombreux benchmarks. Il égale ou dépasse GPT-4o dans les évaluations d’intelligence tout en réduisant la latence de près de moitié et les coûts de 83 %. Ce modèle prend en charge une longueur de contexte maximale de 1,047,576 jetons.
GPT-4.1 est un modèle d’intelligence artificielle fourni par OpenAI. gpt-4.1-nano : offre une fenêtre de contexte plus large — prenant en charge jusqu’à 1 million de jetons de contexte et capable de mieux exploiter ce contexte grâce à une meilleure compréhension des contextes longs. La date de coupure des connaissances a été mise à jour à juin 2024. Ce modèle prend en charge une longueur de contexte maximale de 1,047,576 jetons.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon