GPT-4.1 nano é um modelo de inteligência artificial fornecido pela OpenAI. gpt-4.1-nano: Apresenta uma janela de contexto maior—oferecendo suporte a até 1 milhão de tokens de contexto e capaz de utilizar melhor esse contexto por meio de uma compreensão aprimorada de contextos longos. Possui uma data de corte de conhecimento atualizada para junho de 2024. Este modelo oferece suporte a um comprimento máximo de contexto de 1,047,576 tokens.

seedance-2-0

O modelo de geração de imagens mais avançado da OpenAI, com renderização de texto quase perfeita em vários idiomas, resolução de até 4K e o Thinking Mode potencializado por raciocínio. Projetado para fluxos de trabalho de produção que exigem precisão, velocidade e resultados visuais alinhados à marca.
.jpeg&w=3840&q=75)
O modelo principal mais inteligente e intuitivo da OpenAI, projetado para programação complexa, fluxos de trabalho baseados em agentes, uso do computador, análise de dados e pesquisa aprofundada. Oferece inteligência de ponta com a mesma baixa latência do GPT-5.4, ao mesmo tempo em que conclui tarefas com maior eficiência no uso de tokens. O modelo preferido para cargas de trabalho profissionais e corporativas exigentes.

O modelo mais capaz da OpenAI, projetado para as tarefas mais difíceis e para fluxos de trabalho orientados por agentes de longa duração. O GPT-5.5 Pro se destaca em programação complexa, uso do computador, pesquisa aprofundada, análise de dados e raciocínio científico — oferecendo inteligência de ponta com latência de GPT-5.4 e maior eficiência de tokens. Ideal para casos de uso empresariais e profissionais que exigem o mais alto padrão de precisão e execução autônoma de tarefas.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro é nosso modelo de geração de mídia mais avançado e poderoso, capaz de gerar vídeos com áudio sincronizado. Ele pode criar clipes de vídeo detalhados e dinâmicos a partir de linguagem natural ou imagens.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

Modelo de geração de vídeo superpotente, com efeitos sonoros, suporta o formato de chat.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat é um modelo de linguagem conversacional ajustado por instruções para conversas de uso geral, raciocínio e escrita. Ele oferece suporte a diálogos multiturno, resumo, elaboração de rascunhos, perguntas e respostas em base de conhecimento e assistência de código leve para assistentes em aplicativos, automação de suporte e copilotos de fluxo de trabalho. Os destaques técnicos incluem alinhamento otimizado para chat, saídas controláveis e estruturadas e caminhos de integração para invocação de ferramentas e fluxos de trabalho de recuperação, quando disponíveis.
GPT-5.1 é um modelo de linguagem de uso geral, ajustado para seguir instruções, com foco na geração de texto e no raciocínio em fluxos de trabalho de produto. Ele oferece suporte a diálogos de múltiplas voltas, formatação de saída estruturada e tarefas orientadas a código, como elaboração, refatoração e explicação. Os usos típicos incluem assistentes de chat, QA com recuperação aumentada, transformação de dados e automação em estilo agente com ferramentas ou APIs quando houver suporte. Os destaques técnicos incluem modalidade centrada em texto, seguimento de instruções, saídas no estilo JSON e compatibilidade com chamadas de função em frameworks comuns de orquestração.
Versão com custo otimizado do GPT Image 1. É um modelo de linguagem multimodal nativo que aceita tanto texto quanto imagem como entrada e gera saída de imagem.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
O GPT-5 é o modelo de programação mais poderoso da OpenAI até o momento. Ele apresenta melhorias significativas na geração de front-ends complexos e na depuração de grandes bases de código. Consegue transformar ideias em realidade com resultados intuitivos e esteticamente agradáveis, criando sites, aplicativos e jogos bonitos e responsivos, com um apurado senso estético, tudo a partir de um único prompt. Os primeiros testadores também observaram suas decisões de design, com uma compreensão mais profunda de elementos como espaçamento, tipografia e espaços em branco.
O GPT-5 Nano é um modelo de inteligência artificial fornecido pela OpenAI.
GPT-5 mini é o membro otimizado para custo e latência da família GPT-5 da OpenAI, destinado a oferecer grande parte das capacidades multimodais e de seguimento de instruções do GPT-5 a um custo substancialmente menor para uso em produção em larga escala. É voltado para ambientes em que a taxa de processamento, a precificação por token previsível e as respostas rápidas são as principais restrições, sem deixar de oferecer fortes capacidades de uso geral.
GPT-5 Chat (mais recente) é um modelo de inteligência artificial fornecido pela OpenAI.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro é uma variante “pro” do modelo de raciocínio o3, projetada para raciocinar por mais tempo e fornecer as respostas mais confiáveis, empregando aprendizado por reforço com cadeia de raciocínio privada e estabelecendo novos benchmarks de ponta em domínios como ciência, programação e negócios — enquanto integra, de forma autônoma, ferramentas como pesquisa na web, análise de arquivos, execução de Python e raciocínio visual na API.
Uma versão econômica do GPT em tempo real — capaz de responder a entradas de áudio e texto em tempo real via conexões WebRTC, WebSocket ou SIP.

OpenAI Texto para Fala

请确认您的需求:是否需要将语音转文字并进行翻译?请提供: - 源内容:音频文件或已转写的文本 - 目标语言:如葡萄牙语(或其他) - 输出格式:纯文本、SRT、VTT、JSON 等 - 术语或风格偏好(可选)
GPT-4o mini TTS é um modelo neural de texto para fala projetado para geração de voz natural e de baixa latência em aplicações voltadas ao usuário. Ele converte texto em fala com som natural, com vozes selecionáveis, saída em vários formatos e síntese por streaming para experiências responsivas. Os usos típicos incluem assistentes de voz, IVR e fluxos de contato, leitura em voz alta de produtos e narração de mídia. Os destaques técnicos incluem streaming baseado em API e exportação para formatos de áudio comuns, como MP3 e WAV.
GPT-4o Transcribe é um modelo de transcrição de áudio em texto para reconhecimento de fala multilíngue e de baixa latência. Ele oferece suporte a streaming em tempo real e transcrição em lote a partir de formatos de áudio comuns, com pontuação e segmentação de frases. Os usos típicos incluem legendas ao vivo, entrada para assistentes de voz, anotações de reuniões e transcrição de mídia ou de gravações de chamadas. Os destaques técnicos incluem suporte à modalidade de áudio, processamento de áudio de longa duração e APIs adequadas para fluxos de trabalho interativos e do lado do servidor.
GPT-4o mini Audio Preview é um modelo multimodal compacto para criar aplicativos de áudio conversacional. Ele suporta entrada e saída de voz, além de texto, possibilitando reconhecimento de fala, síntese de fala e diálogos mistos de texto e áudio com chamadas a ferramentas/funções para ações estruturadas. Casos de uso típicos incluem assistentes de voz, transcrição em streaming com sumarização, fluxos de trabalho de IVR e call-bots e assistentes no aplicativo com áudio habilitado. Os destaques técnicos incluem entrada/saída de áudio, respostas em streaming, seguimento de instruções e integração via APIs de chat e de ferramentas.
GPT-4o mini Realtime Preview é um modelo multimodal em tempo real para experiências interativas de voz e visão. Ele processa fala, texto e imagens com entrada e saída em streaming, além de chamadas a ferramentas/funções para ações fundamentadas. Os usos típicos incluem assistentes de voz, atendimento de chamadas ao vivo, legendagem em tempo real e resposta a perguntas visuais sobre conteúdo da câmera ou da tela. Os destaques técnicos incluem áudio bidirecional, compreensão visual, respostas em streaming e saídas estruturadas via funções.

GPT-4o mini Audio é um modelo multimodal para interações de fala e texto. Ele realiza reconhecimento de fala, tradução e conversão de texto em fala, segue instruções e pode acionar ferramentas para ações estruturadas com respostas em streaming. Os usos típicos incluem assistentes de voz em tempo real, legendagem e tradução ao vivo, resumo de chamadas e aplicações controladas por voz. Os destaques técnicos incluem entrada e saída de áudio, respostas em streaming, chamadas de função e saída JSON estruturada.
A Realtime API permite que desenvolvedores criem experiências multimodais de baixa latência, incluindo funcionalidade de fala para fala. Texto e áudio processados pela Realtime API são cobrados separadamente. Este modelo oferece suporte a um comprimento máximo de contexto de 128,000 tokens.
Este modelo suporta um comprimento máximo de contexto de 128,000 tokens.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini é um modelo de inteligência artificial fornecido pela OpenAI.
O3-mini é um modelo de inteligência artificial fornecido pela OpenAI.
O3 é um modelo de inteligência artificial fornecido pela OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini é um modelo de inteligência artificial fornecido pela OpenAI.
<div>GPT-4o é o modelo multimodal mais avançado da OpenAI, mais rápido e mais barato do que o GPT-4 Turbo, com capacidades visuais mais avançadas. Este modelo tem um contexto de 128K e um limite de conhecimento até outubro de 2023. Os modelos da série 1106 e posteriores oferecem suporte a tool_calls e function_call.</div> Este modelo oferece suporte a um comprimento máximo de contexto de 128,000 tokens.
GPT-4.1 mini é um modelo de inteligência artificial fornecido pela OpenAI. gpt-4.1-mini: Um salto significativo no desempenho de modelos pequenos, superando até o GPT-4o em muitos benchmarks. Ele iguala ou supera o GPT-4o em avaliações de inteligência, ao mesmo tempo que reduz a latência em quase metade e o custo em 83%. Este modelo suporta um comprimento máximo de contexto de 1,047,576 tokens.
GPT-4.1 é um modelo de inteligência artificial fornecido pela OpenAI. gpt-4.1-nano: Apresenta uma janela de contexto maior—suportando até 1 milhão de tokens de contexto e capaz de utilizar melhor esse contexto por meio de uma compreensão aprimorada de contextos longos. Possui uma data de corte de conhecimento atualizada para junho de 2024. Este modelo suporta um comprimento máximo de contexto de 1,047,576 tokens.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon