
GPT-6 Sol
Explora la API de GPT-6 Sol.

Explora la API de GPT-6 Sol.

GPT-6 Astra, the flagship model for complex reasoning and coding. Choose GPT-5.6 Terra to balance intelligence and cost,

El modelo de generación de imágenes más avanzado de OpenAI, con un renderizado de texto casi perfecto en múltiples idiomas, resolución de hasta 4K y el Thinking Mode impulsado por razonamiento. Diseñado para flujos de trabajo de producción que exigen precisión, velocidad y resultados visuales coherentes con la marca.

Explora la API de gpt-oss-20b(free).

GPT-5.4 Mini is a lightweight and efficient AI model optimized for speed and everyday productivity. It provides reliable conversational capabilities, content generation, and task assistance while maintaining low latency and resource usage.

Explora la API de GPT Image 2.5(sunburst).
GPT-Realtime-2 is our most capable realtime voice model. It supports speech-to-speech interactions with configurable reasoning effort, stronger instruction following, and more reliable tool use for complex voice-agent workflows

GPT-5.4 Nano is an ultra-lightweight AI model built for maximum speed and efficiency. It is optimized for simple tasks, real-time interactions, and large-scale deployments where low latency and minimal resource consumption are essential.

seedance-2-0

The best voice model for audio in, audio out.

El modelo más capaz de OpenAI, diseñado para las tareas más difíciles y para flujos de trabajo de agentes de larga duración. GPT-5.5 Pro destaca en programación compleja, uso de la computadora, investigación en profundidad, análisis de datos y razonamiento científico — ofreciendo inteligencia de vanguardia con la latencia de GPT-5.4 y mayor eficiencia de tokens. Ideal para casos de uso empresariales y profesionales que exigen el nivel más alto de precisión y ejecución autónoma de tareas.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT Image 2 ALL is a comprehensive image generation model designed to handle a wide range of creative and professional visual tasks. It combines high-quality image creation, advanced prompt understanding, and versatile style support to deliver exceptional results across diverse use cases.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.
GPT-5.1 es un modelo de lenguaje de propósito general ajustado mediante instrucciones, centrado en la generación de texto y el razonamiento en flujos de trabajo de producto. Admite diálogo de múltiples turnos, formateo de salidas estructuradas y tareas orientadas al código, como redacción, refactorización y explicación. Los usos típicos incluyen asistentes de chat, preguntas y respuestas aumentadas mediante recuperación, transformación de datos y automatización al estilo agente con herramientas o APIs cuando están disponibles. Los aspectos técnicos destacados incluyen una modalidad centrada en el texto, seguimiento de instrucciones, salidas de estilo JSON y compatibilidad con llamadas a funciones en marcos de orquestación comunes.
Versión optimizada en costos de GPT Image 1. Es un modelo de lenguaje multimodal nativo que admite como entrada tanto texto como imágenes y genera imágenes como salida.
GPT-5 es el modelo de programación más potente de OpenAI hasta la fecha. Muestra mejoras significativas en la generación de front-end complejos y en la depuración de grandes bases de código. Puede transformar ideas en realidad con resultados intuitivos y estéticamente atractivos, creando sitios web, aplicaciones y juegos bellos y responsivos con un agudo sentido estético, todo a partir de un único prompt. Los primeros evaluadores también han señalado sus elecciones de diseño, con una comprensión más profunda de elementos como el espaciado, la tipografía y el espacio en blanco.
GPT-5 Nano es un modelo de inteligencia artificial proporcionado por OpenAI.
GPT-5 mini es el miembro de la familia GPT-5 de OpenAI optimizado en costos y latencia, diseñado para ofrecer gran parte de las capacidades multimodales y de seguimiento de instrucciones de GPT-5 a un costo sustancialmente menor para su uso en producción a gran escala. Está orientado a entornos donde el rendimiento, los precios por token predecibles y las respuestas rápidas son las principales restricciones, a la vez que sigue proporcionando sólidas capacidades de propósito general.
coming soon
gpt-4o-image generate images as output, optionally using images as input

Sora 2 Pro es nuestro modelo de generación multimedia más avanzado y potente, capaz de generar videos con audio sincronizado. Puede crear clips de video detallados y dinámicos a partir de lenguaje natural o imágenes.

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.

Explora la API de GPT Image 2.5 Flare.
OpenAI o3‑pro es una variante “pro” del modelo de razonamiento o3, diseñada para pensar durante más tiempo, ofrecer las respuestas más fiables mediante el uso de aprendizaje por refuerzo con cadena de pensamiento privada y establecer nuevos estándares de última generación en ámbitos como la ciencia, la programación y los negocios—mientras integra de forma autónoma herramientas como la búsqueda en la web, el análisis de archivos, la ejecución de Python y el razonamiento visual dentro de la API.

Texto a voz de OpenAI

Modelo de generación de video súper potente, con efectos de sonido, admite formato de chat.

Transcripción de voz a texto, creación de traducciones
.jpeg&w=3840&q=75)
El modelo insignia más inteligente e intuitivo de OpenAI, diseñado para programación compleja, flujos de trabajo basados en agentes, uso de computadoras, análisis de datos e investigación en profundidad. Ofrece inteligencia de vanguardia con la misma baja latencia que GPT-5.4, al tiempo que completa tareas con mayor eficiencia en el uso de tokens. El modelo de referencia para cargas de trabajo profesionales y empresariales exigentes.
Explora la API de tts-1.
GPT-4o mini TTS es un modelo neuronal de texto a voz diseñado para la generación de voz natural y de baja latencia en aplicaciones orientadas al usuario. Convierte texto en voz con sonido natural, con voces seleccionables, salida en múltiples formatos y síntesis en streaming para experiencias con gran capacidad de respuesta. Los usos típicos incluyen asistentes de voz, IVR y flujos de contacto, lectura en voz alta de productos y narración de medios. Los aspectos técnicos destacados incluyen transmisión basada en API y exportación a formatos de audio comunes como MP3 y WAV.
Explora la API de o1-pro-2025-03-19.
GPT-4o Transcribe es un modelo de audio a texto para reconocimiento de voz multilingüe y de baja latencia. Admite transmisión en tiempo real y transcripción por lotes a partir de formatos de audio comunes, con puntuación y segmentación de oraciones. Los usos típicos incluyen subtítulos en tiempo real, entrada para asistentes de voz, notas de reuniones y transcripción de medios o grabaciones de llamadas. Entre los aspectos técnicos destacados se incluyen compatibilidad con la modalidad de audio, procesamiento de contenidos de larga duración y APIs adecuadas para flujos de trabajo interactivos y del lado del servidor.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.
GPT-4o mini Audio Preview es un modelo multimodal compacto para crear aplicaciones de audio conversacionales. Admite entrada y salida de voz junto con texto, lo que permite el reconocimiento de voz, la síntesis de voz y diálogos mixtos texto-audio con invocación de herramientas y funciones para acciones estructuradas. Los usos típicos incluyen asistentes de voz, transcripción en streaming con resumen, flujos de trabajo de IVR y de bots de llamadas, y asistentes integrados en la aplicación con funciones de audio. Los aspectos técnicos destacados incluyen E/S de audio, respuestas en streaming, seguimiento de instrucciones e integración mediante las APIs de chat y de herramientas.
GPT-4o mini Realtime Preview es un modelo multimodal en tiempo real para experiencias interactivas de voz y visuales. Procesa voz, texto e imágenes con entrada y salida en streaming, además de llamadas a herramientas/funciones para acciones fundamentadas. Los casos de uso típicos incluyen asistentes de voz, gestión de llamadas en vivo, subtitulado en tiempo real y respuesta a preguntas visuales sobre contenido de cámara o de pantalla. Entre los aspectos técnicos destacados se incluyen audio bidireccional, comprensión visual, respuestas en streaming y salidas estructuradas mediante funciones.
Explora la API de o1-2024-12-17.

GPT-5.3 Instant model used in ChatGPT

GPT-4o mini Audio es un modelo multimodal para interacciones de voz y texto. Realiza reconocimiento de voz, traducción y conversión de texto a voz, sigue instrucciones y puede invocar herramientas para acciones estructuradas con respuestas en streaming. Los usos típicos incluyen asistentes de voz en tiempo real, subtitulación y traducción en vivo, resumen de llamadas y aplicaciones controladas por voz. Los aspectos técnicos destacados incluyen entrada y salida de audio, respuestas en streaming, llamadas a funciones y salida JSON estructurada.
Explora la API de omni-moderation-2024-09-26.
Explora la API de omni-moderation-latest.
Explora la API de tts-1-hd-1106.

The best voice model for audio in, audio out with Chat Completions.
Explora la API de tts-1-1106.
GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.
Explora la API de tts-1-hd.

Start with GPT-5.6 Sol for complex reasoning and coding, choose GPT-5.6 Terra to balance intelligence and cost, or use GPT-5.6 Luna for cost-sensitive, high-volume workloads.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.

Coming Soon

Coming Soon

coming soon
O4-mini es un modelo de inteligencia artificial proporcionado por OpenAI.
O3-mini es un modelo de inteligencia artificial proporcionado por OpenAI.
O3 es un modelo de inteligencia artificial proporcionado por OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini es un modelo de inteligencia artificial proporcionado por OpenAI.
<div>GPT-4o es el modelo multimodal más avanzado de OpenAI, más rápido y económico que GPT-4 Turbo, con capacidades visuales más potentes. Este modelo tiene un contexto de 128K y un límite de conocimiento de octubre de 2023. Los modelos de la serie 1106 y superiores admiten tool_calls y function_call.</div> Este modelo admite una longitud máxima de contexto de 128,000 tokens.
GPT-4.1 nano es un modelo de inteligencia artificial proporcionado por OpenAI. gpt-4.1-nano: Ofrece una ventana de contexto más amplia—admite hasta 1 millón de tokens de contexto y es capaz de aprovechar mejor ese contexto gracias a una comprensión de largo contexto mejorada. Tiene una fecha de corte de conocimiento actualizada a junio de 2024. Este modelo admite una longitud máxima de contexto de 1,047,576 tokens.
GPT-4.1 mini es un modelo de inteligencia artificial proporcionado por OpenAI. gpt-4.1-mini: un salto significativo en el rendimiento de modelos pequeños, incluso superando a GPT-4o en muchas pruebas de referencia. Está a la par de GPT-4o o lo supera en evaluación de inteligencia, mientras reduce la latencia casi a la mitad y el costo en un 83%. Este modelo admite una longitud máxima de contexto de 1,047,576 tokens.
GPT-4.1 es un modelo de inteligencia artificial proporcionado por OpenAI. gpt-4.1-nano: Presenta una ventana de contexto más amplia—admite hasta 1 millón de tokens de contexto y es capaz de aprovechar mejor ese contexto gracias a una comprensión mejorada de contextos largos. Tiene una fecha de corte de conocimiento actualizada a junio de 2024. Este modelo admite una longitud máxima de contexto de 1,047,576 tokens.