GPT-4.1 nano — модель искусственного интеллекта, предоставляемая OpenAI. gpt-4.1-nano: Обладает увеличенным контекстным окном — поддерживает до 1 миллиона токенов контекста и способна лучше использовать этот контекст благодаря улучшенному пониманию длинного контекста. Имеет обновленную дату отсечения знаний: июнь 2024 года. Эта модель поддерживает максимальную длину контекста 1,047,576 токенов.

seedance-2-0

Самая мощная модель генерации изображений OpenAI, обеспечивающая почти безупречное отображение текста на множестве языков, разрешение до 4K и режим Thinking Mode, основанный на рассуждении. Создана для продакшен-процессов, которые требуют точности, скорости и визуального результата, соответствующего фирменному стилю.
.jpeg&w=3840&q=75)
Самая интеллектуальная и интуитивно понятная флагманская модель OpenAI, предназначенная для сложного программирования, агентных рабочих процессов, управления компьютером, анализа данных и углублённых исследований. Обеспечивает передовой уровень интеллекта при той же низкой задержке, что и GPT-5.4, при этом выполняя задачи с более высокой эффективностью использования токенов. Предпочитаемая модель для требовательных профессиональных и корпоративных рабочих нагрузок.

Самая мощная модель OpenAI, спроектированная для самых сложных задач и длительных агентных рабочих процессов. GPT-5.5 Pro превосходно справляется со сложным программированием, работой с компьютером, углублёнными исследованиями, анализом данных и научными рассуждениями — обеспечивая передовой уровень интеллекта при задержке GPT-5.4 и более эффективном использовании токенов. Идеально подходит для корпоративных и профессиональных сценариев использования, требующих высочайшего уровня точности и автономного выполнения задач.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro — наша самая передовая и мощная модель генерации медиаконтента, способная создавать видео с синхронизированным звуком. Она может создавать детализированные, динамичные видеоролики из текста на естественном языке или из изображений.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

Сверхмощная модель для генерации видео со звуковыми эффектами, поддерживает формат чата.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat — донастроенная на инструкциях разговорная языковая модель для универсального чата, рассуждений и написания текстов. Она поддерживает многоходовые диалоги, суммаризацию, подготовку черновиков, ответы на вопросы по базе знаний и легковесную помощь с кодом для встроенных в приложения ассистентов, автоматизации службы поддержки и копилотов рабочих процессов. К ключевым техническим особенностям относятся настройка, оптимизированная для чата, управляемые и структурированные выходные данные, а также интеграционные пути для вызова инструментов и рабочих процессов извлечения, когда они доступны.
GPT-5.1 — универсальная инструкционно дообученная языковая модель, ориентированная на генерацию текста и рассуждение в рамках продуктовых рабочих процессов. Она поддерживает многоходовой диалог, форматирование структурированного вывода и ориентированные на код задачи, такие как подготовка черновиков, рефакторинг и объяснение. Типичные сценарии использования включают чат-ассистенты, вопросно-ответные системы, дополненные поиском, преобразование данных и автоматизацию в агентном стиле с использованием инструментов или API при наличии поддержки. К ключевым техническим особенностям относятся текстоцентричная модальность, следование инструкциям, вывод в стиле JSON и совместимость с вызовом функций в распространённых оркестрационных фреймворках.
Оптимизированная по стоимости версия GPT Image 1. Это нативная мультимодальная языковая модель, которая принимает на вход текст и изображения и генерирует изображения.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5 — самая мощная на сегодняшний день модель для программирования от OpenAI. Она демонстрирует значительные улучшения в генерации сложного фронтенда и отладке крупных кодовых баз. Она способна превращать идеи в реальность, обеспечивая интуитивно понятные и эстетически привлекательные результаты, создавая красивые и адаптивные веб-сайты, приложения и игры с тонким чувством эстетики — всё по одному запросу. Ранние тестировщики также отметили её дизайнерские решения и более глубокое понимание таких элементов, как отступы, типографика и белое пространство.
GPT-5 Nano — модель искусственного интеллекта, предоставляемая OpenAI.
GPT-5 mini — оптимизированный по стоимости и задержке представитель семейства GPT-5 от OpenAI, предназначенный для предоставления значительной части мультимодальных возможностей и качества следования инструкциям, присущих GPT-5, при значительно более низкой стоимости для крупномасштабного промышленного применения. Он ориентирован на среды, где основными ограничениями являются пропускная способность, предсказуемая цена за токен и быстрые ответы, при этом сохраняя мощные универсальные возможности.
GPT-5 Chat (последняя версия) — модель искусственного интеллекта, предоставляемая компанией OpenAI.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro — «pro»-вариант модели рассуждений o3, спроектированный для более длительного размышления и выдачи максимально надёжных ответов за счёт применения приватного обучения с подкреплением по цепочке рассуждений и устанавливающий новые передовые бенчмарки в таких областях, как наука, программирование и бизнес — при этом автономно интегрируя в рамках API такие инструменты, как веб‑поиск, анализ файлов, выполнение кода на Python и визуальные рассуждения.
Экономичная версия GPT реального времени—способная реагировать на аудио- и текстовый ввод в режиме реального времени по соединениям WebRTC, WebSocket или SIP.

Преобразование текста в речь OpenAI

Преобразование речи в текст, создание переводов
GPT-4o mini TTS — нейросетевая модель преобразования текста в речь, предназначенная для естественной генерации речи с низкой задержкой в пользовательских приложениях. Она преобразует текст в естественно звучащую речь с возможностью выбора голосов, поддержкой вывода в нескольких форматах и потоковым синтезом для обеспечения отзывчивого взаимодействия. Типичные сценарии использования включают голосовых ассистентов, IVR и контактные сценарии, чтение вслух в продукте и дикторское сопровождение медиаконтента. К техническим особенностям относятся потоковая передача через API и экспорт в распространённые аудиоформаты, такие как MP3 и WAV.
GPT-4o Transcribe — это модель преобразования аудио в текст для многоязычного распознавания речи с низкой задержкой. Она поддерживает потоковую обработку в реальном времени и пакетное транскрибирование из распространённых аудиоформатов с расстановкой знаков препинания и сегментацией на предложения. Типичные сценарии использования включают субтитры в реальном времени, ввод для голосовых ассистентов, заметки по встречам и транскрибирование медиаконтента или записей звонков. К техническим особенностям относятся поддержка аудиомодальности, обработка длинных записей и API, подходящие для интерактивных и серверных рабочих процессов.
GPT-4o mini Audio Preview — компактная мультимодальная модель для создания разговорных аудиоприложений. Она поддерживает голосовой ввод и вывод наряду с текстом, обеспечивая распознавание речи, синтез речи и смешанные текстово-аудио диалоги с вызовом инструментов и функций для структурированных действий. Типичные сценарии использования включают: голосовые ассистенты, потоковую транскрипцию с суммаризацией, рабочие процессы IVR и колл-ботов, а также помощников в приложениях с поддержкой аудио. Ключевые технические возможности включают аудио-ввод/вывод, потоковые ответы, следование инструкциям и интеграцию через API чата и инструментов.
GPT-4o mini Realtime Preview — это мультимодальная модель реального времени для интерактивных голосовых и визуальных взаимодействий. Она обрабатывает речь, текст и изображения с потоковым вводом и выводом, а также поддерживает вызов инструментов и функций для выполнения контекстно привязанных действий. Типичные сценарии использования включают голосовых ассистентов, обработку звонков в реальном времени, субтитрование в реальном времени и визуальные ответы на вопросы по содержимому с камеры или экрана. К техническим особенностям относятся двунаправленный аудиообмен, понимание визуальной информации, потоковые ответы и структурированные выходные данные через функции.

GPT-4o mini Audio — мультимодальная модель для речевого и текстового взаимодействия. Она выполняет распознавание речи, перевод и синтез речи, следует инструкциям и может вызывать инструменты для выполнения структурированных действий с потоковыми ответами. Типичные варианты использования включают голосовых ассистентов в реальном времени, создание субтитров и перевод в реальном времени, суммаризацию звонков и приложения с голосовым управлением. К техническим особенностям относятся ввод и вывод аудио, потоковые ответы, вызов функций и структурированный вывод в формате JSON.
Realtime API позволяет разработчикам создавать мультимодальные взаимодействия с низкой задержкой, включая функциональность «речь-в-речь». Текст и аудио, обрабатываемые Realtime API, тарифицируются отдельно. Эта модель поддерживает максимальную длину контекста 128,000 токенов.
Эта модель поддерживает максимальную длину контекста в 128,000 токенов.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini — это модель искусственного интеллекта, предоставляемая компанией OpenAI.
O3-mini — это модель искусственного интеллекта от OpenAI.
O3 — модель искусственного интеллекта, предоставляемая компанией OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini — модель искусственного интеллекта, предоставляемая OpenAI.
<div>GPT-4o — самая продвинутая мультимодальная модель OpenAI, быстрее и дешевле, чем GPT-4 Turbo, с более мощными визуальными возможностями. Эта модель имеет контекст 128K и ограничение по знаниям — октябрь 2023 года. Модели серии 1106 и выше поддерживают tool_calls и function_call.</div> Эта модель поддерживает максимальную длину контекста 128,000 токенов.
GPT-4.1 mini — модель искусственного интеллекта, предоставляемая OpenAI. gpt-4.1-mini: Значительный скачок в производительности небольших моделей, даже превосходит GPT-4o во многих бенчмарках. Эта модель соответствует или превосходит GPT-4o в оценке интеллектуальных возможностей, при этом снижая задержку почти вдвое и стоимость на 83%. Эта модель поддерживает максимальную длину контекста в 1,047,576 токенов.
GPT-4.1 — модель искусственного интеллекта, предоставляемая компанией OpenAI. gpt-4.1-nano: Обладает увеличенным контекстным окном — поддерживает до 1 миллиона контекстных токенов и лучше использует этот контекст благодаря улучшенному пониманию длинных контекстов. Имеет обновлённый срез знаний по состоянию на июнь 2024 года. Эта модель поддерживает максимальную длину контекста 1,047,576 токенов.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon