GPT-4.1 nano to model sztucznej inteligencji udostępniany przez OpenAI. gpt-4.1-nano: Zapewnia większe okno kontekstu—obsługujące do 1 miliona tokenów kontekstu oraz lepsze wykorzystanie tego kontekstu dzięki ulepszonemu rozumieniu długiego kontekstu. Ma zaktualizowaną datę odcięcia wiedzy na czerwiec 2024. Ten model obsługuje maksymalną długość kontekstu wynoszącą 1,047,576 tokenów.

seedance-2-0

Najbardziej zaawansowany model generowania obrazów OpenAI, oferujący niemal doskonałe renderowanie tekstu w wielu językach, rozdzielczość do 4K oraz oparty na rozumowaniu tryb Thinking Mode. Stworzony z myślą o przepływach pracy w środowiskach produkcyjnych, które wymagają dokładności, szybkości i efektów wizualnych zgodnych z identyfikacją wizualną marki.
.jpeg&w=3840&q=75)
Najinteligentniejszy i najbardziej intuicyjny flagowy model OpenAI, zaprojektowany do złożonego programowania, agentowych przepływów pracy, korzystania z komputera, analizy danych i pogłębionych badań. Zapewnia inteligencję na poziomie najnowocześniejszych modeli przy równie niskich opóźnieniach jak GPT-5.4, a jednocześnie realizuje zadania z większą efektywnością wykorzystania tokenów. Model pierwszego wyboru do wymagających obciążeń profesjonalnych i korporacyjnych.

Najbardziej zaawansowany model OpenAI, zaprojektowany do najtrudniejszych zadań i długotrwałych agentowych przepływów pracy. GPT-5.5 Pro wyróżnia się w złożonym programowaniu, pracy na komputerze, pogłębionych badaniach, analizie danych i rozumowaniu naukowym — zapewniając inteligencję na poziomie światowej czołówki przy latencji na poziomie GPT-5.4 i większej efektywności wykorzystania tokenów. Idealny do zastosowań korporacyjnych i profesjonalnych, które wymagają najwyższych standardów dokładności oraz autonomicznego wykonywania zadań.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro to nasz najbardziej zaawansowany i najpotężniejszy model generowania multimediów, zdolny do generowania wideo z zsynchronizowanym dźwiękiem. Może tworzyć szczegółowe, dynamiczne klipy wideo na podstawie języka naturalnego lub obrazów.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

Niezwykle potężny model generowania wideo, z efektami dźwiękowymi, obsługuje format czatu.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat to dostrojony za pomocą instrukcji konwersacyjny model językowy do ogólnych zastosowań: czatu, rozumowania i pisania. Obsługuje wieloturowe dialogi, podsumowywanie, tworzenie szkiców, odpowiadanie na pytania w oparciu o bazę wiedzy oraz lekkie wsparcie kodowania na potrzeby asystentów w aplikacjach, automatyzacji wsparcia i współpilotów przepływów pracy. Do najważniejszych aspektów technicznych należą dopasowanie zoptymalizowane pod kątem czatu, sterowalne i ustrukturyzowane odpowiedzi oraz ścieżki integracji do wywoływania narzędzi i przepływów pozyskiwania informacji, gdy są dostępne.
GPT-5.1 to uniwersalny model językowy dostrojony do wykonywania instrukcji, skoncentrowany na generowaniu tekstu i wnioskowaniu w procesach produktowych. Obsługuje wieloturowe dialogi, ustrukturyzowane formatowanie wyników oraz zadania ukierunkowane na kod, takie jak tworzenie, refaktoryzacja i wyjaśnianie. Typowe zastosowania obejmują asystentów czatu, QA wspierane wyszukiwaniem, transformację danych oraz automatyzację w stylu agenta z użyciem narzędzi lub interfejsów API, gdy jest to obsługiwane. Najważniejsze cechy techniczne obejmują modalność zorientowaną na tekst, podążanie za instrukcjami, wyniki w stylu JSON oraz zgodność z wywoływaniem funkcji w popularnych frameworkach orkiestracji.
Kosztowo zoptymalizowana wersja GPT Image 1. To natywny multimodalny model językowy, który przyjmuje zarówno tekst, jak i obrazy jako dane wejściowe oraz generuje wynik w postaci obrazów.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5 to najpotężniejszy jak dotąd model programistyczny OpenAI. Wykazuje znaczące usprawnienia w generowaniu złożonego front-endu oraz debugowaniu rozległych baz kodu. Potrafi przekuwać pomysły w rzeczywistość, dostarczając intuicyjne i estetycznie dopracowane rezultaty, tworząc piękne i responsywne strony internetowe, aplikacje i gry z wyczuciem estetyki — wszystko na podstawie jednego polecenia. Wcześni testerzy zwrócili też uwagę na jego decyzje projektowe oraz głębsze zrozumienie elementów takich jak odstępy, typografia i biała przestrzeń.
GPT-5 Nano to model sztucznej inteligencji dostarczany przez OpenAI.
GPT-5 mini to zoptymalizowany pod kątem kosztów i opóźnień członek rodziny GPT-5 firmy OpenAI, przeznaczony do dostarczania znacznej części mocnych stron GPT-5 w zakresie multimodalności i wykonywania instrukcji przy znacznie niższym koszcie dla zastosowań produkcyjnych na dużą skalę. Jest skierowany do środowisk, w których przepustowość, przewidywalne ceny za token i szybkie odpowiedzi są głównymi ograniczeniami, wciąż zapewniając silne możliwości ogólnego przeznaczenia.
GPT-5 Chat (najnowszy) jest modelem sztucznej inteligencji oferowanym przez OpenAI.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro to wariant „pro” modelu rozumowania o3, zaprojektowany do dłuższego wnioskowania i dostarczania najbardziej niezawodnych odpowiedzi poprzez zastosowanie prywatnego uczenia ze wzmocnieniem opartego na łańcuchu rozumowania oraz ustanawianie nowych, najlepszych w swojej klasie benchmarków w takich dziedzinach jak nauka, programowanie i biznes — jednocześnie autonomicznie integrując w ramach API narzędzia takie jak wyszukiwanie w sieci, analiza plików, wykonywanie kodu w Pythonie i rozumowanie wizualne.
Ekonomiczna wersja GPT w czasie rzeczywistym — zdolna do reagowania na dane wejściowe audio i tekstowe w czasie rzeczywistym za pośrednictwem połączeń WebRTC, WebSocket lub SIP.

Synteza mowy OpenAI

Zamiana mowy na tekst, tworzenie tłumaczeń
GPT-4o mini TTS to neuronowy model syntezy mowy zaprojektowany do naturalnego, niskoopóźnionego generowania głosu w aplikacjach skierowanych do użytkownika końcowego. Przekształca tekst w naturalnie brzmiącą mowę, oferując wybór głosów, wieloformatowe wyjście oraz strumieniową syntezę zapewniającą płynne, responsywne doświadczenia. Typowe zastosowania obejmują asystentów głosowych, IVR i przepływy kontaktowe, funkcje czytania na głos w produktach oraz narrację do mediów. Najważniejsze cechy techniczne obejmują strumieniowanie oparte na API i eksport do popularnych formatów audio, takich jak MP3 i WAV.
GPT-4o Transcribe to model konwersji audio na tekst do wielojęzycznego rozpoznawania mowy o niskich opóźnieniach. Obsługuje strumieniowanie w czasie rzeczywistym i transkrypcję wsadową z popularnych formatów audio, z dodawaniem interpunkcji i segmentacją zdań. Typowe zastosowania obejmują napisy na żywo, wejście dla asystentów głosowych, notatki ze spotkań oraz transkrypcję nagrań medialnych lub połączeń. Najważniejsze cechy techniczne obejmują obsługę danych audio, przetwarzanie długich nagrań oraz interfejsy API dostosowane do interaktywnych i serwerowych przepływów pracy.
GPT-4o mini Audio Preview to kompaktowy model multimodalny do tworzenia konwersacyjnych aplikacji audio. Obsługuje wejście i wyjście mowy wraz z tekstem, umożliwiając rozpoznawanie mowy, syntezę mowy oraz mieszane dialogi tekst-audio z wywoływaniem narzędzi/funkcji dla ustrukturyzowanych działań. Typowe zastosowania obejmują asystentów głosowych, strumieniową transkrypcję z podsumowaniem, scenariusze IVR i call-botów oraz asystentów w aplikacjach z obsługą audio. Najważniejsze cechy techniczne obejmują wejście/wyjście audio, odpowiedzi strumieniowe, podążanie za instrukcjami oraz integrację poprzez interfejsy API czatu i narzędzi.
GPT-4o mini Realtime Preview to wielomodalny model czasu rzeczywistego przeznaczony do interaktywnych doświadczeń głosowych i wizualnych. Obsługuje mowę, tekst i obrazy z wejściem i wyjściem strumieniowym, a także wywoływanie narzędzi/funkcji do wykonywania ugruntowanych działań. Typowe zastosowania obejmują asystentów głosowych, obsługę połączeń na żywo, tworzenie napisów w czasie rzeczywistym oraz wizualne odpowiadanie na pytania dotyczące treści z kamery lub ekranu. Kluczowe cechy techniczne obejmują dwukierunkowe audio, rozumienie obrazu, odpowiedzi strumieniowe oraz strukturyzowane wyniki za pośrednictwem funkcji.

GPT-4o mini Audio to multimodalny model do interakcji głosowych i tekstowych. Wykonuje rozpoznawanie mowy, tłumaczenie i syntezę mowy, stosuje się do instrukcji oraz może wywoływać narzędzia do realizacji ustrukturyzowanych działań z odpowiedziami strumieniowymi. Typowe zastosowania obejmują asystentów głosowych w czasie rzeczywistym, napisy i tłumaczenia na żywo, podsumowywanie połączeń oraz aplikacje sterowane głosem. Najważniejsze cechy techniczne obejmują wejście i wyjście audio, odpowiedzi strumieniowe, wywoływanie funkcji oraz ustrukturyzowane wyjście JSON.
Realtime API umożliwia programistom tworzenie doświadczeń multimodalnych o niskiej latencji, w tym funkcjonalności zamiany mowy na mowę. Tekst i audio przetwarzane przez Realtime API są wyceniane oddzielnie. Ten model obsługuje maksymalną długość kontekstu wynoszącą 128,000 tokenów.
Ten model obsługuje maksymalną długość kontekstu wynoszącą 128,000 tokenów.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini to model sztucznej inteligencji udostępniany przez OpenAI.
O3-mini jest modelem sztucznej inteligencji udostępnianym przez OpenAI.
O3 to model sztucznej inteligencji dostarczany przez OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini to model sztucznej inteligencji dostarczany przez OpenAI.
<div>GPT-4o to najbardziej zaawansowany multimodalny model OpenAI, szybszy i tańszy niż GPT-4 Turbo, o silniejszych możliwościach wizyjnych. Ten model ma kontekst 128K oraz odcięcie wiedzy na październik 2023 r. Modele z serii 1106 i nowsze obsługują tool_calls i function_call.</div> Ten model obsługuje maksymalną długość kontekstu wynoszącą 128,000 tokenów.
GPT-4.1 mini to model sztucznej inteligencji oferowany przez OpenAI. gpt-4.1-mini: Znaczący skok w wydajności małych modeli, nawet przewyższający GPT-4o w wielu benchmarkach. Dorównuje lub przewyższa GPT-4o w ocenach inteligencji, jednocześnie zmniejszając opóźnienie niemal o połowę i koszty o 83%. Ten model obsługuje maksymalną długość kontekstu 1,047,576 tokenów.
GPT-4.1 to model sztucznej inteligencji dostarczany przez OpenAI. gpt-4.1-nano: Charakteryzuje się większym oknem kontekstu — obsługuje do 1 miliona tokenów kontekstowych i potrafi lepiej wykorzystywać ten kontekst dzięki ulepszonemu rozumieniu długiego kontekstu. Ma zaktualizowaną datę odcięcia wiedzy: czerwiec 2024. Ten model obsługuje maksymalną długość kontekstu wynoszącą 1,047,576 tokenów.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon