GPT-4.1 nano는 OpenAI에서 제공하는 인공지능 모델입니다. gpt-4.1-nano: 더 큰 컨텍스트 윈도우를 갖추었으며—최대 1 million 컨텍스트 토큰을 지원하고 향상된 긴 컨텍스트 이해를 통해 그 컨텍스트를 더 잘 활용할 수 있습니다. 지식 컷오프 시점은 2024년 6월로 업데이트되었습니다. 이 모델은 최대 1,047,576 토큰의 컨텍스트 길이를 지원합니다.

seedance-2-0

OpenAI의 가장 강력한 이미지 생성 모델로, 다양한 언어에서 거의 완벽한 텍스트 렌더링과 최대 4K 해상도, 추론 기반 Thinking Mode를 제공합니다. 정확성, 속도, 그리고 브랜드에 부합하는 시각적 출력이 요구되는 프로덕션 워크플로에 맞춰 설계되었습니다.
.jpeg&w=3840&q=75)
복잡한 코딩, 에이전트 기반 워크플로, 컴퓨터 활용, 데이터 분석 및 심층 연구를 위해 설계된 OpenAI의 가장 지능적이고 직관적인 플래그십 모델입니다. GPT-5.4와 같은 낮은 지연 시간으로 최첨단 수준의 지능을 제공하며, 더 높은 토큰 효율성으로 작업을 수행합니다. 까다로운 전문 및 엔터프라이즈 워크로드를 위한 최우선 선택 모델입니다.

OpenAI의 가장 역량이 뛰어난 모델로, 가장 어려운 작업과 장시간 실행되는 에이전트 기반 워크플로우를 위해 설계되었습니다. GPT-5.5 Pro는 복잡한 코딩, 컴퓨터 활용, 심층 연구, 데이터 분석, 과학적 추론에서 뛰어난 성능을 발휘하며, 더 높은 토큰 효율성과 함께 GPT-5.4 수준의 지연 시간으로 최첨단 수준의 지능을 제공합니다. 최고 수준의 정확성과 자율적 작업 실행을 요구하는 기업 및 전문 분야의 사용 사례에 이상적입니다.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro는 동기화된 오디오가 포함된 동영상을 생성할 수 있는, 당사에서 가장 진보되고 강력한 미디어 생성 모델입니다. 자연어 또는 이미지로부터 정교하고 역동적인 동영상 클립을 생성할 수 있습니다.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

초강력 비디오 생성 모델, 효과음 지원, 채팅 형식 지원.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat은 범용 채팅, 추론, 글쓰기를 위해 지시 기반으로 미세 조정된 대화형 언어 모델입니다. 앱 내 어시스턴트, 지원 업무 자동화, 워크플로 코파일럿을 위해 멀티턴 대화, 요약, 초안 작성, 지식 베이스 QA, 경량 코드 지원을 제공합니다. 기술적 하이라이트에는 채팅에 최적화된 정렬, 제어 가능하고 구조화된 출력, 그리고 사용 가능한 경우 도구 호출 및 검색 워크플로를 위한 연동 경로가 포함됩니다.
GPT-5.1은 제품 워크플로우 전반에서의 텍스트 생성과 추론에 초점을 맞춘, 지시로 미세조정된 범용 언어 모델입니다. 멀티턴 대화, 구조화된 출력 형식, 초안 작성·리팩터링·설명과 같은 코드 지향 작업을 지원합니다. 일반적인 활용 사례로는 채팅 어시스턴트, 검색 증강형 QA, 데이터 변환, 그리고 지원되는 경우 도구 또는 API를 활용한 에이전트형 자동화가 포함됩니다. 기술적 특징에는 텍스트 중심 모달리티, 지시 따르기, JSON 스타일 출력, 일반적인 오케스트레이션 프레임워크에서의 함수 호출과의 호환성이 포함됩니다.
GPT Image 1의 비용 최적화 버전입니다. 텍스트와 이미지 입력을 모두 지원하고 이미지 출력을 생성하는 네이티브 멀티모달 언어 모델입니다.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5는 현재까지 OpenAI가 선보인 가장 강력한 코딩 모델입니다. 복잡한 프론트엔드 생성과 대규모 코드베이스 디버깅에서 큰 향상을 보여줍니다. 직관적이고 심미적으로 뛰어난 결과물로 아이디어를 현실로 구현하며, 한 번의 프롬프트만으로 뛰어난 미적 감각을 바탕으로 아름답고 반응형인 웹사이트, 애플리케이션, 게임을 만들어낼 수 있습니다. 초기 테스터들은 간격, 타이포그래피, 여백과 같은 요소에 대한 더 깊은 이해가 반영된 디자인 선택도 지적했습니다.
GPT-5 Nano는 OpenAI가 제공하는 인공지능 모델입니다.
GPT-5 mini는 OpenAI의 GPT-5 제품군에서 비용과 지연 시간에 최적화된 구성원으로, 대규모 프로덕션 사용을 위해 훨씬 낮은 비용으로 GPT-5의 멀티모달 및 지시 따르기 강점을 상당 부분 제공하도록 설계되었습니다. 처리량, 예측 가능한 토큰당 가격, 빠른 응답이 주요 제약인 환경을 대상으로 하면서도 강력한 범용 역량을 제공합니다.
GPT-5 Chat (latest)은 OpenAI가 제공하는 인공지능 모델입니다.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro는 o3 추론 모델의 “프로” 버전으로, 더 오래 사고하고 가장 신뢰할 수 있는 응답을 제공하도록 설계되었으며, 비공개 사고 연쇄 강화학습을 활용해 과학, 프로그래밍, 비즈니스 등 다양한 분야에서 최첨단 벤치마크를 새롭게 세우는 한편—동시에 API 내에서 웹 검색, 파일 분석, Python 실행, 시각적 추론 등의 도구를 자율적으로 통합합니다.
실시간 GPT의 경제적인 버전—WebRTC, WebSocket 또는 SIP 연결을 통해 오디오 및 텍스트 입력에 실시간으로 응답할 수 있음.

OpenAI 텍스트 음성 변환

음성을 텍스트로 변환, 번역 생성
GPT-4o mini TTS는 사용자 대상 애플리케이션에서 자연스럽고 지연이 낮은 음성 생성을 위해 설계된 신경망 기반 텍스트-음성 변환 모델입니다. 선택 가능한 보이스, 다양한 포맷 출력, 반응성이 높은 경험을 위한 스트리밍 합성을 통해 텍스트를 자연스러운 음성으로 변환합니다. 대표적인 사용처로는 음성 비서, IVR 및 컨택트 플로우, 제품 낭독, 미디어 내레이션 등이 있습니다. 기술적 하이라이트로는 API 기반 스트리밍과 MP3 및 WAV 등의 일반적인 오디오 포맷으로의 내보내기가 포함됩니다.
GPT-4o Transcribe는 다국어 저지연 음성 인식을 위한 오디오-텍스트 변환 모델입니다. 일반적인 오디오 형식에서 구두점과 문장 분할을 포함한 실시간 스트리밍 및 배치 전사를 지원합니다. 대표적인 사용 사례로는 실시간 자막, 음성 비서 입력, 회의 노트, 미디어 또는 통화 녹음 전사가 있습니다. 기술적 특징으로는 오디오 모달리티 지원, 장시간 오디오 처리, 그리고 상호작용형 및 서버 측 워크플로에 적합한 API가 포함됩니다.
GPT-4o mini Audio Preview는 대화형 오디오 애플리케이션을 구축하기 위한 컴팩트한 멀티모달 모델입니다. 텍스트와 함께 음성 입력과 출력을 지원하며, 음성 인식, 음성 합성, 그리고 구조화된 작업을 위한 도구/함수 호출이 가능한 텍스트-오디오 혼합 대화를 구현합니다. 주요 활용 사례로는 음성 비서, 요약을 포함한 스트리밍 전사, IVR 및 콜봇 워크플로, 오디오 지원 인앱 도우미 등이 있습니다. 기술적 하이라이트로는 오디오 I/O, 스트리밍 응답、지시사항 준수, chat 및 tools API를 통한 통합이 포함됩니다。
GPT-4o mini Realtime Preview는 대화형 음성 및 시각적 경험을 위한 실시간 멀티모달 모델입니다. 스트리밍 입력과 출력으로 음성, 텍스트, 이미지를 처리하며, 구체적인 동작 수행을 위한 툴/함수 호출도 지원합니다. 대표적인 활용 사례로는 음성 비서, 실시간 통화 처리, 실시간 자막 생성, 카메라 또는 화면 콘텐츠를 통한 시각적 질의응답이 있습니다. 기술적 하이라이트로는 양방향 오디오, 시각 이해, 스트리밍 응답, 함수 기반의 구조화된 출력이 포함됩니다.

GPT-4o mini Audio는 음성 및 텍스트 상호작용을 위한 멀티모달 모델입니다. 음성 인식, 번역, 텍스트 음성 변환을 수행하고 지시를 따르며, 스트리밍 응답과 함께 구조화된 작업을 위해 도구를 호출할 수 있습니다. 일반적인 사용 사례로는 실시간 음성 비서, 라이브 자막 및 번역, 통화 요약, 음성 제어 애플리케이션이 포함됩니다. 기술적 특징으로는 오디오 입력과 출력, 스트리밍 응답, 함수 호출, 구조화된 JSON 출력이 있습니다.
Realtime API는 개발자가 음성-음성 기능을 포함한 저지연 멀티모달 경험을 구현할 수 있도록 합니다. Realtime API로 처리되는 텍스트와 오디오의 요금은 별도로 책정됩니다. 이 모델은 최대 128,000 토큰의 컨텍스트 길이를 지원합니다.
이 모델은 최대 128,000 토큰의 컨텍스트 길이를 지원합니다.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini는 OpenAI에서 제공하는 인공지능 모델입니다.
O3-mini는 OpenAI가 제공하는 인공지능 모델입니다.
O3는 OpenAI가 제공하는 인공지능 모델입니다.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini는 OpenAI가 제공하는 인공지능 모델입니다.
<div>GPT-4o는 OpenAI의 가장 진보된 멀티모달 모델로, GPT-4 Turbo보다 더 빠르고 더 저렴하며 시각적 기능이 더 강력합니다. 이 모델은 128K 컨텍스트를 갖추고 있으며 지식 컷오프는 2023년 10월입니다. 1106 시리즈 이상의 모델은 tool_calls 및 function_call을 지원합니다.</div> 이 모델은 최대 128,000 토큰의 컨텍스트 길이를 지원합니다.
GPT-4.1 mini는 OpenAI가 제공하는 인공지능 모델입니다. gpt-4.1-mini: 소형 모델 성능에서 획기적인 도약을 이뤘으며, 여러 벤치마크에서 GPT-4o를 능가합니다. 지능 평가에서 GPT-4o에 필적하거나 이를 상회하면서, 지연 시간을 거의 절반으로 줄이고 비용을 83% 절감합니다. 이 모델은 최대 1,047,576 토큰의 컨텍스트 길이를 지원합니다.
GPT-4.1는 OpenAI가 제공하는 인공지능 모델입니다. gpt-4.1-nano: 더 큰 컨텍스트 윈도우를 제공하며—최대 1 million 컨텍스트 토큰을 지원하고 향상된 긴 컨텍스트 이해를 통해 해당 컨텍스트를 더 잘 활용할 수 있습니다. 지식 컷오프 시점은 2024년 6월로 업데이트되었습니다. 이 모델은 최대 1,047,576 토큰의 컨텍스트 길이를 지원합니다.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon