
GPT-6 Sol
GPT-6 Sol APIを見る。

GPT-6 Sol APIを見る。

GPT-6 Astra, the flagship model for complex reasoning and coding. Choose GPT-5.6 Terra to balance intelligence and cost,

OpenAIで最も高性能な画像生成モデルで、多言語にわたるほぼ完璧なテキストレンダリング、最大4K解像度、推論駆動のThinking Modeを備えています。精度と速度、そしてブランドに即したビジュアル出力を求めるプロダクションワークフロー向けに設計されています。

gpt-oss-20b(free) APIを見る。

GPT-5.4 Mini is a lightweight and efficient AI model optimized for speed and everyday productivity. It provides reliable conversational capabilities, content generation, and task assistance while maintaining low latency and resource usage.

GPT Image 2.5(sunburst) APIを見る。
GPT-Realtime-2 is our most capable realtime voice model. It supports speech-to-speech interactions with configurable reasoning effort, stronger instruction following, and more reliable tool use for complex voice-agent workflows

GPT-5.4 Nano is an ultra-lightweight AI model built for maximum speed and efficiency. It is optimized for simple tasks, real-time interactions, and large-scale deployments where low latency and minimal resource consumption are essential.

seedance-2-0

The best voice model for audio in, audio out.

OpenAI で最も高機能なモデルであり、最難関のタスクと長時間稼働するエージェント駆動型ワークフローのために設計されています。GPT-5.5 Pro は複雑なコーディング、コンピュータ操作、高度な調査、データ分析、科学的推論に卓越し、GPT-5.4 のレイテンシを維持しつつ、より高いトークン効率で最先端レベルのインテリジェンスを提供します。最高水準の正確性と自律的なタスク実行を要求するエンタープライズおよびプロフェッショナルのユースケースに最適です。

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT Image 2 ALL is a comprehensive image generation model designed to handle a wide range of creative and professional visual tasks. It combines high-quality image creation, advanced prompt understanding, and versatile style support to deliver exceptional results across diverse use cases.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.
GPT-5.1は、製品のワークフロー全般にわたり、テキスト生成と推論に注力した汎用の指示追従に最適化された言語モデルです。複数ターンの対話、構造化された出力フォーマット、下書き作成・リファクタリング・解説といったコード志向のタスクをサポートします。代表的な用途には、チャットアシスタント、検索拡張型QA、データ変換、ツールやAPIがサポートされている場合のエージェント型自動化が含まれます。技術的なハイライトには、テキスト中心のモダリティ、指示追従、JSONスタイルの出力、一般的なオーケストレーションフレームワークの関数呼び出しとの互換性が含まれます。
GPT Image 1 のコスト最適化版。テキストと画像の両方の入力を受け付け、画像を出力するネイティブなマルチモーダル言語モデルです。
GPT-5は、OpenAI史上で最も強力なコーディングモデルです。複雑なフロントエンドの生成や大規模なコードベースのデバッグにおいて、著しい改善が見られます。直感的で審美性の高い結果によってアイデアを現実に変え、優れた審美眼で、美しくレスポンシブなウェブサイト、アプリケーション、ゲームを、単一のプロンプトから作り上げることができます。初期テスターはそのデザイン上の選択についても言及しており、間隔、タイポグラフィ、余白といった要素をより深く理解していると指摘しています。
GPT-5 Nano は、OpenAI が提供する人工知能モデルです。
GPT-5 mini は、OpenAI の GPT-5 ファミリーに属する、コストとレイテンシを最適化したモデルであり、大規模な本番運用において、GPT-5 のマルチモーダル能力と指示追従の強みの多くを大幅に低いコストで提供することを目的としています。スループット、予測可能なトークン単価、そして高速な応答が主な制約となる環境を対象としつつ、強力な汎用能力も備えています。
coming soon
gpt-4o-image generate images as output, optionally using images as input

Sora 2 Pro は、当社で最も高度かつ強力なメディア生成モデルで、音声と同期した動画を生成できます。自然言語または画像から、精細でダイナミックな動画クリップを生成します。

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.

GPT Image 2.5 Flare APIを見る。
OpenAI o3‑pro は、o3 推論モデルの「Pro」版であり、非公開の思考連鎖強化学習を用いてより長く推論し、科学、プログラミング、ビジネスといった領域で最先端のベンチマークを更新しつつ、最も信頼性の高い応答を提供するよう設計されています—同時に、API 内でウェブ検索、ファイル解析、Python 実行、視覚的推論などのツールを自律的に統合します。

OpenAI テキスト読み上げ

効果音に対応し、チャット形式をサポートする超高性能な動画生成モデル。

音声をテキストに変換、翻訳を作成
.jpeg&w=3840&q=75)
OpenAI の最も高い知性と直感性を備えた旗艦モデルで、複雑なコーディング、エージェント型ワークフロー、コンピュータ操作、データ分析、そして高度なリサーチのために設計されています。GPT-5.4 と同等の低遅延で最先端レベルのインテリジェンスを提供し、より高いトークン効率でタスクを完了します。要求の厳しいプロフェッショナルおよびエンタープライズのワークロードにおける第一選択のモデルです。
tts-1 APIを見る。
GPT-4o mini TTSは、ユーザー向けアプリケーションにおける自然で低遅延な音声生成のために設計されたニューラルテキスト読み上げモデルです。選択可能な音声、複数形式の出力、ストリーミング合成に対応し、テキストを自然な音声に変換して応答性の高い体験を実現します。代表的な用途には、音声アシスタント、IVRおよびコンタクトフロー、製品の読み上げ、メディアのナレーションが含まれます。技術的な特長には、APIベースのストリーミングや、MP3やWAVなど一般的な音声形式へのエクスポートが含まれます。
o1-pro-2025-03-19 APIを見る。
GPT-4o Transcribe は、多言語・低遅延の音声認識に対応した、音声をテキストに変換するモデルです。句読点付与や文分割に対応し、一般的な音声フォーマットからのリアルタイムストリーミングとバッチ書き起こしをサポートします。代表的な用途には、ライブ字幕、音声アシスタントの入力、会議メモ、メディアや通話録音の書き起こしが含まれます。技術的な特長には、音声モダリティのサポート、長時間音声の処理、インタラクティブおよびサーバーサイドのワークフローに適したAPIが含まれます。

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.
GPT-4o mini Audio Preview は、音声対話アプリケーションの構築向けのコンパクトなマルチモーダルモデルです。テキストに加えて音声の入出力をサポートし、音声認識、音声合成、さらに構造化されたアクションのためのツールや関数の呼び出しと組み合わせた、テキストと音声が混在する対話を実現します。代表的な用途には、音声アシスタント、要約付きストリーミング文字起こし、IVR やコールボットのワークフロー、音声対応のアプリ内ヘルパーが含まれます。技術的なハイライトには、オーディオの入出力、ストリーミング応答、指示追従、チャットおよびツールの API を介した統合が含まれます。
GPT-4o mini Realtime Preview は、インタラクティブな音声およびビジュアル体験のためのリアルタイムのマルチモーダルモデルです。ストリーミング入出力で音声、テキスト、画像を扱い、外部ツールやデータに基づくアクションのためのツールおよび関数呼び出しにも対応します。代表的な用途には、音声アシスタント、ライブ通話対応、リアルタイム字幕生成、カメラや画面コンテンツに対する視覚質問応答が含まれます。技術的な特長には、双方向音声、視覚理解、ストリーミング応答、関数を介した構造化出力が含まれます。
o1-2024-12-17 APIを見る。

GPT-5.3 Instant model used in ChatGPT

GPT-4o mini Audio は、音声とテキストのインタラクション向けのマルチモーダルモデルです。音声認識、翻訳、音声合成(テキスト読み上げ)を行い、指示に従い、ストリーミング応答で構造化されたアクションのためのツール呼び出しが可能です。代表的な用途には、リアルタイム音声アシスタント、ライブ字幕化と翻訳、通話要約、音声制御アプリケーションが含まれます。技術的な特長には、音声入出力、ストリーミング応答、関数呼び出し、構造化された JSON 出力が含まれます。
omni-moderation-2024-09-26 APIを見る。
omni-moderation-latest APIを見る。
tts-1-hd-1106 APIを見る。

The best voice model for audio in, audio out with Chat Completions.
tts-1-1106 APIを見る。
GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.
tts-1-hd APIを見る。

Start with GPT-5.6 Sol for complex reasoning and coding, choose GPT-5.6 Terra to balance intelligence and cost, or use GPT-5.6 Luna for cost-sensitive, high-volume workloads.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.

Coming Soon

Coming Soon

coming soon
O4-mini は、OpenAI が提供する人工知能モデルです。
O3-miniは、OpenAIが提供する人工知能モデルです。
O3は、OpenAIが提供する人工知能モデルです。
O1-pro is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini は、OpenAI が提供する人工知能モデルです。
<div>GPT-4o は OpenAI の最も高度なマルチモーダルモデルで、GPT-4 Turbo より高速かつ低コストで、より強力な視覚機能を備えています。このモデルは128Kのコンテキスト長を持ち、知識のカットオフは2023年10月です。1106 シリーズ以上のモデルは tool_calls と function_call をサポートしています。</div> このモデルは最大128,000トークンのコンテキスト長をサポートします。
GPT-4.1 nanoは、OpenAIが提供する人工知能モデルです。 gpt-4.1-nano: より大きなコンテキストウィンドウを備え—最大100万のコンテキストトークンに対応し、長文脈の理解が向上したことで、そのコンテキストをより有効に活用できます。 更新された知識カットオフは2024年6月です。 このモデルは最大1,047,576トークンのコンテキスト長をサポートします。
GPT-4.1 mini は OpenAI が提供する人工知能モデルです。gpt-4.1-mini: 小型モデルの性能において大きな飛躍を遂げ、多くのベンチマークで GPT-4o をも上回ります。知能評価では GPT-4o に匹敵するかそれ以上であり、レイテンシをほぼ半減し、コストを83%削減します。このモデルは最大 1,047,576 トークンのコンテキスト長をサポートします。
GPT-4.1は、OpenAIが提供する人工知能モデルです。gpt-4.1-nano: より大きなコンテキストウィンドウを備え—最大 1 million のコンテキストトークンに対応し、長いコンテキストの理解が向上したことで、そのコンテキストをより有効に活用できます。知識のカットオフ時点は2024年6月に更新されています。このモデルは最大1,047,576トークンのコンテキスト長をサポートします。