GPT-4.1 nanoは、OpenAIが提供する人工知能モデルです。 gpt-4.1-nano: より大きなコンテキストウィンドウを備え—最大100万のコンテキストトークンに対応し、長文脈の理解が向上したことで、そのコンテキストをより有効に活用できます。 更新された知識カットオフは2024年6月です。 このモデルは最大1,047,576トークンのコンテキスト長をサポートします。

seedance-2-0

OpenAIで最も高性能な画像生成モデルで、多言語にわたるほぼ完璧なテキストレンダリング、最大4K解像度、推論駆動のThinking Modeを備えています。精度と速度、そしてブランドに即したビジュアル出力を求めるプロダクションワークフロー向けに設計されています。
.jpeg&w=3840&q=75)
OpenAI の最も高い知性と直感性を備えた旗艦モデルで、複雑なコーディング、エージェント型ワークフロー、コンピュータ操作、データ分析、そして高度なリサーチのために設計されています。GPT-5.4 と同等の低遅延で最先端レベルのインテリジェンスを提供し、より高いトークン効率でタスクを完了します。要求の厳しいプロフェッショナルおよびエンタープライズのワークロードにおける第一選択のモデルです。

OpenAI で最も高機能なモデルであり、最難関のタスクと長時間稼働するエージェント駆動型ワークフローのために設計されています。GPT-5.5 Pro は複雑なコーディング、コンピュータ操作、高度な調査、データ分析、科学的推論に卓越し、GPT-5.4 のレイテンシを維持しつつ、より高いトークン効率で最先端レベルのインテリジェンスを提供します。最高水準の正確性と自律的なタスク実行を要求するエンタープライズおよびプロフェッショナルのユースケースに最適です。

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro は、当社で最も高度かつ強力なメディア生成モデルで、音声と同期した動画を生成できます。自然言語または画像から、精細でダイナミックな動画クリップを生成します。

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

効果音に対応し、チャット形式をサポートする超高性能な動画生成モデル。

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat は、汎用的なチャット、推論、文章作成に向けて指示追従で微調整された対話型言語モデルです。マルチターン対話、要約、下書き作成、ナレッジベースQAに対応し、アプリ内アシスタント、サポート自動化、ワークフロー・コパイロット向けの軽量なコード支援も提供します。技術的なハイライトには、チャットに最適化されたアラインメント、制御可能で構造化された出力、利用可能な場合のツール呼び出しおよびリトリーバル・ワークフローへの統合パスが含まれます。
GPT-5.1は、製品のワークフロー全般にわたり、テキスト生成と推論に注力した汎用の指示追従に最適化された言語モデルです。複数ターンの対話、構造化された出力フォーマット、下書き作成・リファクタリング・解説といったコード志向のタスクをサポートします。代表的な用途には、チャットアシスタント、検索拡張型QA、データ変換、ツールやAPIがサポートされている場合のエージェント型自動化が含まれます。技術的なハイライトには、テキスト中心のモダリティ、指示追従、JSONスタイルの出力、一般的なオーケストレーションフレームワークの関数呼び出しとの互換性が含まれます。
GPT Image 1 のコスト最適化版。テキストと画像の両方の入力を受け付け、画像を出力するネイティブなマルチモーダル言語モデルです。
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5は、OpenAI史上で最も強力なコーディングモデルです。複雑なフロントエンドの生成や大規模なコードベースのデバッグにおいて、著しい改善が見られます。直感的で審美性の高い結果によってアイデアを現実に変え、優れた審美眼で、美しくレスポンシブなウェブサイト、アプリケーション、ゲームを、単一のプロンプトから作り上げることができます。初期テスターはそのデザイン上の選択についても言及しており、間隔、タイポグラフィ、余白といった要素をより深く理解していると指摘しています。
GPT-5 Nano は、OpenAI が提供する人工知能モデルです。
GPT-5 mini は、OpenAI の GPT-5 ファミリーに属する、コストとレイテンシを最適化したモデルであり、大規模な本番運用において、GPT-5 のマルチモーダル能力と指示追従の強みの多くを大幅に低いコストで提供することを目的としています。スループット、予測可能なトークン単価、そして高速な応答が主な制約となる環境を対象としつつ、強力な汎用能力も備えています。
GPT-5 Chat (最新) は、OpenAI によって提供される人工知能モデルです。
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro は、o3 推論モデルの「Pro」版であり、非公開の思考連鎖強化学習を用いてより長く推論し、科学、プログラミング、ビジネスといった領域で最先端のベンチマークを更新しつつ、最も信頼性の高い応答を提供するよう設計されています—同時に、API 内でウェブ検索、ファイル解析、Python 実行、視覚的推論などのツールを自律的に統合します。
リアルタイム GPT の低コスト版—WebRTC、WebSocket、または SIP 接続を介して、音声およびテキスト入力にリアルタイムで応答可能。

OpenAI テキスト読み上げ

音声をテキストに変換、翻訳を作成
GPT-4o mini TTSは、ユーザー向けアプリケーションにおける自然で低遅延な音声生成のために設計されたニューラルテキスト読み上げモデルです。選択可能な音声、複数形式の出力、ストリーミング合成に対応し、テキストを自然な音声に変換して応答性の高い体験を実現します。代表的な用途には、音声アシスタント、IVRおよびコンタクトフロー、製品の読み上げ、メディアのナレーションが含まれます。技術的な特長には、APIベースのストリーミングや、MP3やWAVなど一般的な音声形式へのエクスポートが含まれます。
GPT-4o Transcribe は、多言語・低遅延の音声認識に対応した、音声をテキストに変換するモデルです。句読点付与や文分割に対応し、一般的な音声フォーマットからのリアルタイムストリーミングとバッチ書き起こしをサポートします。代表的な用途には、ライブ字幕、音声アシスタントの入力、会議メモ、メディアや通話録音の書き起こしが含まれます。技術的な特長には、音声モダリティのサポート、長時間音声の処理、インタラクティブおよびサーバーサイドのワークフローに適したAPIが含まれます。
GPT-4o mini Audio Preview は、音声対話アプリケーションの構築向けのコンパクトなマルチモーダルモデルです。テキストに加えて音声の入出力をサポートし、音声認識、音声合成、さらに構造化されたアクションのためのツールや関数の呼び出しと組み合わせた、テキストと音声が混在する対話を実現します。代表的な用途には、音声アシスタント、要約付きストリーミング文字起こし、IVR やコールボットのワークフロー、音声対応のアプリ内ヘルパーが含まれます。技術的なハイライトには、オーディオの入出力、ストリーミング応答、指示追従、チャットおよびツールの API を介した統合が含まれます。
GPT-4o mini Realtime Preview は、インタラクティブな音声およびビジュアル体験のためのリアルタイムのマルチモーダルモデルです。ストリーミング入出力で音声、テキスト、画像を扱い、外部ツールやデータに基づくアクションのためのツールおよび関数呼び出しにも対応します。代表的な用途には、音声アシスタント、ライブ通話対応、リアルタイム字幕生成、カメラや画面コンテンツに対する視覚質問応答が含まれます。技術的な特長には、双方向音声、視覚理解、ストリーミング応答、関数を介した構造化出力が含まれます。

GPT-4o mini Audio は、音声とテキストのインタラクション向けのマルチモーダルモデルです。音声認識、翻訳、音声合成(テキスト読み上げ)を行い、指示に従い、ストリーミング応答で構造化されたアクションのためのツール呼び出しが可能です。代表的な用途には、リアルタイム音声アシスタント、ライブ字幕化と翻訳、通話要約、音声制御アプリケーションが含まれます。技術的な特長には、音声入出力、ストリーミング応答、関数呼び出し、構造化された JSON 出力が含まれます。
Realtime API により、開発者は音声から音声への変換機能を含む低レイテンシなマルチモーダル体験を構築できます。Realtime API で処理されるテキストと音声は個別に課金されます。本モデルは最大 128,000 トークンのコンテキスト長をサポートします。
このモデルは最大128,000トークンのコンテキスト長をサポートします。
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini は、OpenAI が提供する人工知能モデルです。
O3-miniは、OpenAIが提供する人工知能モデルです。
O3は、OpenAIが提供する人工知能モデルです。
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini は、OpenAI が提供する人工知能モデルです。
<div>GPT-4o は OpenAI の最も高度なマルチモーダルモデルで、GPT-4 Turbo より高速かつ低コストで、より強力な視覚機能を備えています。このモデルは128Kのコンテキスト長を持ち、知識のカットオフは2023年10月です。1106 シリーズ以上のモデルは tool_calls と function_call をサポートしています。</div> このモデルは最大128,000トークンのコンテキスト長をサポートします。
GPT-4.1 mini は OpenAI が提供する人工知能モデルです。gpt-4.1-mini: 小型モデルの性能において大きな飛躍を遂げ、多くのベンチマークで GPT-4o をも上回ります。知能評価では GPT-4o に匹敵するかそれ以上であり、レイテンシをほぼ半減し、コストを83%削減します。このモデルは最大 1,047,576 トークンのコンテキスト長をサポートします。
GPT-4.1は、OpenAIが提供する人工知能モデルです。gpt-4.1-nano: より大きなコンテキストウィンドウを備え—最大 1 million のコンテキストトークンに対応し、長いコンテキストの理解が向上したことで、そのコンテキストをより有効に活用できます。知識のカットオフ時点は2024年6月に更新されています。このモデルは最大1,047,576トークンのコンテキスト長をサポートします。
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon