GPT-4.1 nano เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI. gpt-4.1-nano: มีหน้าต่างบริบทที่ใหญ่ขึ้น—รองรับโทเค็นบริบทได้สูงสุด 1 ล้าน และสามารถใช้บริบทนั้นได้ดียิ่งขึ้นด้วยความเข้าใจบริบทระยะยาวที่ได้รับการปรับปรุง. มีขอบเขตความรู้ที่อัปเดตเป็นเดือนมิถุนายน 2024. โมเดลนี้รองรับความยาวบริบทสูงสุด 1,047,576 โทเค็น.

seedance-2-0

โมเดลการสร้างภาพที่มีความสามารถสูงสุดของ OpenAI มาพร้อมการเรนเดอร์ข้อความที่แทบสมบูรณ์แบบในหลายภาษา รองรับความละเอียดสูงสุดถึง 4K และ Thinking Mode ที่ขับเคลื่อนด้วยการให้เหตุผล。ออกแบบมาสำหรับเวิร์กโฟลว์ระดับโปรดักชันที่ต้องการความแม่นยำ ความเร็ว และผลลัพธ์ภาพที่สอดคล้องกับแบรนด์
.jpeg&w=3840&q=75)
โมเดลเรือธงที่ฉลาดและใช้งานได้อย่างเป็นธรรมชาติที่สุดของ OpenAI ออกแบบมาสำหรับการเขียนโค้ดที่ซับซ้อน เวิร์กโฟลว์แบบเอเจนต์ การใช้คอมพิวเตอร์ การวิเคราะห์ข้อมูล และการวิจัยเชิงลึก มอบความฉลาดระดับแนวหน้าพร้อมความหน่วงต่ำเทียบเท่า GPT-5.4 ขณะเดียวกันก็ทำงานสำเร็จด้วยประสิทธิภาพการใช้โทเค็นที่สูงกว่า โมเดลตัวเลือกหลักสำหรับเวิร์กโหลดระดับมืออาชีพและองค์กรที่มีความต้องการสูง

โมเดลที่มีความสามารถสูงสุดของ OpenAI ออกแบบมาสำหรับภารกิจที่ยากที่สุดและเวิร์กโฟลว์เชิงเอเจนต์ที่ดำเนินต่อเนื่องยาวนาน GPT-5.5 Pro โดดเด่นในงานเขียนโค้ดที่ซับซ้อน การใช้งานคอมพิวเตอร์ การวิจัยเชิงลึก การวิเคราะห์ข้อมูล และการให้เหตุผลเชิงวิทยาศาสตร์ — มอบอัจฉริยะระดับแนวหน้าพร้อมความหน่วงเวลาในระดับ GPT-5.4 และประสิทธิภาพการใช้โทเคนที่ดียิ่งขึ้น เหมาะอย่างยิ่งสำหรับการใช้งานระดับองค์กรและระดับมืออาชีพที่ต้องการมาตรฐานความแม่นยำสูงสุดและความสามารถในการดำเนินภารกิจโดยอัตโนมัติ

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro เป็นโมเดลสร้างสื่อที่ล้ำหน้าและทรงพลังที่สุดของเรา ที่สามารถสร้างวิดีโอพร้อมเสียงที่ซิงโครไนซ์ได้ สามารถสร้างคลิปวิดีโอที่ละเอียดและไดนามิกจากภาษาธรรมชาติหรือภาพได้

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

โมเดลสร้างวิดีโอทรงพลังเป็นพิเศษ พร้อมเอฟเฟ็กต์เสียง และรองรับรูปแบบแชต

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat เป็นโมเดลภาษาสำหรับการสนทนาที่ปรับจูนด้วยคำสั่ง สำหรับการแชตอเนกประสงค์ การให้เหตุผล และการเขียน รองรับบทสนทนาหลายรอบ การสรุปความ การร่าง การถาม-ตอบบนฐานความรู้ และการช่วยเขียนโค้ดแบบน้ำหนักเบาสำหรับผู้ช่วยภายในแอป ระบบอัตโนมัติด้านซัพพอร์ต และผู้ช่วยร่วมสำหรับเวิร์กโฟลว์ จุดเด่นด้านเทคนิคประกอบด้วยการจัดแนวที่ปรับให้เหมาะกับการแชต เอาต์พุตที่ควบคุมได้และมีโครงสร้าง และเส้นทางการผสานรวมสำหรับการเรียกใช้เครื่องมือและเวิร์กโฟลว์การเรียกค้น เมื่อมีให้ใช้งาน
GPT-5.1 เป็นโมเดลภาษาที่ผ่านการปรับจูนด้วยคำสั่งสำหรับการใช้งานทั่วไป ซึ่งมุ่งเน้นการสร้างข้อความและการให้เหตุผลครอบคลุมเวิร์กโฟลว์ของผลิตภัณฑ์ รองรับบทสนทนาแบบหลายรอบ การจัดรูปแบบผลลัพธ์เชิงโครงสร้าง และงานที่เน้นโค้ด เช่น การร่าง การรีแฟกทอริง และการอธิบาย การใช้งานทั่วไปได้แก่ ผู้ช่วยแชต การถาม-ตอบแบบเสริมการเรียกค้น การแปลงข้อมูล และระบบอัตโนมัติแบบเอเจนต์ด้วยเครื่องมือหรือ API เมื่อรองรับ จุดเด่นด้านเทคนิคประกอบด้วยรูปแบบสื่อที่เน้นข้อความ ความสามารถในการปฏิบัติตามคำสั่ง ผลลัพธ์แบบ JSON และความเข้ากันได้กับการเรียกใช้ฟังก์ชันในเฟรมเวิร์กการออร์เคสเตรชันที่ใช้กันทั่วไป
เวอร์ชันที่ปรับให้เหมาะสมด้านต้นทุนของ GPT Image 1 เป็นโมเดลภาษามัลติโมดัลแบบเนทีฟที่รับอินพุตได้ทั้งข้อความและรูปภาพ และสร้างเอาต์พุตเป็นรูปภาพ
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5 เป็นโมเดลสำหรับการเขียนโค้ดที่ทรงพลังที่สุดของ OpenAI จนถึงปัจจุบัน โมเดลนี้แสดงให้เห็นถึงการพัฒนาอย่างมีนัยสำคัญในการสร้างส่วนหน้าที่ซับซ้อนและการดีบักฐานโค้ดขนาดใหญ่ โมเดลนี้สามารถแปลงไอเดียให้เป็นจริงด้วยผลลัพธ์ที่ใช้งานง่ายและสวยงาม สร้างเว็บไซต์ แอปพลิเคชัน และเกมที่สวยงามและตอบสนองได้ดี ด้วยสัมผัสทางสุนทรียภาพที่เฉียบคม ทั้งหมดนี้จากพรอมป์เดียว ผู้ทดสอบระยะแรกยังสังเกตถึงการตัดสินใจด้านการออกแบบของโมเดลนี้ โดยมีความเข้าใจที่ลึกซึ้งยิ่งขึ้นต่อองค์ประกอบอย่างระยะห่าง การจัดวางตัวอักษร และพื้นที่ว่าง
GPT-5 Nano เป็นโมเดลปัญญาประดิษฐ์ที่ OpenAI จัดให้บริการ
GPT-5 mini เป็นสมาชิกของตระกูล GPT-5 ของ OpenAI ที่ได้รับการปรับให้เหมาะสมด้านต้นทุนและเวลาแฝง โดยมุ่งหมายจะส่งมอบจุดแข็งด้านมัลติโหมดและความสามารถในการทำตามคำสั่งของ GPT-5 ได้เป็นส่วนใหญ่ ขณะที่ลดต้นทุนลงอย่างมากสำหรับการใช้งานในระดับการผลิตขนาดใหญ่ โดยมุ่งเป้าสู่สภาพแวดล้อมที่ข้อจำกัดหลักคืออัตราการผ่านงาน (throughput) การกำหนดราคาแบบต่อโทเค็นที่คาดการณ์ได้ และการตอบสนองที่รวดเร็ว ขณะเดียวกันก็ยังคงมอบความสามารถแบบอเนกประสงค์ที่แข็งแกร่ง
GPT-5 Chat (ล่าสุด) เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro เป็นรุ่น “pro” ของโมเดลการให้เหตุผล o3 ที่ถูกออกแบบให้ใช้เวลาคิดได้นานขึ้นและมอบคำตอบที่เชื่อถือได้มากที่สุด โดยอาศัยการเรียนรู้แบบเสริมกำลังด้วยห่วงโซ่การคิดแบบส่วนตัว และสร้างเกณฑ์มาตรฐานล้ำสมัยชุดใหม่ครอบคลุมหลายสาขา เช่น วิทยาศาสตร์ การเขียนโปรแกรม และธุรกิจ — พร้อมผสานเครื่องมือต่าง ๆ แบบอัตโนมัติ เช่น การค้นหาบนเว็บ การวิเคราะห์ไฟล์ การรัน Python และการให้เหตุผลเชิงภาพ ภายใน API
เวอร์ชันราคาประหยัดของ GPT แบบเรียลไทม์—สามารถตอบสนองต่ออินพุตทั้งเสียงและข้อความแบบเรียลไทม์ผ่านการเชื่อมต่อ WebRTC, WebSocket หรือ SIP

OpenAI การแปลงข้อความเป็นคำพูด

แปลงคำพูดเป็นข้อความ, สร้างคำแปล
GPT-4o mini TTS เป็นโมเดลการสังเคราะห์เสียงจากข้อความแบบประสาทเทียม ออกแบบมาเพื่อสร้างเสียงพูดที่เป็นธรรมชาติและมีความหน่วงต่ำสำหรับแอปพลิเคชันที่ผู้ใช้ใช้งานโดยตรง。 มันสามารถแปลงข้อความเป็นเสียงพูดที่ฟังเป็นธรรมชาติ พร้อมตัวเลือกเสียงหลายแบบ เอาต์พุตหลายรูปแบบ และการสังเคราะห์แบบสตรีมมิงเพื่อประสบการณ์การใช้งานที่ตอบสนองรวดเร็ว。 การใช้งานทั่วไป ได้แก่ ผู้ช่วยเสียง, ระบบ IVR และโฟลว์การติดต่อ, การอ่านเนื้อหาผลิตภัณฑ์ออกเสียง, และการบรรยายสื่อ。 ไฮไลต์ทางเทคนิค ได้แก่ การสตรีมผ่าน API และการส่งออกเป็นรูปแบบไฟล์เสียงที่ใช้กันทั่วไป เช่น MP3 และ WAV。
GPT-4o Transcribe เป็นโมเดลแปลงเสียงเป็นข้อความที่รองรับการรู้จำคำพูดหลายภาษาด้วยความหน่วงต่ำ รองรับการสตรีมแบบเรียลไทม์และการถอดเสียงแบบแบตช์จากรูปแบบไฟล์เสียงที่ใช้กันทั่วไป พร้อมเครื่องหมายวรรคตอนและการแบ่งประโยค การใช้งานทั่วไป ได้แก่ คำบรรยายสด, อินพุตสำหรับผู้ช่วยเสียง, บันทึกการประชุม และการถอดเสียงจากสื่อหรือการบันทึกการโทร จุดเด่นด้านเทคนิครวมถึงการรองรับโมดาลิตี้เสียง การประมวลผลแบบเนื้อหายาว และ API ที่เหมาะกับเวิร์กโฟลว์แบบโต้ตอบและฝั่งเซิร์ฟเวอร์
GPT-4o mini Audio Preview เป็นโมเดลมัลติโมดัลขนาดกะทัดรัดสำหรับพัฒนาแอปพลิเคชันสนทนาเชิงเสียง รองรับอินพุตและเอาต์พุตเสียงควบคู่กับข้อความ ช่วยให้ทำการรู้จำเสียง การสังเคราะห์เสียง และบทสนทนาแบบผสมข้อความ-เสียง พร้อมการเรียกใช้เครื่องมือ/ฟังก์ชันสำหรับการดำเนินการแบบมีโครงสร้าง การใช้งานทั่วไป ได้แก่ ผู้ช่วยเสียง การถอดความแบบสตรีมพร้อมการสรุป เวิร์กโฟลว์ IVR และคอลบอต และผู้ช่วยในแอปที่รองรับเสียง ไฮไลต์ด้านเทคนิคได้แก่ audio I/O การตอบสนองแบบสตรีม การทำตามคำสั่ง และการผสานใช้งานผ่าน API สำหรับแชทและเครื่องมือ
GPT-4o mini Realtime Preview เป็นโมเดลมัลติโหมดแบบเรียลไทม์สำหรับประสบการณ์เชิงโต้ตอบด้านเสียงและภาพ รองรับเสียงพูด ข้อความ และรูปภาพ พร้อมอินพุตและเอาต์พุตแบบสตรีมมิง รวมถึงการเรียกใช้เครื่องมือ/ฟังก์ชันเพื่อดำเนินการที่ยึดโยงกับข้อมูลจริง การใช้งานทั่วไปได้แก่ ผู้ช่วยเสียง การจัดการสายโทรแบบสด การทำคำบรรยายแบบเรียลไทม์ และการตอบคำถามเชิงภาพจากกล้องหรือเนื้อหาบนหน้าจอ ไฮไลต์ทางเทคนิครวมถึงเสียงแบบสองทิศทาง การเข้าใจภาพ การตอบกลับแบบสตรีมมิง และเอาต์พุตแบบมีโครงสร้างผ่านฟังก์ชัน

GPT-4o mini Audio เป็นโมเดลแบบมัลติโหมดสำหรับการโต้ตอบด้วยเสียงและข้อความ รองรับการรู้จำเสียง การแปลภาษา และการแปลงข้อความเป็นเสียง สามารถปฏิบัติตามคำสั่ง และเรียกใช้เครื่องมือเพื่อดำเนินการแบบมีโครงสร้างพร้อมการตอบสนองแบบสตรีมมิง การใช้งานทั่วไปได้แก่ ผู้ช่วยเสียงแบบเรียลไทม์ คำบรรยายสดและการแปลสด การสรุปการโทร และแอปพลิเคชันที่ควบคุมด้วยเสียง จุดเด่นด้านเทคนิคประกอบด้วย อินพุตและเอาต์พุตเสียง การตอบสนองแบบสตรีมมิง การเรียกใช้ฟังก์ชัน และเอาต์พุต JSON แบบมีโครงสร้าง
Realtime API ช่วยให้นักพัฒนาสร้างประสบการณ์แบบมัลติโหมดที่มีความหน่วงต่ำ รวมถึงฟังก์ชันเสียงต่อเสียง. ข้อความและเสียงที่ประมวลผลโดย Realtime API จะถูกคิดราคาแยกกัน. โมเดลนี้รองรับความยาวบริบทสูงสุด 128,000 โทเค็น.
โมเดลนี้รองรับความยาวบริบทได้สูงสุด 128,000 โทเค็น.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI.
O3-mini เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI.
O3 เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI.
<div>GPT-4o เป็นโมเดลแบบมัลติโมดัลที่ล้ำหน้าที่สุดของ OpenAI เร็วกว่าและมีต้นทุนต่ำกว่า GPT-4 Turbo พร้อมความสามารถด้านภาพที่ทรงพลังยิ่งขึ้น โมเดลนี้มีบริบทขนาด 128K และมีขีดจำกัดความรู้ ณ เดือนตุลาคม 2023 โมเดลในซีรีส์ 1106 ขึ้นไปรองรับ tool_calls และ function_call.</div> โมเดลนี้รองรับความยาวบริบทสูงสุด 128,000 โทเค็น.
GPT-4.1 mini เป็นโมเดลปัญญาประดิษฐ์จาก OpenAI. gpt-4.1-mini: เป็นก้าวกระโดดครั้งสำคัญด้านประสิทธิภาพของโมเดลขนาดเล็ก จนเอาชนะ GPT-4o ได้ในหลายเบนช์มาร์ก. ทำได้เทียบเท่าหรือเหนือกว่า GPT-4o ในการประเมินด้านความฉลาด พร้อมทั้งลดเวลาแฝงลงเกือบครึ่งหนึ่งและลดต้นทุนลง 83%. โมเดลนี้รองรับความยาวบริบทสูงสุด 1,047,576 โทเค็น.
GPT-4.1 เป็นโมเดลปัญญาประดิษฐ์ที่ให้บริการโดย OpenAI. gpt-4.1-nano: มีหน้าต่างบริบทที่ใหญ่ขึ้น—รองรับโทเคนบริบทได้สูงสุด 1 million และสามารถใช้ประโยชน์จากบริบทนั้นได้ดียิ่งขึ้นด้วยความสามารถในการทำความเข้าใจบริบทยาวที่ได้รับการปรับปรุง. มีจุดตัดความรู้ที่อัปเดตเป็นเดือนมิถุนายน 2024. โมเดลนี้รองรับความยาวบริบทสูงสุด 1,047,576 โทเคน.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon