
GPT-6 Sol
Khám phá API của GPT-6 Sol.

Khám phá API của GPT-6 Sol.

GPT-6 Astra, the flagship model for complex reasoning and coding. Choose GPT-5.6 Terra to balance intelligence and cost,

Mô hình tạo hình ảnh mạnh mẽ nhất của OpenAI, với khả năng kết xuất văn bản gần như hoàn hảo trong nhiều ngôn ngữ, độ phân giải lên đến 4K và Thinking Mode được hỗ trợ bởi khả năng suy luận. Được xây dựng cho các quy trình sản xuất đòi hỏi độ chính xác, tốc độ và đầu ra hình ảnh đúng nhận diện thương hiệu.

Khám phá API của gpt-oss-20b(free).

GPT-5.4 Mini is a lightweight and efficient AI model optimized for speed and everyday productivity. It provides reliable conversational capabilities, content generation, and task assistance while maintaining low latency and resource usage.

Khám phá API của GPT Image 2.5(sunburst).
GPT-Realtime-2 is our most capable realtime voice model. It supports speech-to-speech interactions with configurable reasoning effort, stronger instruction following, and more reliable tool use for complex voice-agent workflows

GPT-5.4 Nano is an ultra-lightweight AI model built for maximum speed and efficiency. It is optimized for simple tasks, real-time interactions, and large-scale deployments where low latency and minimal resource consumption are essential.

seedance-2-0

The best voice model for audio in, audio out.

Mô hình mạnh nhất của OpenAI, được thiết kế cho các tác vụ khó nhất và các quy trình tác nhân tự chủ kéo dài. GPT-5.5 Pro xuất sắc trong lập trình phức tạp, sử dụng máy tính, nghiên cứu chuyên sâu, phân tích dữ liệu và suy luận khoa học — mang lại trí tuệ đẳng cấp tiên phong với độ trễ tương đương GPT-5.4 cùng hiệu quả sử dụng token cao hơn. Lý tưởng cho các trường hợp sử dụng cấp doanh nghiệp và chuyên nghiệp đòi hỏi tiêu chuẩn cao nhất về độ chính xác và khả năng thực thi tác vụ tự chủ.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT Image 2 ALL is a comprehensive image generation model designed to handle a wide range of creative and professional visual tasks. It combines high-quality image creation, advanced prompt understanding, and versatile style support to deliver exceptional results across diverse use cases.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.
GPT-5.1 là một mô hình ngôn ngữ mục đích chung được tinh chỉnh theo hướng dẫn, tập trung vào việc tạo văn bản và suy luận trên các quy trình làm việc của sản phẩm. Mô hình hỗ trợ đối thoại đa lượt, định dạng đầu ra có cấu trúc, và các tác vụ hướng mã như soạn thảo, tái cấu trúc và giải thích. Các trường hợp sử dụng điển hình bao gồm trợ lý trò chuyện, Hỏi đáp tăng cường truy hồi, chuyển đổi dữ liệu, và tự động hóa kiểu tác tử với công cụ hoặc API khi được hỗ trợ. Những điểm nổi bật về kỹ thuật bao gồm chế độ lấy văn bản làm trung tâm, khả năng tuân theo hướng dẫn, đầu ra theo kiểu JSON, và khả năng tương thích với việc gọi hàm trong các khung điều phối phổ biến.
Phiên bản tối ưu hóa chi phí của GPT Image 1. Đây là một mô hình ngôn ngữ đa phương thức gốc, nhận cả văn bản và hình ảnh làm đầu vào và tạo đầu ra là hình ảnh.
GPT-5 là mô hình viết mã mạnh mẽ nhất của OpenAI cho đến nay. Nó cho thấy những cải tiến đáng kể trong việc tạo giao diện front-end phức tạp và gỡ lỗi trong các codebase lớn. Nó có thể biến ý tưởng thành hiện thực với kết quả trực quan và giàu tính thẩm mỹ, tạo ra các trang web, ứng dụng và trò chơi đẹp, đáp ứng tốt với cảm quan thẩm mỹ tinh tế, tất cả chỉ từ một lời nhắc duy nhất. Những người thử nghiệm sớm cũng ghi nhận các lựa chọn thiết kế của nó, với sự hiểu biết sâu hơn về các yếu tố như khoảng cách, kiểu chữ và khoảng trắng.
GPT-5 Nano là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
GPT-5 mini là thành viên trong gia đình GPT-5 của OpenAI, được tối ưu hóa về chi phí và độ trễ, nhằm mang lại phần lớn các năng lực đa phương thức và khả năng làm theo hướng dẫn của GPT-5 với chi phí thấp hơn đáng kể cho việc sử dụng ở quy mô sản xuất lớn. Sản phẩm hướng tới các môi trường mà thông lượng, mức định giá theo mỗi token có thể dự đoán trước và phản hồi nhanh là những ràng buộc chính, đồng thời vẫn cung cấp các khả năng tổng quát mạnh mẽ.
coming soon
gpt-4o-image generate images as output, optionally using images as input

Sora 2 Pro là mô hình tạo sinh đa phương tiện tiên tiến và mạnh mẽ nhất của chúng tôi, có khả năng tạo video với âm thanh được đồng bộ hóa. Nó có thể tạo các đoạn video chi tiết, sinh động từ ngôn ngữ tự nhiên hoặc hình ảnh.

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.

Khám phá API của GPT Image 2.5 Flare.
OpenAI o3‑pro là biến thể “pro” của mô hình suy luận o3, được thiết kế để suy nghĩ lâu hơn và cung cấp các phản hồi đáng tin cậy nhất bằng cách áp dụng học tăng cường chuỗi tư duy riêng tư và thiết lập các chuẩn mực tối tân mới trên các lĩnh vực như khoa học, lập trình và kinh doanh—đồng thời tự động tích hợp các công cụ như tìm kiếm web, phân tích tệp, thực thi Python và suy luận thị giác ngay trong API.

OpenAI Text-to-Speech

Mô hình tạo video siêu mạnh mẽ, kèm hiệu ứng âm thanh, hỗ trợ định dạng chat.

Chuyển giọng nói thành văn bản, tạo bản dịch
.jpeg&w=3840&q=75)
Mô hình chủ lực thông minh và trực quan nhất của OpenAI, được thiết kế cho lập trình phức tạp, luồng công việc dựa trên tác nhân, sử dụng máy tính, phân tích dữ liệu và nghiên cứu chuyên sâu. Mang lại trí tuệ ở đẳng cấp tiên phong với độ trễ thấp tương đương GPT-5.4, đồng thời hoàn thành tác vụ với hiệu quả sử dụng token cao hơn. Là lựa chọn hàng đầu cho các khối lượng công việc chuyên nghiệp và doanh nghiệp đòi hỏi cao.
Khám phá API của tts-1.
GPT-4o mini TTS là một mô hình chuyển văn bản thành giọng nói dựa trên mạng nơ-ron, được thiết kế để tạo giọng nói tự nhiên với độ trễ thấp cho các ứng dụng hướng tới người dùng. Nó chuyển văn bản thành giọng nói tự nhiên với các giọng đọc có thể lựa chọn, đầu ra đa định dạng và khả năng tổng hợp theo luồng để mang lại trải nghiệm phản hồi nhanh. Các trường hợp sử dụng điển hình bao gồm trợ lý giọng nói, IVR và luồng liên hệ, tính năng đọc to thông tin sản phẩm và thuyết minh nội dung truyền thông. Các điểm nổi bật về kỹ thuật bao gồm truyền phát theo luồng dựa trên API và xuất ra các định dạng âm thanh phổ biến như MP3 và WAV.
Khám phá API của o1-pro-2025-03-19.
GPT-4o Transcribe là một mô hình chuyển âm thanh thành văn bản dành cho nhận dạng giọng nói đa ngôn ngữ với độ trễ thấp. Mô hình hỗ trợ truyền phát thời gian thực và chuyển biên theo lô từ các định dạng âm thanh phổ biến, kèm dấu câu và phân đoạn câu. Các trường hợp sử dụng điển hình bao gồm phụ đề trực tiếp, đầu vào cho trợ lý giọng nói, ghi chú cuộc họp, và chuyển biên nội dung truyền thông hoặc ghi âm cuộc gọi. Các điểm nổi bật kỹ thuật bao gồm hỗ trợ dạng thức âm thanh, xử lý nội dung dài, và API phù hợp cho các quy trình tương tác và phía máy chủ.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.
GPT-4o mini Audio Preview là mô hình đa phương thức nhỏ gọn để xây dựng các ứng dụng hội thoại bằng âm thanh. Mô hình hỗ trợ nhập và xuất giọng nói song song với văn bản, cho phép nhận dạng giọng nói, tổng hợp giọng nói và đối thoại kết hợp văn bản–âm thanh, kèm khả năng gọi công cụ/hàm cho các hành động có cấu trúc. Các trường hợp sử dụng điển hình gồm trợ lý giọng nói, phiên âm theo luồng kèm tóm tắt, quy trình IVR và call-bot, cũng như các trợ lý trong ứng dụng có hỗ trợ âm thanh. Các điểm nổi bật kỹ thuật bao gồm I/O âm thanh, phản hồi theo luồng, khả năng làm theo chỉ dẫn và tích hợp qua các API trò chuyện và công cụ.
GPT-4o mini Realtime Preview là một mô hình đa phương thức thời gian thực dành cho các trải nghiệm giọng nói và thị giác mang tính tương tác. Mô hình xử lý giọng nói, văn bản và hình ảnh với đầu vào và đầu ra dạng luồng, cùng khả năng gọi công cụ/hàm để thực hiện các hành động có cơ sở. Các trường hợp sử dụng điển hình bao gồm trợ lý giọng nói, xử lý cuộc gọi trực tiếp, tạo phụ đề thời gian thực và hỏi đáp về nội dung thị giác từ camera hoặc màn hình. Các điểm nổi bật về kỹ thuật gồm âm thanh hai chiều, khả năng hiểu thị giác, phản hồi dạng luồng và đầu ra có cấu trúc thông qua các hàm.
Khám phá API của o1-2024-12-17.

GPT-5.3 Instant model used in ChatGPT

GPT-4o mini Audio là một mô hình đa phương thức dành cho các tương tác bằng giọng nói và văn bản. Nó thực hiện nhận dạng giọng nói, dịch và chuyển văn bản thành giọng nói, tuân theo chỉ dẫn, và có thể gọi các công cụ để thực hiện các hành động có cấu trúc với phản hồi theo luồng. Các trường hợp sử dụng điển hình bao gồm trợ lý giọng nói thời gian thực, phụ đề và dịch trực tiếp, tóm tắt cuộc gọi, và các ứng dụng điều khiển bằng giọng nói. Các điểm nổi bật về kỹ thuật bao gồm đầu vào và đầu ra âm thanh, phản hồi theo luồng, gọi hàm, và xuất JSON có cấu trúc.
Khám phá API của omni-moderation-2024-09-26.
Khám phá API của omni-moderation-latest.
Khám phá API của tts-1-hd-1106.

The best voice model for audio in, audio out with Chat Completions.
Khám phá API của tts-1-1106.
GPT-Realtime-2.1 updates GPT-Realtime-2 with improved alphanumeric recognition, silence and noise handling, and interruption behavior. It supports speech-to-speech interactions with configurable reasoning effort, instruction following, and tool use for complex voice-agent workflows.
Khám phá API của tts-1-hd.

Start with GPT-5.6 Sol for complex reasoning and coding, choose GPT-5.6 Terra to balance intelligence and cost, or use GPT-5.6 Luna for cost-sensitive, high-volume workloads.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.

Coming Soon

Coming Soon

coming soon
O4-mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
O3-mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
O3 là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
O1-pro is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
<div>GPT-4o là mô hình đa phương thức tiên tiến nhất của OpenAI, nhanh hơn và rẻ hơn so với GPT-4 Turbo, với khả năng thị giác mạnh mẽ hơn. Mô hình này có cửa sổ ngữ cảnh 128K và mốc kiến thức đến tháng 10 năm 2023. Các mô hình thuộc dòng 1106 trở lên hỗ trợ tool_calls và function_call.</div> Mô hình này hỗ trợ độ dài cửa sổ ngữ cảnh tối đa là 128,000 token.
GPT-4.1 nano là một mô hình trí tuệ nhân tạo do OpenAI cung cấp. gpt-4.1-nano: Có cửa sổ ngữ cảnh lớn hơn—hỗ trợ tới 1 triệu token ngữ cảnh và tận dụng ngữ cảnh đó tốt hơn nhờ khả năng hiểu ngữ cảnh dài được cải thiện. Có mốc kiến thức được cập nhật là tháng 6 năm 2024. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa là 1,047,576 token.
GPT-4.1 mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp. gpt-4.1-mini: Một bước nhảy vọt đáng kể về hiệu năng của mô hình nhỏ, thậm chí vượt qua GPT-4o trong nhiều bài đánh giá điểm chuẩn. Nó đạt hoặc vượt GPT-4o trong các đánh giá trí tuệ, đồng thời giảm độ trễ gần một nửa và chi phí tới 83%. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa là 1,047,576 token.
GPT-4.1 là một mô hình trí tuệ nhân tạo do OpenAI cung cấp. gpt-4.1-nano: Có cửa sổ ngữ cảnh lớn hơn—hỗ trợ tới 1 triệu token ngữ cảnh và có khả năng tận dụng tốt hơn ngữ cảnh đó nhờ khả năng hiểu ngữ cảnh dài được cải thiện. Có mốc kiến thức được cập nhật đến tháng 6 năm 2024. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa 1,047,576 token.