GPT-4.1 nano là một mô hình trí tuệ nhân tạo do OpenAI cung cấp. gpt-4.1-nano: Có cửa sổ ngữ cảnh lớn hơn—hỗ trợ tới 1 triệu token ngữ cảnh và tận dụng ngữ cảnh đó tốt hơn nhờ khả năng hiểu ngữ cảnh dài được cải thiện. Có mốc kiến thức được cập nhật là tháng 6 năm 2024. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa là 1,047,576 token.

seedance-2-0

Mô hình tạo hình ảnh mạnh mẽ nhất của OpenAI, với khả năng kết xuất văn bản gần như hoàn hảo trong nhiều ngôn ngữ, độ phân giải lên đến 4K và Thinking Mode được hỗ trợ bởi khả năng suy luận. Được xây dựng cho các quy trình sản xuất đòi hỏi độ chính xác, tốc độ và đầu ra hình ảnh đúng nhận diện thương hiệu.
.jpeg&w=3840&q=75)
Mô hình chủ lực thông minh và trực quan nhất của OpenAI, được thiết kế cho lập trình phức tạp, luồng công việc dựa trên tác nhân, sử dụng máy tính, phân tích dữ liệu và nghiên cứu chuyên sâu. Mang lại trí tuệ ở đẳng cấp tiên phong với độ trễ thấp tương đương GPT-5.4, đồng thời hoàn thành tác vụ với hiệu quả sử dụng token cao hơn. Là lựa chọn hàng đầu cho các khối lượng công việc chuyên nghiệp và doanh nghiệp đòi hỏi cao.

Mô hình mạnh nhất của OpenAI, được thiết kế cho các tác vụ khó nhất và các quy trình tác nhân tự chủ kéo dài. GPT-5.5 Pro xuất sắc trong lập trình phức tạp, sử dụng máy tính, nghiên cứu chuyên sâu, phân tích dữ liệu và suy luận khoa học — mang lại trí tuệ đẳng cấp tiên phong với độ trễ tương đương GPT-5.4 cùng hiệu quả sử dụng token cao hơn. Lý tưởng cho các trường hợp sử dụng cấp doanh nghiệp và chuyên nghiệp đòi hỏi tiêu chuẩn cao nhất về độ chính xác và khả năng thực thi tác vụ tự chủ.

GPT Image 2 is openai state-of-the-art image generation model for fast, high-quality image generation and editing. It supports flexible image sizes and high-fidelity image inputs.

Sora 2 Pro là mô hình tạo sinh đa phương tiện tiên tiến và mạnh mẽ nhất của chúng tôi, có khả năng tạo video với âm thanh được đồng bộ hóa. Nó có thể tạo các đoạn video chi tiết, sinh động từ ngôn ngữ tự nhiên hoặc hình ảnh.

gpt-5.2-pro is the highest-capability, production-oriented member of OpenAI’s GPT-5.2 family, exposed through the Responses API for workloads that demand maximal fidelity, multi-step reasoning, extensive tool use and the largest context/throughput budgets OpenAI offers.

GPT-5.4 nano is designed for tasks where speed and cost matter most like classification, data extraction, ranking, and sub-agents.

GPT-5.4 mini brings the strengths of GPT-5.4 to a faster, more efficient model designed for high-volume workloads.

GPT-5.4 is the frontier model for complex professional work. Reasoning.effort supports: none (default), low, medium, high and xhigh.

GPT-5.3 Instant model used in ChatGPT

Mô hình tạo video siêu mạnh mẽ, kèm hiệu ứng âm thanh, hỗ trợ định dạng chat.

The best voice model for audio in, audio out with Chat Completions.

The best voice model for audio in, audio out.

GPT-5.3-Codex is optimized for agentic coding tasks in Codex or similar environments. GPT-5.3-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-5.2-Codex is an upgraded version of GPT-5.2 optimized for agentic coding tasks in Codex or similar environments. GPT-5.2-Codex supports low, medium, high, and xhigh reasoning effort settings.

GPT-Image-1.5 is OpenAI’s image model in the GPT Image family . It is a natively multimodal GPT model designed to generate images from text prompts and to perform high-fidelity edits of input images while following user instructions closely.

gpt-5.2-chat-latest is the Chat-optimized snapshot of OpenAI’s GPT-5.2 family (branded in ChatGPT as GPT-5.2 Instant). It is the model for interactive/chat use cases that need a blend of speed, long-context handling, multimodal inputs and reliable conversational behaviour.
GPT-5.1-Codex-Max is OpenAI’s purpose-built agentic coding model in the GPT-5.1 family, optimized to execute long-running software engineering workflows (refactors, multi-hour agent loops, terminal automation, test runs and code review) with higher reliability and token efficiency than its predecessors.
GPT-5.1-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5.1 Chat là mô hình ngôn ngữ hội thoại được tinh chỉnh theo chỉ dẫn cho các mục đích chung về trò chuyện, suy luận và viết. Nó hỗ trợ đối thoại nhiều lượt, tóm tắt, soạn thảo, hỏi-đáp dựa trên cơ sở tri thức, và hỗ trợ viết mã nhẹ cho các trợ lý trong ứng dụng, tự động hóa hỗ trợ, và trợ lý đồng hành cho quy trình làm việc. Các điểm nổi bật kỹ thuật bao gồm căn chỉnh tối ưu cho hội thoại, đầu ra có thể kiểm soát và có cấu trúc, cùng các lộ trình tích hợp để gọi công cụ và quy trình truy xuất khi khả dụng.
GPT-5.1 là một mô hình ngôn ngữ mục đích chung được tinh chỉnh theo hướng dẫn, tập trung vào việc tạo văn bản và suy luận trên các quy trình làm việc của sản phẩm. Mô hình hỗ trợ đối thoại đa lượt, định dạng đầu ra có cấu trúc, và các tác vụ hướng mã như soạn thảo, tái cấu trúc và giải thích. Các trường hợp sử dụng điển hình bao gồm trợ lý trò chuyện, Hỏi đáp tăng cường truy hồi, chuyển đổi dữ liệu, và tự động hóa kiểu tác tử với công cụ hoặc API khi được hỗ trợ. Những điểm nổi bật về kỹ thuật bao gồm chế độ lấy văn bản làm trung tâm, khả năng tuân theo hướng dẫn, đầu ra theo kiểu JSON, và khả năng tương thích với việc gọi hàm trong các khung điều phối phổ biến.
Phiên bản tối ưu hóa chi phí của GPT Image 1. Đây là một mô hình ngôn ngữ đa phương thức gốc, nhận cả văn bản và hình ảnh làm đầu vào và tạo đầu ra là hình ảnh.
GPT-5-Codex is a high-performance large language model focused on code generation and understanding, with enhanced capabilities for complex programming tasks, code reasoning, and production-level applications.
GPT-5 là mô hình viết mã mạnh mẽ nhất của OpenAI cho đến nay. Nó cho thấy những cải tiến đáng kể trong việc tạo giao diện front-end phức tạp và gỡ lỗi trong các codebase lớn. Nó có thể biến ý tưởng thành hiện thực với kết quả trực quan và giàu tính thẩm mỹ, tạo ra các trang web, ứng dụng và trò chơi đẹp, đáp ứng tốt với cảm quan thẩm mỹ tinh tế, tất cả chỉ từ một lời nhắc duy nhất. Những người thử nghiệm sớm cũng ghi nhận các lựa chọn thiết kế của nó, với sự hiểu biết sâu hơn về các yếu tố như khoảng cách, kiểu chữ và khoảng trắng.
GPT-5 Nano là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
GPT-5 mini là thành viên trong gia đình GPT-5 của OpenAI, được tối ưu hóa về chi phí và độ trễ, nhằm mang lại phần lớn các năng lực đa phương thức và khả năng làm theo hướng dẫn của GPT-5 với chi phí thấp hơn đáng kể cho việc sử dụng ở quy mô sản xuất lớn. Sản phẩm hướng tới các môi trường mà thông lượng, mức định giá theo mỗi token có thể dự đoán trước và phản hồi nhanh là những ràng buộc chính, đồng thời vẫn cung cấp các khả năng tổng quát mạnh mẽ.
GPT-5 Chat (mới nhất) là một mô hình trí tuệ nhân tạo được OpenAI cung cấp.
coming soon
gpt-4o-image generate images as output, optionally using images as input

GPT-5.2 is a multi-flavored model suite (Instant, Thinking, Pro) engineered for better long-context understanding, stronger coding and tool use, and materially higher performance on professional “knowledge-work” benchmarks.
OpenAI o3‑pro là biến thể “pro” của mô hình suy luận o3, được thiết kế để suy nghĩ lâu hơn và cung cấp các phản hồi đáng tin cậy nhất bằng cách áp dụng học tăng cường chuỗi tư duy riêng tư và thiết lập các chuẩn mực tối tân mới trên các lĩnh vực như khoa học, lập trình và kinh doanh—đồng thời tự động tích hợp các công cụ như tìm kiếm web, phân tích tệp, thực thi Python và suy luận thị giác ngay trong API.
Phiên bản tiết kiệm chi phí của GPT thời gian thực — có khả năng phản hồi đầu vào âm thanh và văn bản theo thời gian thực thông qua các kết nối WebRTC, WebSocket hoặc SIP.

OpenAI Text-to-Speech

Chuyển giọng nói thành văn bản, tạo bản dịch
GPT-4o mini TTS là một mô hình chuyển văn bản thành giọng nói dựa trên mạng nơ-ron, được thiết kế để tạo giọng nói tự nhiên với độ trễ thấp cho các ứng dụng hướng tới người dùng. Nó chuyển văn bản thành giọng nói tự nhiên với các giọng đọc có thể lựa chọn, đầu ra đa định dạng và khả năng tổng hợp theo luồng để mang lại trải nghiệm phản hồi nhanh. Các trường hợp sử dụng điển hình bao gồm trợ lý giọng nói, IVR và luồng liên hệ, tính năng đọc to thông tin sản phẩm và thuyết minh nội dung truyền thông. Các điểm nổi bật về kỹ thuật bao gồm truyền phát theo luồng dựa trên API và xuất ra các định dạng âm thanh phổ biến như MP3 và WAV.
GPT-4o Transcribe là một mô hình chuyển âm thanh thành văn bản dành cho nhận dạng giọng nói đa ngôn ngữ với độ trễ thấp. Mô hình hỗ trợ truyền phát thời gian thực và chuyển biên theo lô từ các định dạng âm thanh phổ biến, kèm dấu câu và phân đoạn câu. Các trường hợp sử dụng điển hình bao gồm phụ đề trực tiếp, đầu vào cho trợ lý giọng nói, ghi chú cuộc họp, và chuyển biên nội dung truyền thông hoặc ghi âm cuộc gọi. Các điểm nổi bật kỹ thuật bao gồm hỗ trợ dạng thức âm thanh, xử lý nội dung dài, và API phù hợp cho các quy trình tương tác và phía máy chủ.
GPT-4o mini Audio Preview là mô hình đa phương thức nhỏ gọn để xây dựng các ứng dụng hội thoại bằng âm thanh. Mô hình hỗ trợ nhập và xuất giọng nói song song với văn bản, cho phép nhận dạng giọng nói, tổng hợp giọng nói và đối thoại kết hợp văn bản–âm thanh, kèm khả năng gọi công cụ/hàm cho các hành động có cấu trúc. Các trường hợp sử dụng điển hình gồm trợ lý giọng nói, phiên âm theo luồng kèm tóm tắt, quy trình IVR và call-bot, cũng như các trợ lý trong ứng dụng có hỗ trợ âm thanh. Các điểm nổi bật kỹ thuật bao gồm I/O âm thanh, phản hồi theo luồng, khả năng làm theo chỉ dẫn và tích hợp qua các API trò chuyện và công cụ.
GPT-4o mini Realtime Preview là một mô hình đa phương thức thời gian thực dành cho các trải nghiệm giọng nói và thị giác mang tính tương tác. Mô hình xử lý giọng nói, văn bản và hình ảnh với đầu vào và đầu ra dạng luồng, cùng khả năng gọi công cụ/hàm để thực hiện các hành động có cơ sở. Các trường hợp sử dụng điển hình bao gồm trợ lý giọng nói, xử lý cuộc gọi trực tiếp, tạo phụ đề thời gian thực và hỏi đáp về nội dung thị giác từ camera hoặc màn hình. Các điểm nổi bật về kỹ thuật gồm âm thanh hai chiều, khả năng hiểu thị giác, phản hồi dạng luồng và đầu ra có cấu trúc thông qua các hàm.

GPT-4o mini Audio là một mô hình đa phương thức dành cho các tương tác bằng giọng nói và văn bản. Nó thực hiện nhận dạng giọng nói, dịch và chuyển văn bản thành giọng nói, tuân theo chỉ dẫn, và có thể gọi các công cụ để thực hiện các hành động có cấu trúc với phản hồi theo luồng. Các trường hợp sử dụng điển hình bao gồm trợ lý giọng nói thời gian thực, phụ đề và dịch trực tiếp, tóm tắt cuộc gọi, và các ứng dụng điều khiển bằng giọng nói. Các điểm nổi bật về kỹ thuật bao gồm đầu vào và đầu ra âm thanh, phản hồi theo luồng, gọi hàm, và xuất JSON có cấu trúc.
Realtime API cho phép các nhà phát triển xây dựng các trải nghiệm đa phương thức có độ trễ thấp, bao gồm chức năng chuyển đổi giọng nói sang giọng nói. Văn bản và âm thanh được Realtime API xử lý được tính phí riêng biệt. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa 128,000 token.
Mô hình này hỗ trợ độ dài ngữ cảnh tối đa là 128,000 token.
An Ada-based text embedding model optimized for various NLP tasks.
A small text embedding model for efficient processing.
A large text embedding model for a wide range of natural language processing tasks.
An advanced AI model for generating images from text descriptions.
New version of DALL-E for image generation.
O4-mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
O3-mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
O3 là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
O1-pro is an artificial intelligence model provided by OpenAI.
O1-mini is an artificial intelligence model provided by OpenAI.
O1 is an artificial intelligence model provided by OpenAI.
gpt-oss-20b is an artificial intelligence model provided by cloudflare-workers-ai.
gpt-oss-120b is an artificial intelligence model provided by cloudflare-workers-ai.
GPT-4o mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp.
<div>GPT-4o là mô hình đa phương thức tiên tiến nhất của OpenAI, nhanh hơn và rẻ hơn so với GPT-4 Turbo, với khả năng thị giác mạnh mẽ hơn. Mô hình này có cửa sổ ngữ cảnh 128K và mốc kiến thức đến tháng 10 năm 2023. Các mô hình thuộc dòng 1106 trở lên hỗ trợ tool_calls và function_call.</div> Mô hình này hỗ trợ độ dài cửa sổ ngữ cảnh tối đa là 128,000 token.
GPT-4.1 mini là một mô hình trí tuệ nhân tạo do OpenAI cung cấp. gpt-4.1-mini: Một bước nhảy vọt đáng kể về hiệu năng của mô hình nhỏ, thậm chí vượt qua GPT-4o trong nhiều bài đánh giá điểm chuẩn. Nó đạt hoặc vượt GPT-4o trong các đánh giá trí tuệ, đồng thời giảm độ trễ gần một nửa và chi phí tới 83%. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa là 1,047,576 token.
GPT-4.1 là một mô hình trí tuệ nhân tạo do OpenAI cung cấp. gpt-4.1-nano: Có cửa sổ ngữ cảnh lớn hơn—hỗ trợ tới 1 triệu token ngữ cảnh và có khả năng tận dụng tốt hơn ngữ cảnh đó nhờ khả năng hiểu ngữ cảnh dài được cải thiện. Có mốc kiến thức được cập nhật đến tháng 6 năm 2024. Mô hình này hỗ trợ độ dài ngữ cảnh tối đa 1,047,576 token.
GPT-3.5 Turbo 0125 is an artificial intelligence model provided by OpenAI. A pure official high-speed GPT-3.5 series, supporting tools_call. This model supports a maximum context length of 4096 tokens.
coming soon