OpenAI: GPT-5 mini
gpt-5-mini- Đầu vào / Đầu ra-30%
- $0.25 / $2.00$0.175 / $1.40
- Ngữ cảnh
- 400K
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về GPT-5 mini
GPT-5 mini là mô hình GPT-5 nhỏ hơn của OpenAI, được mô tả là phiên bản nhanh hơn và tiết kiệm chi phí hơn của GPT-5 cho các công việc có định nghĩa rõ ràng và lưu lượng cao. Nó chấp nhận văn bản và hình ảnh, trả về văn bản, đồng thời giữ lại các token suy luận, gọi hàm và đầu ra có cấu trúc. Hãy chọn nó thay vì mô hình đầy đủ khi độ trễ và khối lượng công việc quan trọng hơn độ chính xác tối đa.
Ưu điểm
- Được OpenAI định vị là phiên bản nhanh hơn của GPT-5 cho các ứng dụng nhạy cảm về thời gian và có lưu lượng cao.
- Giữ lại các token suy luận, vì vậy nó vẫn có thể giải quyết các vấn đề đa bước ở quy mô nhỏ hơn.
- Xử lý gọi hàm, tìm kiếm web, tìm kiếm tệp và đầu ra có cấu trúc giống như mô hình lớn hơn của nó.
- Nhận đầu vào hình ảnh, cho phép đặt câu hỏi về ảnh chụp màn hình và tài liệu mà không cần mô hình thị giác riêng biệt.
Khi nào nên chọn model khác
- Mốc kiến thức tháng 5 năm 2024 của nó sớm hơn so với GPT-5 đầy đủ, vì vậy nó biết ít hơn về các sự kiện gần đây.
- Đối với các suy luận khó nhất và các tác vụ tái cấu trúc lớn, GPT-5 đầy đủ hoặc gói Pro là lựa chọn an toàn hơn.
- Nó chỉ trả về văn bản, không có đầu ra âm thanh hoặc hình ảnh.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
Giá
Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.
Thông số mặc định
mỗi 1M token- Giá Official
- Đầu vào $0.25 / Đầu ra $2.00 / Đọc bộ nhớ đệm $0.025
- Giá Verified
- Đầu vào $0.175 / Đầu ra $1.40 / Đọc bộ nhớ đệm $0.0175
- Giảm giá
- -30%
Đọc bộ nhớ đệm
- Giá Official
- $0.025
- Giá Verified
- $0.0175
- Giảm giá
- -30%
Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.
Tìm kiếm web
- Giá Official
- $0.01/lượt tìm
- Giá Verified
- $0.007/lượt tìm
- Giảm giá
- -30%
| Giá Officialmỗi 1M token | Giá Verifiedmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $0.25 / Đầu ra $2.00 / Đọc bộ nhớ đệm $0.025 | Đầu vào $0.175 / Đầu ra $1.40 / Đọc bộ nhớ đệm $0.0175 | -30% |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.025 | $0.0175 | -30% |
| Phí công cụPhí tính theo mỗi lượt gọi khi model sử dụng công cụ. | |||
| Tìm kiếm web | $0.01/lượt tìm | $0.007/lượt tìm | -30% |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở GPT-5 mini trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử gpt-5-mini với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
- Thị giác
Trợ lý phục vụ khách hàng
Trả lời các câu hỏi về sản phẩm bằng các lệnh gọi công cụ vào hệ thống đặt hàng, nơi thời gian phản hồi quyết định trải nghiệm.
Phân loại hàng loạt
Gán nhãn hàng nghìn phiếu hỗ trợ hoặc đánh giá với lược đồ đầu ra có cấu trúc và các danh mục nhất quán.
Giải thích mã và chỉnh sửa nhỏ
Giải thích các hàm, viết kiểm thử và thực hiện các chỉnh sửa giới hạn khi một mô hình kích thước đầy đủ là quá mức cần thiết cho tác vụ.
Các bước phụ của tác nhân
Chạy các tra cứu và tóm tắt định kỳ trong một quy trình làm việc lớn hơn trong khi một mô hình mạnh hơn xử lý việc lập kế hoạch.
Ví dụ prompt
Phân loại phiếu hỗ trợ này là thanh toán, lỗi hay yêu cầu tính năng và trả về nhãn kèm theo một câu giải thích.
Tóm tắt bản ghi cuộc gọi này thành năm gạch đầu dòng và liệt kê bất kỳ mục hành động nào kèm theo người chịu trách nhiệm.
Viết kiểm thử đơn vị cho hàm này và chỉ ra bất kỳ đầu vào nào mà nó không xử lý được.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
GPT-5 mini là gì?
GPT-5 mini là phiên bản nhỏ hơn của GPT-5 từ OpenAI. Nó hướng tới công việc nhanh, tiết kiệm chi phí với khối lượng yêu cầu lớn và vẫn hỗ trợ suy luận, công cụ và đầu vào hình ảnh.
Khi nào tôi nên sử dụng GPT-5 mini thay vì GPT-5?
Sử dụng mini cho các tác vụ có phạm vi rõ ràng như phân loại, tóm tắt và gọi công cụ định kỳ nơi tốc độ và khối lượng công việc được ưu tiên. Sử dụng GPT-5 đầy đủ khi các câu trả lời thường xuyên sai trên tập đánh giá của riêng bạn hoặc tác vụ cần suy luận sâu hơn.
GPT-5 mini có chấp nhận hình ảnh không?
Có. Văn bản và hình ảnh được đưa vào và văn bản được trả ra. Điều đó bao gồm việc đọc ảnh chụp màn hình, biểu mẫu và biểu đồ để đặt câu hỏi hoặc trích xuất, nhưng bản thân mô hình không thể tự tạo hoặc chỉnh sửa hình ảnh.
Mốc kiến thức của GPT-5 mini là gì?
OpenAI liệt kê ngày 31 tháng 5 năm 2024 là mốc kiến thức cho mô hình này. Bất kỳ thông tin nào mới hơn đều phải đến từ câu lệnh, từ các tệp đính kèm hoặc từ lệnh gọi công cụ tìm kiếm web.
GPT-5 mini có nhỏ hơn GPT-5 nano không?
Không. Nano là mô hình nhỏ hơn và rẻ hơn trong hai loại và hướng tới việc tóm tắt và phân loại. Mini nằm giữa nano và GPT-5 đầy đủ về năng lực và chi phí.
GPT-5 mini có giá bao nhiêu?
Trên TokenLab, GPT-5 mini có giá Đầu vào $0.175 / Đầu ra $1.40 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của GPT-5 mini là bao nhiêu?
GPT-5 mini hỗ trợ tối đa 400.000 token ngữ cảnh và trả về tối đa 128.000 token mỗi phản hồi.
GPT-5 mini nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho GPT-5 mini. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
GPT-5 mini hỗ trợ những thao tác nào?
GPT-5 mini hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh GPT-5 mini
Nguồn
Đánh giá ngày 2 thg 10, 2026