Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

OpenAI: GPT-5 mini

GPT-5 nhỏ dành cho các tác tử phản hồi nhanh, hỗ trợ lập trình và tự động hóa hàng ngày
So sánh mô hình
gpt-5-mini
Sẵn sàngOpenAITrò chuyệnGiảm 90% cho đầu vào đã lưu
Đầu vào / Đầu ra-30%
$0.25 / $2.00$0.175 / $1.40
Ngữ cảnh
400K
Độ dài đầu ra tối đa
128K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm PromptSuy luận

Về GPT-5 mini

GPT-5 mini là mô hình GPT-5 nhỏ hơn của OpenAI, được mô tả là phiên bản nhanh hơn và tiết kiệm chi phí hơn của GPT-5 cho các công việc có định nghĩa rõ ràng và lưu lượng cao. Nó chấp nhận văn bản và hình ảnh, trả về văn bản, đồng thời giữ lại các token suy luận, gọi hàm và đầu ra có cấu trúc. Hãy chọn nó thay vì mô hình đầy đủ khi độ trễ và khối lượng công việc quan trọng hơn độ chính xác tối đa.

Ưu điểm

  • Được OpenAI định vị là phiên bản nhanh hơn của GPT-5 cho các ứng dụng nhạy cảm về thời gian và có lưu lượng cao.
  • Giữ lại các token suy luận, vì vậy nó vẫn có thể giải quyết các vấn đề đa bước ở quy mô nhỏ hơn.
  • Xử lý gọi hàm, tìm kiếm web, tìm kiếm tệp và đầu ra có cấu trúc giống như mô hình lớn hơn của nó.
  • Nhận đầu vào hình ảnh, cho phép đặt câu hỏi về ảnh chụp màn hình và tài liệu mà không cần mô hình thị giác riêng biệt.

Khi nào nên chọn model khác

  • Mốc kiến thức tháng 5 năm 2024 của nó sớm hơn so với GPT-5 đầy đủ, vì vậy nó biết ít hơn về các sự kiện gần đây.
  • Đối với các suy luận khó nhất và các tác vụ tái cấu trúc lớn, GPT-5 đầy đủ hoặc gói Pro là lựa chọn an toàn hơn.
  • Nó chỉ trả về văn bản, không có đầu ra âm thanh hoặc hình ảnh.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnResponses API
    POST/v1/responses
    Định dạng API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

Giá

Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.

Thông số mặc định

mỗi 1M token
Giá Official
Đầu vào $0.25 / Đầu ra $2.00 / Đọc bộ nhớ đệm $0.025
Giá Verified
Đầu vào $0.175 / Đầu ra $1.40 / Đọc bộ nhớ đệm $0.0175
Giảm giá
-30%
Giá cache của prompt

Đọc bộ nhớ đệm

Giá Official
$0.025
Giá Verified
$0.0175
Giảm giá
-30%
Phí công cụ

Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.

Tìm kiếm web

Giá Official
$0.01/lượt tìm
Giá Verified
$0.007/lượt tìm
Giảm giá
-30%

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở GPT-5 mini trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử gpt-5-mini với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Suy luận
  • Thị giác
  • Trợ lý phục vụ khách hàng

    Trả lời các câu hỏi về sản phẩm bằng các lệnh gọi công cụ vào hệ thống đặt hàng, nơi thời gian phản hồi quyết định trải nghiệm.

  • Phân loại hàng loạt

    Gán nhãn hàng nghìn phiếu hỗ trợ hoặc đánh giá với lược đồ đầu ra có cấu trúc và các danh mục nhất quán.

  • Giải thích mã và chỉnh sửa nhỏ

    Giải thích các hàm, viết kiểm thử và thực hiện các chỉnh sửa giới hạn khi một mô hình kích thước đầy đủ là quá mức cần thiết cho tác vụ.

  • Các bước phụ của tác nhân

    Chạy các tra cứu và tóm tắt định kỳ trong một quy trình làm việc lớn hơn trong khi một mô hình mạnh hơn xử lý việc lập kế hoạch.

Ví dụ prompt

Phân loại phiếu hỗ trợ này là thanh toán, lỗi hay yêu cầu tính năng và trả về nhãn kèm theo một câu giải thích.

Tóm tắt bản ghi cuộc gọi này thành năm gạch đầu dòng và liệt kê bất kỳ mục hành động nào kèm theo người chịu trách nhiệm.

Viết kiểm thử đơn vị cho hàm này và chỉ ra bất kỳ đầu vào nào mà nó không xử lý được.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

GPT-5 mini là gì?

GPT-5 mini là phiên bản nhỏ hơn của GPT-5 từ OpenAI. Nó hướng tới công việc nhanh, tiết kiệm chi phí với khối lượng yêu cầu lớn và vẫn hỗ trợ suy luận, công cụ và đầu vào hình ảnh.

Khi nào tôi nên sử dụng GPT-5 mini thay vì GPT-5?

Sử dụng mini cho các tác vụ có phạm vi rõ ràng như phân loại, tóm tắt và gọi công cụ định kỳ nơi tốc độ và khối lượng công việc được ưu tiên. Sử dụng GPT-5 đầy đủ khi các câu trả lời thường xuyên sai trên tập đánh giá của riêng bạn hoặc tác vụ cần suy luận sâu hơn.

GPT-5 mini có chấp nhận hình ảnh không?

Có. Văn bản và hình ảnh được đưa vào và văn bản được trả ra. Điều đó bao gồm việc đọc ảnh chụp màn hình, biểu mẫu và biểu đồ để đặt câu hỏi hoặc trích xuất, nhưng bản thân mô hình không thể tự tạo hoặc chỉnh sửa hình ảnh.

Mốc kiến thức của GPT-5 mini là gì?

OpenAI liệt kê ngày 31 tháng 5 năm 2024 là mốc kiến thức cho mô hình này. Bất kỳ thông tin nào mới hơn đều phải đến từ câu lệnh, từ các tệp đính kèm hoặc từ lệnh gọi công cụ tìm kiếm web.

GPT-5 mini có nhỏ hơn GPT-5 nano không?

Không. Nano là mô hình nhỏ hơn và rẻ hơn trong hai loại và hướng tới việc tóm tắt và phân loại. Mini nằm giữa nano và GPT-5 đầy đủ về năng lực và chi phí.

GPT-5 mini có giá bao nhiêu?

Trên TokenLab, GPT-5 mini có giá Đầu vào $0.175 / Đầu ra $1.40 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của GPT-5 mini là bao nhiêu?

GPT-5 mini hỗ trợ tối đa 400.000 token ngữ cảnh và trả về tối đa 128.000 token mỗi phản hồi.

GPT-5 mini nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho GPT-5 mini. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

GPT-5 mini hỗ trợ những thao tác nào?

GPT-5 mini hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh GPT-5 mini

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ GPT 5

Mô hình liên quan