Zhipu AI: glm-5.3-flash
glm-5.3-flash- Đầu vào / Đầu ra
- $0.15 / $0.50
- Ngữ cảnh
- 1M
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm Prompt
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
messagesGốc (Messages API)POST/v1/messagesĐịnh dạng API:curl https://api.tokenlab.sh/v1/messages \ -H "Content-Type: application/json" \ -H "x-api-key: sk-xxx" \ -H "anthropic-version: 2023-06-01" \ -d '{ "model": "glm-5.3-flash", "max_tokens": 1024, "messages": [ {"role": "user", "content": "Hello!"} ] }'
Giá
Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.
List Price
Mỗi 1M Token- Giá niêm yết
- Đầu vào $0.15 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.03
- Giá TokenLab
- Đầu vào $0.15 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.03
- Giảm giá
- -
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.03
- Giá TokenLab
- $0.03
- Giảm giá
- -
| Giá niêm yếtMỗi 1M Token | Giá TokenLabMỗi 1M Token | Giảm giá | |
|---|---|---|---|
| List Price | Đầu vào $0.15 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.03 | Đầu vào $0.15 / Đầu ra $0.50 / Đọc bộ nhớ đệm $0.03 | - |
| Đọc bộ nhớ đệm | $0.03 | $0.03 | - |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ quaChưa có dữ liệu
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở glm-5.3-flash trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử glm-5.3-flash với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp choThị giác
Đọc ảnh, parse tài liệu và trả lời câu hỏi trực quan
Agent và công cụ
Xử lý suy luận, phân loại hỗ trợ, gọi công cụ và các tác vụ nhiều bước.
Lập trình
Viết, kiểm tra và sửa lỗi code ngay trong công cụ bạn đang dùng.
Trợ lý tri thức
Xây dựng tính năng chat, tìm kiếm và truy xuất với chi phí cùng khả năng minh bạch.
So sánh trực tiếp
So sánh chất lượng phản hồi, độ trễ và giá cả trực tiếp.
Ví dụ prompt
Viết một câu trả lời hỗ trợ ngắn gọn và liệt kê các giả định đằng sau.
Review thiết kế API này và chỉ ra ba rủi ro tích hợp lớn nhất.
Biến một changelog dài thành release notes mà người không phải dev cũng đọc được.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
glm-5.3-flash có giá bao nhiêu?
Trên TokenLab, glm-5.3-flash có giá Đầu vào $0.15 / Đầu ra $0.50 Mỗi 1M Token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
glm-5.3-flash phù hợp nhất với việc gì?
glm-5.3-flash hỗ trợ Chế độ JSON, Bộ nhớ đệm Prompt, Sử dụng công cụ. Bạn có thể mở trực tiếp trong Create.
Gọi API của glm-5.3-flash thế nào?
Mở glm-5.3-flash trong Create để thử ví dụ có sẵn cho /v1/messages.
glm-5.3-flash nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho glm-5.3-flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Tôi có thể test glm-5.3-flash trước khi tích hợp không?
Có. Mở Console tạo bản nháp sẵn sàng cho glm-5.3-flash, yêu cầu của bạn được lưu giữ.
glm-5.3-flash hỗ trợ những thao tác nào?
glm-5.3-flash hỗ trợ messages. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.