Alibaba Cloud: qwen-flash-character

Giá, hiệu suất, khả năng và yêu cầu sẵn sàng sử dụng cho qwen-flash-character.
So sánh mô hình
qwen-flash-character
Sẵn sàngAlibaba CloudTrò chuyệnGiảm 80% cho đầu vào đã lưu
Đầu vào / Đầu ra
$0.0368 / $0.2206
Ngữ cảnh
8K
Độ dài đầu ra tối đa
4K
Phương thức
Trò chuyện
Khả năng
Bộ nhớ đệm Prompt

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    messagesGốc (Messages API)
    POST/v1/messages
    Định dạng API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "qwen-flash-character",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Default

Mỗi 1M Token
Giá niêm yết
Đầu vào $0.0368 / Đầu ra $0.2206 / Đọc bộ nhớ đệm $0.007353 / Văn bản Đầu vào $0.0368 / Văn bản Đầu ra $0.2206
Giá TokenLab
Đầu vào $0.0368 / Đầu ra $0.2206 / Đọc bộ nhớ đệm $0.007353 / Văn bản Đầu vào $0.0368 / Văn bản Đầu ra $0.2206
Giảm giá
-
Giá cache của prompt

Đọc bộ nhớ đệm

Giá niêm yết
$0.007353
Giá TokenLab
$0.007353
Giảm giá
-

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua

Chưa có dữ liệu

Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở qwen-flash-character trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử qwen-flash-character với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

01

Agent và công cụ

Xử lý suy luận, phân loại hỗ trợ, gọi công cụ và các tác vụ nhiều bước.

02

Lập trình

Viết, kiểm tra và sửa lỗi code ngay trong công cụ bạn đang dùng.

03

Trợ lý tri thức

Xây dựng tính năng chat, tìm kiếm và truy xuất với chi phí cùng khả năng minh bạch.

04

So sánh trực tiếp

So sánh chất lượng phản hồi, độ trễ và giá cả trực tiếp.

Ví dụ prompt

Viết một câu trả lời hỗ trợ ngắn gọn và liệt kê các giả định đằng sau.

Review thiết kế API này và chỉ ra ba rủi ro tích hợp lớn nhất.

Biến một changelog dài thành release notes mà người không phải dev cũng đọc được.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

qwen-flash-character có giá bao nhiêu?

Trên TokenLab, qwen-flash-character có giá Đầu vào $0.0368 / Đầu ra $0.2206 Mỗi 1M Token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

qwen-flash-character phù hợp nhất với việc gì?

qwen-flash-character hỗ trợ Bộ nhớ đệm Prompt. Bạn có thể mở trực tiếp trong Create.

Gọi API của qwen-flash-character thế nào?

Mở qwen-flash-character trong Create để thử ví dụ có sẵn cho /v1/messages.

qwen-flash-character nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho qwen-flash-character. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Tôi có thể test qwen-flash-character trước khi tích hợp không?

Có. Mở Console tạo bản nháp sẵn sàng cho qwen-flash-character, yêu cầu của bạn được lưu giữ.

qwen-flash-character hỗ trợ những thao tác nào?

qwen-flash-character hỗ trợ messages. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

Xem thêm từ Qwen

Mô hình liên quan