Alibaba Cloud: qwen3-omni-flash

Giá, hiệu suất, khả năng và yêu cầu sẵn sàng sử dụng cho qwen3-omni-flash.
So sánh mô hình
qwen3-omni-flash
Sẵn sàngAlibaba CloudTrò chuyện
Đầu vào / Đầu ra
$0.2647 / $1.01
Ngữ cảnh
49K
Độ dài đầu ra tối đa
16K
Phương thức
Thị giácTrò chuyện

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    messagesGốc (Messages API)
    POST/v1/messages
    Định dạng API:
    curl https://api.tokenlab.sh/v1/messages \
      -H "Content-Type: application/json" \
      -H "x-api-key: sk-xxx" \
      -H "anthropic-version: 2023-06-01" \
      -d '{
        "model": "qwen3-omni-flash",
        "max_tokens": 1024,
        "messages": [
          {"role": "user", "content": "Hello!"}
        ]
      }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Default

Mỗi 1M Token
Giá niêm yết
Đầu vào $0.2647 / Đầu ra $1.01 / Văn bản Đầu vào $0.2647 / Hình ảnh Đầu vào $0.4853 / Văn bản Đầu ra $1.01
Giá TokenLab
Đầu vào $0.2647 / Đầu ra $1.01 / Văn bản Đầu vào $0.2647 / Hình ảnh Đầu vào $0.4853 / Văn bản Đầu ra $1.01
Giảm giá
-

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua

Chưa có dữ liệu

Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở qwen3-omni-flash trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử qwen3-omni-flash với tin nhắn ngắn tại /v1/messages. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho

Thị giác

Đọc ảnh, parse tài liệu và trả lời câu hỏi trực quan

01

Agent và công cụ

Xử lý suy luận, phân loại hỗ trợ, gọi công cụ và các tác vụ nhiều bước.

02

Lập trình

Viết, kiểm tra và sửa lỗi code ngay trong công cụ bạn đang dùng.

03

Trợ lý tri thức

Xây dựng tính năng chat, tìm kiếm và truy xuất với chi phí cùng khả năng minh bạch.

04

So sánh trực tiếp

So sánh chất lượng phản hồi, độ trễ và giá cả trực tiếp.

Ví dụ prompt

Viết một câu trả lời hỗ trợ ngắn gọn và liệt kê các giả định đằng sau.

Review thiết kế API này và chỉ ra ba rủi ro tích hợp lớn nhất.

Biến một changelog dài thành release notes mà người không phải dev cũng đọc được.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

qwen3-omni-flash có giá bao nhiêu?

Trên TokenLab, qwen3-omni-flash có giá Đầu vào $0.2647 / Đầu ra $1.01 Mỗi 1M Token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

qwen3-omni-flash phù hợp nhất với việc gì?

qwen3-omni-flash hỗ trợ Thị giác. Bạn có thể mở trực tiếp trong Create.

Gọi API của qwen3-omni-flash thế nào?

Mở qwen3-omni-flash trong Create để thử ví dụ có sẵn cho /v1/messages.

qwen3-omni-flash nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/messages làm mặc định cho qwen3-omni-flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Tôi có thể test qwen3-omni-flash trước khi tích hợp không?

Có. Mở Console tạo bản nháp sẵn sàng cho qwen3-omni-flash, yêu cầu của bạn được lưu giữ.

qwen3-omni-flash hỗ trợ những thao tác nào?

qwen3-omni-flash hỗ trợ messages. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

Xem thêm từ Qwen Omni

Mô hình liên quan