Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Moonshot: Kimi K3

Mô hình Kimi đa phương thức với ngữ cảnh 1 triệu token và khả năng tư duy nỗ lực tối đa có thể bật/tắt, dành cho các tác vụ đại lý (agent) dài hạn.
So sánh mô hình
kimi-k3
Sẵn sàngMoonshotTrò chuyện
Đầu vào / Đầu ra
$3.00 / $15.00
Ngữ cảnh
1M
Độ dài đầu ra tối đa
128K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm PromptSuy luận

Về Kimi K3

Kimi K3 là mô hình hàng đầu với trọng số mở của Moonshot AI, được phát hành vào tháng 7 năm 2026: một mô hình hỗn hợp chuyên gia (mixture-of-experts) với 2,8 nghìn tỷ tham số, hỗ trợ nhập liệu hình ảnh và video gốc cùng ngữ cảnh một triệu token. Tính năng suy luận luôn bật với mức độ nỗ lực thấp, cao hoặc tối đa. Nó sử dụng Kimi Delta Attention và kích hoạt 16 trong số 896 chuyên gia trên mỗi token. Moonshot xây dựng nó cho các tác nhân dài hạn, cơ sở mã lớn và công việc tri thức.

Ưu điểm

  • Nỗ lực suy luận có thể được đặt ở mức thấp, cao hoặc tối đa, vì vậy một mô hình có thể bao quát cả việc trả lời nhanh và giải quyết vấn đề chuyên sâu.
  • Ngữ cảnh một triệu token, nhắm đến các cơ sở mã lớn và lịch sử tác nhân dài.
  • Nhập liệu hình ảnh và video gốc, vì vậy biểu đồ, ảnh chụp màn hình và bản ghi có thể là một phần của tác vụ.
  • Hỗ trợ đầu ra JSON, gọi công cụ với tải động, tiếp nối tiền tố và tự động lưu trữ ngữ cảnh.

Khi nào nên chọn model khác

  • Tính năng suy luận luôn bật, vì vậy các lượt tương tác tầm thường sẽ tốn nhiều thời gian hơn so với một mô hình không có tính năng suy luận.
  • Một mô hình có kích thước này rất nặng để tự lưu trữ ngay cả khi trọng số là mở.
  • Văn bản là đầu ra duy nhất; hãy sử dụng một mô hình riêng biệt cho hình ảnh hoặc giọng nói.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnResponses API
    POST/v1/responses
    Định dạng API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "kimi-k3",
        "input": "Hello!"
      }'

Giá

Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.

Default

mỗi 1M token
Giá Official
Đầu vào $3.00 / Đầu ra $15.00 / Đọc bộ nhớ đệm $0.30 / Ghi bộ nhớ đệm $3.00 / Văn bản Đầu vào $3.00 / Văn bản Đầu ra $15.00
Giá Verified
—
Giảm giá
—
Giá cache của prompt

Đọc bộ nhớ đệm

Giá Official
$0.30
Giá Verified
—
Giảm giá
—

Ghi bộ nhớ đệm

Giá Official
$3.00
Giá Verified
—
Giảm giá
—

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Tỷ lệ thành công 30 ngày
98,4%
Lượt yêu cầu 30 ngày
100+
Hoạt động gần nhất
1 phút trước

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Kimi K3 trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử kimi-k3 với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Suy luận
  • Thị giác
  • Các tác nhân dài hạn

    Chạy các tác nhân nghiên cứu hoặc kỹ thuật thực hiện hàng trăm lệnh gọi công cụ và cần ghi nhớ các kết quả trước đó trong suốt một phiên làm việc rất dài.

  • Công việc trên cơ sở mã lớn

    Điều hướng và thay đổi một kho lưu trữ lớn bằng cách tải phần lớn nó vào ngữ cảnh thay vì chỉ dựa vào việc truy xuất.

  • Phân tích video và biểu đồ

    Đặt câu hỏi về một bản demo đã ghi lại hoặc một biểu đồ dày đặc và nhận các kết quả trích dẫn những gì có trên màn hình.

  • Tự động hóa công việc tri thức

    Soạn thảo báo cáo và phân tích từ các tập tài liệu lớn, sử dụng công cụ để lấy dữ liệu và kiểm tra các con số.

Ví dụ prompt

Xem xét hồ sơ 600 trang được đính kèm và liệt kê mọi giao dịch với các bên liên quan cùng số trang tương ứng.

Đọc kho lưu trữ này và giải thích cách một yêu cầu truyền từ bộ định tuyến đến cơ sở dữ liệu, nêu tên từng tệp.

Xem video demo sản phẩm này và viết báo cáo lỗi cho bước mà biểu mẫu bị đặt lại.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Kimi K3 là gì?

Mô hình hàng đầu với trọng số mở của Moonshot AI, với 2,8 nghìn tỷ tham số trong thiết kế hỗn hợp chuyên gia. Nó đọc văn bản, hình ảnh và video, có ngữ cảnh một triệu token và suy luận trước khi trả lời với mức độ nỗ lực có thể điều chỉnh.

Các mức độ nỗ lực suy luận là gì?

Thấp, cao và tối đa. Tính năng suy luận luôn bật và mức độ nỗ lực thiết lập mức độ cân nhắc của mô hình. Sử dụng mức thấp cho các yêu cầu thông thường và mức tối đa cho việc gỡ lỗi, lập kế hoạch hoặc phân tích khó.

Kimi K3 có phải là mã nguồn mở không?

Moonshot đã công bố trọng số sau khi ra mắt API, vì vậy bạn có thể tự lưu trữ nếu có phần cứng. Gọi nó thông qua API sẽ tránh được chi phí đó và cho phép bạn chuyển đổi mô hình mà không cần triển khai lại.

Nó có hỗ trợ đầu vào video không?

Có. Moonshot mô tả hỗ trợ gốc cho hình ảnh và video, phù hợp với bản ghi màn hình, bản demo và biểu đồ cùng với hướng dẫn bằng văn bản. Đầu ra vẫn là văn bản, vì vậy kết quả trả về dưới dạng câu trả lời viết.

Nó khác với Kimi K2.6 như thế nào?

K3 là mô hình mới hơn và lớn hơn nhiều, với cửa sổ ngữ cảnh một triệu token, các mức độ nỗ lực có thể cấu hình và khả năng mở rộng hiệu quả hơn theo ghi nhận của Moonshot. K2.6 có ngữ cảnh ngắn hơn và không có cài đặt nỗ lực.

Kimi K3 có giá bao nhiêu?

Trên TokenLab, Kimi K3 có giá Đầu vào $3.00 / Đầu ra $15.00 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Kimi K3 là bao nhiêu?

Kimi K3 hỗ trợ tối đa 1.048.576 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.

Kimi K3 nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho Kimi K3. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Kimi K3 hỗ trợ những thao tác nào?

Kimi K3 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Kimi K3

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ Kimi

Mô hình liên quan