Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

xAI: Grok 4.20 Multi-Agent

Grok 4.20 Multi-Agent là biến thể suy luận cộng tác của Grok 4.20. Nó dành cho các câu hỏi đòi hỏi khắt khe, được hưởng lợi từ việc khám phá nhiều hướng phân tích trước khi một phản hồi được tổng hợp.
So sánh mô hình
grok-4.20-multi-agent
Sẵn sàngxAITrò chuyện
Đầu vào / Đầu ra
$1.25 / $2.50
Ngữ cảnh
1M
Độ dài đầu ra tối đa
128K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm PromptSuy luận

Về Grok 4.20 Multi-Agent

Grok 4.20 Multi-Agent là biến thể của Grok 4.20 từ xAI, giúp giải quyết các câu hỏi khó bằng cách chạy song song nhiều tác nhân (agent). Mỗi tác nhân nghiên cứu một khía cạnh khác nhau, và một tác nhân lãnh đạo sẽ tổng hợp các kết quả thành một câu trả lời duy nhất kèm theo bằng chứng hỗ trợ. Mô hình này phù hợp với các câu hỏi mang tính nghiên cứu, nơi độ bao quát quan trọng hơn tốc độ, khác với các mô hình 4.20 suy luận đơn bước và không suy luận.

Ưu điểm

  • Chia nhỏ câu hỏi cho nhiều tác nhân cùng khám phá các khía cạnh khác nhau cùng lúc, sau đó hợp nhất kết quả thành một câu trả lời duy nhất.
  • Một tác nhân lãnh đạo sẽ viết câu trả lời cuối cùng, giúp bạn nhận được một phản hồi mạch lạc thay vì một tập hợp các kết quả rời rạc.
  • xAI thiết lập khoảng bốn tác nhân cho nghiên cứu nhanh và mười sáu tác nhân cho phân tích chuyên sâu, tùy thuộc vào mức độ nỗ lực.
  • Phù hợp với các câu hỏi cần thu thập nguồn và kiểm chứng chéo thay vì chỉ thực hiện một bước truy xuất đơn lẻ.
  • Đọc được cả hình ảnh và văn bản khi câu hỏi bao gồm ảnh chụp màn hình hoặc số liệu.

Khi nào nên chọn model khác

  • Việc chạy nhiều tác nhân sẽ tốn nhiều thời gian và token hơn so với một lượt xử lý; mô hình 4.20 thông thường sẽ tốt hơn cho các tra cứu đơn giản.
  • Chỉ câu trả lời cuối cùng của tác nhân lãnh đạo được hiển thị, vì vậy bạn không thể kiểm tra kết luận của từng tác nhân phụ.
  • Đây là biến thể hướng tới nghiên cứu; đối với tác nhân lập trình hoặc gọi công cụ thông thường, grok-4.7 là lựa chọn trực tiếp hơn.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnResponses API
    POST/v1/responses
    Định dạng API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-multi-agent",
        "input": "Hello!"
      }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Thông số mặc định

mỗi 1M token
Giá niêm yết
Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
Official
Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
Giảm giá
—
Giá cache của prompt

Đọc bộ nhớ đệm

Giá niêm yết
$0.20
Official
$0.20
Giảm giá
—

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Grok 4.20 Multi-Agent trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử grok-4.20-multi-agent với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Suy luận
  • Thị giác
  • Nghiên cứu thị trường và đối thủ cạnh tranh

    Yêu cầu một bản tổng quan có nguồn về một danh mục sản phẩm, với mỗi tác nhân phụ trách các nhà cung cấp hoặc khía cạnh khác nhau, và nhận về một bản tóm tắt đã được tổng hợp.

  • Đánh giá tài liệu và chính sách

    Đặt một câu hỏi bao quát nhiều tài liệu hoặc quy định và để các tác nhân song song thu thập các điểm liên quan trước khi tác nhân lãnh đạo hòa giải các điểm bất đồng.

  • Phân tích mở chuyên sâu

    Đưa ra một câu hỏi không có phương pháp rõ ràng, chẳng hạn như lý do tại sao một chỉ số thay đổi, và nhận được một cái nhìn tổng hợp được xây dựng từ nhiều hướng phân tích.

Ví dụ prompt

So sánh các phương pháp chính để lập chỉ mục tìm kiếm vector cho một tập dữ liệu mười triệu tài liệu. Đề cập đến độ chính xác, mức sử dụng bộ nhớ và độ phức tạp vận hành, sau đó đưa ra đề xuất.

Các vấn đề pháp lý mở xung quanh việc huấn luyện mô hình trên hình ảnh có bản quyền là gì? Hãy nêu các quan điểm cạnh tranh và bằng chứng cho từng quan điểm.

Số lượng đăng ký của chúng tôi đã giảm 18 phần trăm vào tháng trước. Hãy đề xuất năm giải thích độc lập và cho biết dữ liệu nào sẽ xác nhận hoặc loại trừ từng trường hợp.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Phiên bản đa tác nhân của Grok 4.20 làm gì?

Nó khởi chạy nhiều tác nhân cùng làm việc trên một câu hỏi song song. Chúng thu thập và phân tích thông tin từ các khía cạnh khác nhau, sau đó một tác nhân lãnh đạo kết hợp các thảo luận thành một câu trả lời cuối cùng. Bạn gửi một câu lệnh (prompt) bình thường và nhận được một phản hồi duy nhất.

Grok-4.20-multi-agent sử dụng bao nhiêu tác nhân?

xAI mô tả hai thiết lập: bốn tác nhân cho nghiên cứu nhanh, tập trung và mười sáu tác nhân cho phân tích sâu, phức tạp. Số lượng tác nhân tuân theo mức độ nỗ lực suy luận mà bạn yêu cầu, với nỗ lực thấp tương ứng với nhóm nhỏ hơn và nỗ lực cao tương ứng với nhóm lớn hơn.

Grok-4.20-multi-agent có chậm hơn grok-4.20 không?

Nhìn chung là có. Nhiều tác nhân khám phá câu hỏi trước khi tác nhân lãnh đạo viết câu trả lời, vì vậy độ trễ và mức sử dụng token tăng theo số lượng tác nhân. Đối với các câu hỏi ngắn hoặc trò chuyện, các mô hình 4.20 tiêu chuẩn hoặc không suy luận sẽ phản hồi nhanh hơn.

Tôi có thể xem kết luận của từng tác nhân không?

Không. xAI chỉ hiển thị đầu ra của tác nhân lãnh đạo, và trạng thái làm việc của các tác nhân phụ không được trả về. Hãy yêu cầu mô hình trích dẫn bằng chứng trong câu trả lời cuối cùng nếu bạn cần xác minh cách đạt được kết luận.

Nó có chấp nhận hình ảnh không?

Có. Giống như các mô hình 4.20 khác, nó chấp nhận hình ảnh cùng với văn bản, vì vậy một câu hỏi nghiên cứu có thể bao gồm biểu đồ hoặc ảnh chụp màn hình. Phản hồi trả về dưới dạng văn bản.

Grok 4.20 Multi-Agent có giá bao nhiêu?

Trên TokenLab, Grok 4.20 Multi-Agent có giá Đầu vào $1.25 / Đầu ra $2.50 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Grok 4.20 Multi-Agent là bao nhiêu?

Grok 4.20 Multi-Agent hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.

Grok 4.20 Multi-Agent nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho Grok 4.20 Multi-Agent. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Grok 4.20 Multi-Agent hỗ trợ những thao tác nào?

Grok 4.20 Multi-Agent hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Grok 4.20 Multi-Agent

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ Grok 4

Mô hình liên quan