xAI: Grok 4.20 Multi-Agent
grok-4.20-multi-agent- Đầu vào / Đầu ra
- $1.25 / $2.50
- Ngữ cảnh
- 1M
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về Grok 4.20 Multi-Agent
Grok 4.20 Multi-Agent là biến thể của Grok 4.20 từ xAI, giúp giải quyết các câu hỏi khó bằng cách chạy song song nhiều tác nhân (agent). Mỗi tác nhân nghiên cứu một khía cạnh khác nhau, và một tác nhân lãnh đạo sẽ tổng hợp các kết quả thành một câu trả lời duy nhất kèm theo bằng chứng hỗ trợ. Mô hình này phù hợp với các câu hỏi mang tính nghiên cứu, nơi độ bao quát quan trọng hơn tốc độ, khác với các mô hình 4.20 suy luận đơn bước và không suy luận.
Ưu điểm
- Chia nhỏ câu hỏi cho nhiều tác nhân cùng khám phá các khía cạnh khác nhau cùng lúc, sau đó hợp nhất kết quả thành một câu trả lời duy nhất.
- Một tác nhân lãnh đạo sẽ viết câu trả lời cuối cùng, giúp bạn nhận được một phản hồi mạch lạc thay vì một tập hợp các kết quả rời rạc.
- xAI thiết lập khoảng bốn tác nhân cho nghiên cứu nhanh và mười sáu tác nhân cho phân tích chuyên sâu, tùy thuộc vào mức độ nỗ lực.
- Phù hợp với các câu hỏi cần thu thập nguồn và kiểm chứng chéo thay vì chỉ thực hiện một bước truy xuất đơn lẻ.
- Đọc được cả hình ảnh và văn bản khi câu hỏi bao gồm ảnh chụp màn hình hoặc số liệu.
Khi nào nên chọn model khác
- Việc chạy nhiều tác nhân sẽ tốn nhiều thời gian và token hơn so với một lượt xử lý; mô hình 4.20 thông thường sẽ tốt hơn cho các tra cứu đơn giản.
- Chỉ câu trả lời cuối cùng của tác nhân lãnh đạo được hiển thị, vì vậy bạn không thể kiểm tra kết luận của từng tác nhân phụ.
- Đây là biến thể hướng tới nghiên cứu; đối với tác nhân lập trình hoặc gọi công cụ thông thường, grok-4.7 là lựa chọn trực tiếp hơn.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-multi-agent", "input": "Hello!" }'
Giá
Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.
Thông số mặc định
mỗi 1M token- Giá niêm yết
- Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
- Official
- Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
- Giảm giá
- —
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.20
- Official
- $0.20
- Giảm giá
- —
| Giá niêm yếtmỗi 1M token | Officialmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20 | Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20 | — |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.20 | $0.20 | — |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Grok 4.20 Multi-Agent trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử grok-4.20-multi-agent với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
- Thị giác
Nghiên cứu thị trường và đối thủ cạnh tranh
Yêu cầu một bản tổng quan có nguồn về một danh mục sản phẩm, với mỗi tác nhân phụ trách các nhà cung cấp hoặc khía cạnh khác nhau, và nhận về một bản tóm tắt đã được tổng hợp.
Đánh giá tài liệu và chính sách
Đặt một câu hỏi bao quát nhiều tài liệu hoặc quy định và để các tác nhân song song thu thập các điểm liên quan trước khi tác nhân lãnh đạo hòa giải các điểm bất đồng.
Phân tích mở chuyên sâu
Đưa ra một câu hỏi không có phương pháp rõ ràng, chẳng hạn như lý do tại sao một chỉ số thay đổi, và nhận được một cái nhìn tổng hợp được xây dựng từ nhiều hướng phân tích.
Ví dụ prompt
So sánh các phương pháp chính để lập chỉ mục tìm kiếm vector cho một tập dữ liệu mười triệu tài liệu. Đề cập đến độ chính xác, mức sử dụng bộ nhớ và độ phức tạp vận hành, sau đó đưa ra đề xuất.
Các vấn đề pháp lý mở xung quanh việc huấn luyện mô hình trên hình ảnh có bản quyền là gì? Hãy nêu các quan điểm cạnh tranh và bằng chứng cho từng quan điểm.
Số lượng đăng ký của chúng tôi đã giảm 18 phần trăm vào tháng trước. Hãy đề xuất năm giải thích độc lập và cho biết dữ liệu nào sẽ xác nhận hoặc loại trừ từng trường hợp.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Phiên bản đa tác nhân của Grok 4.20 làm gì?
Nó khởi chạy nhiều tác nhân cùng làm việc trên một câu hỏi song song. Chúng thu thập và phân tích thông tin từ các khía cạnh khác nhau, sau đó một tác nhân lãnh đạo kết hợp các thảo luận thành một câu trả lời cuối cùng. Bạn gửi một câu lệnh (prompt) bình thường và nhận được một phản hồi duy nhất.
Grok-4.20-multi-agent sử dụng bao nhiêu tác nhân?
xAI mô tả hai thiết lập: bốn tác nhân cho nghiên cứu nhanh, tập trung và mười sáu tác nhân cho phân tích sâu, phức tạp. Số lượng tác nhân tuân theo mức độ nỗ lực suy luận mà bạn yêu cầu, với nỗ lực thấp tương ứng với nhóm nhỏ hơn và nỗ lực cao tương ứng với nhóm lớn hơn.
Grok-4.20-multi-agent có chậm hơn grok-4.20 không?
Nhìn chung là có. Nhiều tác nhân khám phá câu hỏi trước khi tác nhân lãnh đạo viết câu trả lời, vì vậy độ trễ và mức sử dụng token tăng theo số lượng tác nhân. Đối với các câu hỏi ngắn hoặc trò chuyện, các mô hình 4.20 tiêu chuẩn hoặc không suy luận sẽ phản hồi nhanh hơn.
Tôi có thể xem kết luận của từng tác nhân không?
Không. xAI chỉ hiển thị đầu ra của tác nhân lãnh đạo, và trạng thái làm việc của các tác nhân phụ không được trả về. Hãy yêu cầu mô hình trích dẫn bằng chứng trong câu trả lời cuối cùng nếu bạn cần xác minh cách đạt được kết luận.
Nó có chấp nhận hình ảnh không?
Có. Giống như các mô hình 4.20 khác, nó chấp nhận hình ảnh cùng với văn bản, vì vậy một câu hỏi nghiên cứu có thể bao gồm biểu đồ hoặc ảnh chụp màn hình. Phản hồi trả về dưới dạng văn bản.
Grok 4.20 Multi-Agent có giá bao nhiêu?
Trên TokenLab, Grok 4.20 Multi-Agent có giá Đầu vào $1.25 / Đầu ra $2.50 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Grok 4.20 Multi-Agent là bao nhiêu?
Grok 4.20 Multi-Agent hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.
Grok 4.20 Multi-Agent nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho Grok 4.20 Multi-Agent. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Grok 4.20 Multi-Agent hỗ trợ những thao tác nào?
Grok 4.20 Multi-Agent hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Grok 4.20 Multi-Agent
Nguồn
Đánh giá ngày 2 thg 10, 2026