xAI: Grok 4.20
grok-4.20- Đầu vào / Đầu ra-50%
- $1.25 / $2.50$0.625 / $1.25
- Ngữ cảnh
- 1M
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm PromptSuy luận
Về Grok 4.20
Grok 4.20 là mô hình có khả năng suy luận của xAI thuộc dòng 4.20, được xây dựng cho các quy trình gọi công cụ (tool-calling) với đầu vào rất dài. Mô hình đọc văn bản và hình ảnh, viết văn bản, và suy nghĩ trước khi trả lời, điều này giúp phân biệt nó với các phiên bản không suy luận và đa tác nhân cùng tên dòng. Hãy chọn mô hình này khi câu trả lời phụ thuộc vào việc kết nối nhiều tài liệu, ảnh chụp màn hình và kết quả trung gian từ công cụ.
Ưu điểm
- Suy luận qua vấn đề trước khi trả lời, giúp các câu hỏi nhiều bước nhận được câu trả lời đã qua xử lý thay vì chỉ là dự đoán ban đầu.
- Chấp nhận hình ảnh cùng với văn bản, cho phép một cuộc hội thoại kết hợp ảnh chụp màn hình, biểu đồ và tài liệu viết.
- Gọi các công cụ và trả về JSON có cấu trúc, vì vậy nó có thể nằm trong vòng lặp tác nhân hoặc quy trình trích xuất.
- Xử lý lịch sử hội thoại rất dài, hữu ích cho các cuộc điều tra tích lũy bằng chứng qua nhiều lượt.
- Bộ nhớ đệm prompt (prompt caching) giúp giảm chi phí gửi lại tiền tố chung lớn giữa các yêu cầu.
Khi nào nên chọn model khác
- Bước suy nghĩ làm tăng độ trễ; biến thể 4.20 không suy luận trả lời nhanh hơn khi tác vụ là soạn thảo hoặc trích xuất đơn thuần.
- Các bản phát hành Grok mới hơn như 4.7 nhắm mục tiêu trực tiếp hơn vào công việc lập trình và tác nhân, và có thể hoạt động tốt hơn trong các tác vụ phần mềm khó.
- Đầu ra chỉ là văn bản, vì vậy nó không thể tạo hình ảnh, âm thanh hoặc video.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20", "input": "Hello!" }'
Giá
Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.
Đầu vào token <= 200K
mỗi 1M token- Giá niêm yết
- Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
- Giá TokenLab
- Đầu vào $0.625 / Đầu ra $1.25 / Đọc bộ nhớ đệm $0.10
- Giảm giá
- -50%
Đầu vào token > 200K
mỗi 1M token- Giá niêm yết
- Đầu vào $2.50 / Đầu ra $5.00 / Đọc bộ nhớ đệm $0.40
- Giá TokenLab
- Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
- Giảm giá
- -50%
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.20
- Giá TokenLab
- $0.10
- Giảm giá
- -50%
| Giá niêm yếtmỗi 1M token | Giá TokenLabmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Đầu vào token <= 200K | Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20 | Đầu vào $0.625 / Đầu ra $1.25 / Đọc bộ nhớ đệm $0.10 | -50% |
| Đầu vào token > 200K | Đầu vào $2.50 / Đầu ra $5.00 / Đọc bộ nhớ đệm $0.40 | Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20 | -50% |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.20 | $0.10 | -50% |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Grok 4.20 trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử grok-4.20 với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Suy luận
- Thị giác
Điều tra dựa trên bằng chứng
Cung cấp cho nó các báo cáo, tệp xuất và ảnh chụp màn hình thu thập được trong quá trình xảy ra sự cố hoặc kiểm toán, và yêu cầu một dòng thời gian đã được suy luận cùng với các câu hỏi còn bỏ ngỏ.
Vòng lặp tác nhân với công cụ
Cung cấp cho nó các chức năng tìm kiếm, cơ sở dữ liệu hoặc quản lý vé và để nó quyết định chức năng nào cần gọi, đọc kết quả và tiếp tục cho đến khi câu hỏi được giải đáp.
Trích xuất có cấu trúc từ đầu vào lộn xộn
Chuyển đổi các biểu mẫu, hóa đơn hoặc nhật ký trò chuyện đã quét thành lược đồ JSON cố định, với bước suy luận hỗ trợ cho các mục nhập mơ hồ.
Ví dụ prompt
Ba tệp xuất nhật ký và một ảnh chụp màn hình của bảng điều khiển được đính kèm. Hãy xây dựng dòng thời gian của sự cố và đánh dấu bất kỳ điều gì mà nhật ký mâu thuẫn.
Trích xuất nhà cung cấp, ngày tháng, các mục hàng và thuế từ hình ảnh hóa đơn này dưới dạng JSON khớp với lược đồ bên dưới. Đánh dấu bất kỳ trường nào bạn không chắc chắn.
Bạn có thể gọi search_orders và get_customer. Một khách hàng nói rằng hai mặt hàng bị thiếu trong đơn hàng 8812. Hãy tìm cách kiểm tra và thứ tự thực hiện.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Grok 4.20 là gì?
Grok 4.20 là mô hình trò chuyện từ xAI chấp nhận văn bản và hình ảnh, trả lời bằng văn bản. Đây là phiên bản suy luận của dòng này: nó xử lý vấn đề trước khi trả lời. xAI cung cấp cùng một thế hệ mô hình dưới dạng không suy luận và đa tác nhân.
Grok-4.20 khác với grok-4.20-non-reasoning như thế nào?
ID cơ sở dành thời gian suy luận trước khi trả lời, trong khi ID không suy luận trả lời trực tiếp. Sử dụng ID cơ sở cho các câu hỏi cần phân tích nhiều bước, và ID không suy luận cho việc soạn thảo, trích xuất và trò chuyện nơi tốc độ quan trọng hơn chiều sâu.
Grok 4.20 có thể đọc hình ảnh không?
Có. Bạn có thể gửi hình ảnh cùng với văn bản của mình, ví dụ như ảnh chụp màn hình, biểu đồ hoặc tài liệu được chụp ảnh, và đặt câu hỏi về chúng trong cùng một cuộc hội thoại. Các câu trả lời là văn bản; mô hình không tạo hoặc chỉnh sửa hình ảnh.
Grok 4.20 có hỗ trợ gọi công cụ và đầu ra JSON không?
Có. Nó hỗ trợ gọi hàm và phản hồi JSON có cấu trúc, vì vậy bạn có thể kết nối nó với các hàm của riêng mình hoặc ép buộc câu trả lời vào một lược đồ. Điều đó làm cho nó có thể sử dụng cho các công việc trích xuất và cho các tác nhân hoạt động trên các hệ thống bên ngoài.
Tôi có thể sử dụng ứng dụng khách kiểu OpenAI hiện có của mình với Grok 4.20 không?
Có. Mã ứng dụng khách kiểu OpenAI hiện có hoạt động bằng cách thay đổi tên mô hình, và các định nghĩa công cụ cũng như lược đồ JSON sử dụng cùng các trường mà bạn đã gửi hiện nay.
Grok 4.20 có giá bao nhiêu?
Trên TokenLab, Grok 4.20 có giá Đầu vào $0.625 / Đầu ra $1.25 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Grok 4.20 là bao nhiêu?
Grok 4.20 hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.
Grok 4.20 nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho Grok 4.20. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Grok 4.20 hỗ trợ những thao tác nào?
Grok 4.20 hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Grok 4.20
Nguồn
Đánh giá ngày 2 thg 10, 2026