xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- Đầu vào / Đầu ra-50%
- $1.25 / $2.50$0.625 / $1.25
- Ngữ cảnh
- 1M
- Độ dài đầu ra tối đa
- 128K
- Phương thức
- Thị giácTrò chuyện
- Khả năng
- Sử dụng công cụBộ nhớ đệm Prompt
Về Grok 4.20 Non-Reasoning
Grok 4.20 Non-Reasoning là phiên bản trả lời trực tiếp của mô hình 4.20 từ xAI. Nó bỏ qua giai đoạn suy nghĩ mở rộng, vì vậy nó phản hồi nhanh chóng với các câu lệnh văn bản và hình ảnh, phù hợp cho việc soạn thảo, trích xuất và trò chuyện có hỗ trợ công cụ. xAI mô tả nó là sự kết hợp giữa việc tuân thủ nghiêm ngặt câu lệnh và tỷ lệ ảo tưởng thấp. Hãy chọn các biến thể suy luận hoặc đa tác nhân khi vấn đề cần phân tích kỹ lưỡng.
Ưu điểm
- Phản hồi mà không cần giai đoạn suy nghĩ riêng biệt, giúp giữ độ trễ thấp cho trò chuyện tương tác và các công việc khối lượng lớn.
- xAI nhấn mạnh việc tuân thủ nghiêm ngặt câu lệnh và tỷ lệ ảo tưởng thấp cho mô hình này, hữu ích khi đầu ra phải tuân theo một khuôn mẫu nhất định.
- Hỗ trợ gọi hàm (function calling) và đầu ra JSON có cấu trúc cho các quy trình trích xuất và trợ lý điều khiển bằng công cụ.
- Chấp nhận hình ảnh cùng với văn bản, vì vậy nó có thể đọc biên lai hoặc ảnh chụp màn hình và trả lời trong một bước.
- Bộ nhớ đệm câu lệnh (prompt caching) giúp ích khi nhiều yêu cầu sử dụng lại cùng một hướng dẫn dài hoặc văn bản tham chiếu.
Khi nào nên chọn model khác
- Vì không có bước suy luận, nó yếu hơn về logic đa giai đoạn hoặc toán học so với grok-4.20 hoặc grok-4.7.
- Nó không chia nhỏ công việc giữa các tác nhân; nghiên cứu mở sẽ được thực hiện tốt hơn bởi biến thể đa tác nhân.
- Đầu ra chỉ là văn bản, không tạo hình ảnh, âm thanh hoặc video.
Bắt đầu
Tạo API key
Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.
Gửi yêu cầu đầu tiên của bạn
Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.
Văn bản sang văn bảnResponses APIPOST/v1/responsesĐịnh dạng API:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
Giá
Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.
Thông số mặc định
mỗi 1M token- Giá niêm yết
- Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
- Giá TokenLab
- Đầu vào $0.625 / Đầu ra $1.25 / Đọc bộ nhớ đệm $0.10
- Giảm giá
- -50%
Đọc bộ nhớ đệm
- Giá niêm yết
- $0.20
- Giá TokenLab
- $0.10
- Giảm giá
- -50%
| Giá niêm yếtmỗi 1M token | Giá TokenLabmỗi 1M token | Giảm giá | |
|---|---|---|---|
| Thông số mặc định | Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20 | Đầu vào $0.625 / Đầu ra $1.25 / Đọc bộ nhớ đệm $0.10 | -50% |
| Giá cache của prompt | |||
| Đọc bộ nhớ đệm | $0.20 | $0.10 | -50% |
Sử dụng & hoạt động
Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.
Mức sử dụng & tình trạng
24 giờ qua- Yêu cầu
- Tỷ lệ thành công
- Độ trễ P95
- Tổng token
Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.
Mở trong Console
Mở Grok 4.20 Non-Reasoning trong Console để chỉnh sửa và gửi prompt ngay.
Giúp tôi thử grok-4.20-non-reasoning với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.
Tình huống sử dụng
Phù hợp cho- Thị giác
Trò chuyện với khách hàng
Trả lời các câu hỏi về sản phẩm và tài khoản với giọng điệu nhất quán, gọi các hàm tra cứu khi cần mà không bắt khách hàng phải chờ đợi giai đoạn suy nghĩ dài.
Trích xuất tài liệu hàng loạt
Xử lý hàng ngàn hợp đồng, biểu mẫu hoặc email thông qua một lược đồ JSON cố định, dựa vào việc tuân thủ hướng dẫn nghiêm ngặt để giữ cho các trường dữ liệu nhất quán.
Soạn thảo và viết lại
Tạo bản nháp đầu tiên cho email, bản tóm tắt và ghi chú phát hành theo định dạng yêu cầu, sau đó tinh chỉnh chúng bằng các hướng dẫn tiếp theo ngắn gọn.
Ví dụ prompt
Tóm tắt chuỗi hỗ trợ này thành ba gạch đầu dòng và một câu trả lời gợi ý. Giữ câu trả lời dưới 80 từ và không hứa hẹn hoàn tiền.
Trích xuất tên các bên, ngày hiệu lực và thời hạn thông báo chấm dứt từ hợp đồng này vào lược đồ JSON bên dưới. Trả về null cho bất kỳ thông tin nào bị thiếu.
Viết lại nhật ký thay đổi (changelog) này cho khách hàng không chuyên về kỹ thuật. Giữ các tiêu đề, bỏ số phiếu hỗ trợ nội bộ và sử dụng các câu văn đơn giản.
Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.
FAQ
Grok 4.20 Non-Reasoning là gì?
Đây là phiên bản Grok 4.20 của xAI trả lời trực tiếp thay vì suy nghĩ trước. Nó đọc văn bản và hình ảnh, viết văn bản, và hỗ trợ gọi hàm cũng như đầu ra có cấu trúc. Nó nhắm đến các công việc nhanh, nặng về hướng dẫn như trích xuất, soạn thảo và trò chuyện có hỗ trợ công cụ.
Khi nào tôi nên sử dụng non-reasoning thay vì grok-4.20?
Sử dụng nó khi nhiệm vụ rõ ràng và câu trả lời chủ yếu là truy xuất, viết lại hoặc định dạng. Nó phản hồi sớm hơn ID suy luận. Hãy chuyển sang grok-4.20 khi câu trả lời cần nhiều bước phân tích, chẳng hạn như gỡ lỗi hoặc lập kế hoạch.
Grok 4.20 Non-Reasoning có tuân theo lược đồ JSON không?
Có. Nó hỗ trợ đầu ra có cấu trúc, vì vậy bạn có thể cung cấp một lược đồ và nhận được phản hồi phù hợp với nó. Kết hợp với sự nhấn mạnh của xAI về việc tuân thủ nghiêm ngặt câu lệnh, điều này làm cho nó trở thành lựa chọn mặc định hợp lý cho các công việc trích xuất và phân loại.
Nó có thể chấp nhận đầu vào hình ảnh không?
Có, hình ảnh có thể được gửi cùng với văn bản, ví dụ như một biểu mẫu được chụp ảnh hoặc ảnh chụp màn hình giao diện người dùng. Phản hồi là văn bản. Mô hình không thể tạo hoặc chỉnh sửa hình ảnh.
Nó có hoạt động với ứng dụng khách kiểu OpenAI hiện có không?
Có. Mã ứng dụng khách kiểu OpenAI hiện có hoạt động bằng cách chỉ thay đổi tên mô hình, với các định nghĩa công cụ và lược đồ JSON được gửi trong các trường thông thường như trước đây.
Grok 4.20 Non-Reasoning có giá bao nhiêu?
Trên TokenLab, Grok 4.20 Non-Reasoning có giá Đầu vào $0.625 / Đầu ra $1.25 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.
Giới hạn ngữ cảnh và đầu ra của Grok 4.20 Non-Reasoning là bao nhiêu?
Grok 4.20 Non-Reasoning hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.
Grok 4.20 Non-Reasoning nên dùng endpoint nào?
Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho Grok 4.20 Non-Reasoning. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.
Grok 4.20 Non-Reasoning hỗ trợ những thao tác nào?
Grok 4.20 Non-Reasoning hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.
So sánh Grok 4.20 Non-Reasoning
Nguồn
Đánh giá ngày 2 thg 10, 2026