Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

xAI: Grok 4.20 Non-Reasoning

Grok 4.20 Non-Reasoning cung cấp biến thể phản hồi trực tiếp của dòng 4.20. Nó hữu ích cho việc trích xuất, soạn thảo và hội thoại có hỗ trợ công cụ, nơi một giai đoạn suy luận mở rộng riêng biệt không phải là trọng tâm.
So sánh mô hình
grok-4.20-non-reasoning
Sẵn sàngxAITrò chuyệnGiảm 84% cho đầu vào đã lưu
Đầu vào / Đầu ra-50%
$1.25 / $2.50$0.625 / $1.25
Ngữ cảnh
1M
Độ dài đầu ra tối đa
128K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm Prompt

Về Grok 4.20 Non-Reasoning

Grok 4.20 Non-Reasoning là phiên bản trả lời trực tiếp của mô hình 4.20 từ xAI. Nó bỏ qua giai đoạn suy nghĩ mở rộng, vì vậy nó phản hồi nhanh chóng với các câu lệnh văn bản và hình ảnh, phù hợp cho việc soạn thảo, trích xuất và trò chuyện có hỗ trợ công cụ. xAI mô tả nó là sự kết hợp giữa việc tuân thủ nghiêm ngặt câu lệnh và tỷ lệ ảo tưởng thấp. Hãy chọn các biến thể suy luận hoặc đa tác nhân khi vấn đề cần phân tích kỹ lưỡng.

Ưu điểm

  • Phản hồi mà không cần giai đoạn suy nghĩ riêng biệt, giúp giữ độ trễ thấp cho trò chuyện tương tác và các công việc khối lượng lớn.
  • xAI nhấn mạnh việc tuân thủ nghiêm ngặt câu lệnh và tỷ lệ ảo tưởng thấp cho mô hình này, hữu ích khi đầu ra phải tuân theo một khuôn mẫu nhất định.
  • Hỗ trợ gọi hàm (function calling) và đầu ra JSON có cấu trúc cho các quy trình trích xuất và trợ lý điều khiển bằng công cụ.
  • Chấp nhận hình ảnh cùng với văn bản, vì vậy nó có thể đọc biên lai hoặc ảnh chụp màn hình và trả lời trong một bước.
  • Bộ nhớ đệm câu lệnh (prompt caching) giúp ích khi nhiều yêu cầu sử dụng lại cùng một hướng dẫn dài hoặc văn bản tham chiếu.

Khi nào nên chọn model khác

  • Vì không có bước suy luận, nó yếu hơn về logic đa giai đoạn hoặc toán học so với grok-4.20 hoặc grok-4.7.
  • Nó không chia nhỏ công việc giữa các tác nhân; nghiên cứu mở sẽ được thực hiện tốt hơn bởi biến thể đa tác nhân.
  • Đầu ra chỉ là văn bản, không tạo hình ảnh, âm thanh hoặc video.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnResponses API
    POST/v1/responses
    Định dạng API:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "grok-4.20-non-reasoning",
        "input": "Hello!"
      }'

Giá

Giá Official là mức giá công khai của nhà phát triển. Giá TokenLab là số tiền bạn trả cho mô hình này trên TokenLab.

Thông số mặc định

mỗi 1M token
Giá niêm yết
Đầu vào $1.25 / Đầu ra $2.50 / Đọc bộ nhớ đệm $0.20
Giá TokenLab
Đầu vào $0.625 / Đầu ra $1.25 / Đọc bộ nhớ đệm $0.10
Giảm giá
-50%
Giá cache của prompt

Đọc bộ nhớ đệm

Giá niêm yết
$0.20
Giá TokenLab
$0.10
Giảm giá
-50%

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Các chỉ số sẽ xuất hiện sau khi đạt ngưỡng về quyền riêng tư và khối lượng dữ liệu.

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Grok 4.20 Non-Reasoning trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử grok-4.20-non-reasoning với tin nhắn ngắn tại /v1/responses. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Thị giác
  • Trò chuyện với khách hàng

    Trả lời các câu hỏi về sản phẩm và tài khoản với giọng điệu nhất quán, gọi các hàm tra cứu khi cần mà không bắt khách hàng phải chờ đợi giai đoạn suy nghĩ dài.

  • Trích xuất tài liệu hàng loạt

    Xử lý hàng ngàn hợp đồng, biểu mẫu hoặc email thông qua một lược đồ JSON cố định, dựa vào việc tuân thủ hướng dẫn nghiêm ngặt để giữ cho các trường dữ liệu nhất quán.

  • Soạn thảo và viết lại

    Tạo bản nháp đầu tiên cho email, bản tóm tắt và ghi chú phát hành theo định dạng yêu cầu, sau đó tinh chỉnh chúng bằng các hướng dẫn tiếp theo ngắn gọn.

Ví dụ prompt

Tóm tắt chuỗi hỗ trợ này thành ba gạch đầu dòng và một câu trả lời gợi ý. Giữ câu trả lời dưới 80 từ và không hứa hẹn hoàn tiền.

Trích xuất tên các bên, ngày hiệu lực và thời hạn thông báo chấm dứt từ hợp đồng này vào lược đồ JSON bên dưới. Trả về null cho bất kỳ thông tin nào bị thiếu.

Viết lại nhật ký thay đổi (changelog) này cho khách hàng không chuyên về kỹ thuật. Giữ các tiêu đề, bỏ số phiếu hỗ trợ nội bộ và sử dụng các câu văn đơn giản.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Grok 4.20 Non-Reasoning là gì?

Đây là phiên bản Grok 4.20 của xAI trả lời trực tiếp thay vì suy nghĩ trước. Nó đọc văn bản và hình ảnh, viết văn bản, và hỗ trợ gọi hàm cũng như đầu ra có cấu trúc. Nó nhắm đến các công việc nhanh, nặng về hướng dẫn như trích xuất, soạn thảo và trò chuyện có hỗ trợ công cụ.

Khi nào tôi nên sử dụng non-reasoning thay vì grok-4.20?

Sử dụng nó khi nhiệm vụ rõ ràng và câu trả lời chủ yếu là truy xuất, viết lại hoặc định dạng. Nó phản hồi sớm hơn ID suy luận. Hãy chuyển sang grok-4.20 khi câu trả lời cần nhiều bước phân tích, chẳng hạn như gỡ lỗi hoặc lập kế hoạch.

Grok 4.20 Non-Reasoning có tuân theo lược đồ JSON không?

Có. Nó hỗ trợ đầu ra có cấu trúc, vì vậy bạn có thể cung cấp một lược đồ và nhận được phản hồi phù hợp với nó. Kết hợp với sự nhấn mạnh của xAI về việc tuân thủ nghiêm ngặt câu lệnh, điều này làm cho nó trở thành lựa chọn mặc định hợp lý cho các công việc trích xuất và phân loại.

Nó có thể chấp nhận đầu vào hình ảnh không?

Có, hình ảnh có thể được gửi cùng với văn bản, ví dụ như một biểu mẫu được chụp ảnh hoặc ảnh chụp màn hình giao diện người dùng. Phản hồi là văn bản. Mô hình không thể tạo hoặc chỉnh sửa hình ảnh.

Nó có hoạt động với ứng dụng khách kiểu OpenAI hiện có không?

Có. Mã ứng dụng khách kiểu OpenAI hiện có hoạt động bằng cách chỉ thay đổi tên mô hình, với các định nghĩa công cụ và lược đồ JSON được gửi trong các trường thông thường như trước đây.

Grok 4.20 Non-Reasoning có giá bao nhiêu?

Trên TokenLab, Grok 4.20 Non-Reasoning có giá Đầu vào $0.625 / Đầu ra $1.25 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Grok 4.20 Non-Reasoning là bao nhiêu?

Grok 4.20 Non-Reasoning hỗ trợ tối đa 1.000.000 token ngữ cảnh và trả về tối đa 131.072 token mỗi phản hồi.

Grok 4.20 Non-Reasoning nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1/responses làm mặc định cho Grok 4.20 Non-Reasoning. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Grok 4.20 Non-Reasoning hỗ trợ những thao tác nào?

Grok 4.20 Non-Reasoning hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Grok 4.20 Non-Reasoning

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ Grok 4

Mô hình liên quan