Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Google: Gemini 3.7 Flash

Mô hình Gemini hiệu suất cao dành cho quy trình làm việc tác tử, lập trình và suy luận đa phương thức
So sánh mô hình
gemini-3.7-flash
Sẵn sàngGoogleTrò chuyệnGiảm 90% cho đầu vào đã lưu
Đầu vào / Đầu ra-50%
$0.75 / $3.75$0.375 / $1.88
Ngữ cảnh
1M
Ngày phát hành
13 thg 8, 2026
Độ dài đầu ra tối đa
64K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm Prompt

Về Gemini 3.7 Flash

Gemini 3.7 Flash là một mô hình thuộc dòng Flash ổn định của Google, phát hành vào tháng 8 năm 2026, được Google mô tả là được xây dựng cho việc lập trình phức tạp, quy trình làm việc dạng tác nhân (agentic) và thực thi nhiều bước đáng tin cậy. Mô hình này đọc văn bản và hình ảnh, hỗ trợ suy luận (thinking), gọi công cụ, trả về JSON tuân thủ schema và lưu trữ ngữ cảnh trong bộ nhớ đệm (caching). Đây là một bước tiến so với 3.6 Flash và kém một bước so với 3.8 Flash.

Ưu điểm

  • Khả năng suy luận có thể chạy trước câu trả lời, giúp ích cho việc lập trình và các tác vụ nhiều bước.
  • Thực thi nhiều bước đáng tin cậy là mục tiêu thiết kế đã được nêu rõ, rất hữu ích khi một tác nhân không được phép làm mất vị trí hiện tại của mình.
  • Việc gọi công cụ và JSON tuân thủ schema giúp dễ dàng đưa kết quả vào các hệ thống khác.
  • Đầu vào hình ảnh xử lý ảnh chụp màn hình, sơ đồ và tài liệu đã quét.

Khi nào nên chọn model khác

  • Gemini 3.8 Flash là mô hình mới hơn được Google giới thiệu là dòng Flash có năng lực cao nhất.
  • Khả năng suy luận làm tăng độ trễ, vì vậy các thao tác tra cứu đơn giản sẽ phù hợp hơn với Flash-Lite.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnGemini API
    POST/v1beta/models/gemini-3.7-flash:generateContent
    Định dạng API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Giá

Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.

Promotional Standard

mỗi 1M token
Giá Official
Đầu vào $0.75 / Đầu ra $3.75 / Đọc bộ nhớ đệm $0.075
Giá Verified
Đầu vào $0.375 / Đầu ra $1.88 / Đọc bộ nhớ đệm $0.0375
Giảm giá
-50%
Giá cache của prompt

Đọc bộ nhớ đệm

Giá Official
$0.075
Giá Verified
$0.0375
Giảm giá
-50%
Phí công cụ

Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.

Tìm kiếm web

Giá Official
$0.014/lượt tìm
Giá Verified
$0.007/lượt tìm
Giảm giá
-50%

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Tỷ lệ thành công 30 ngày
99,8%
Độ trễ trung vị 7 ngày
13,6 sn=271
Độ trễ P95 7 ngày
53 sn=271
Lượt yêu cầu 30 ngày
1K+
Hoạt động gần nhất
19 giờ trước

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Gemini 3.7 Flash trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử gemini-3.7-flash với tin nhắn ngắn tại /v1beta/models/gemini-3.7-flash:generateContent. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Thị giác
  • Triển khai tính năng

    Yêu cầu tác nhân đọc một ticket, chỉnh sửa nhiều file và chạy các bài kiểm thử.

  • Tự động hóa quy trình làm việc

    Liên kết các phê duyệt, tra cứu và thông báo trong đó mỗi bước phụ thuộc vào bước trước đó.

  • Đánh giá mã nguồn

    Đọc bản diff, đánh dấu các thay đổi rủi ro và giải thích từng phát hiện để người đánh giá là con người có thể quyết định nhanh chóng những gì cần chấp nhận.

  • Làm sạch dữ liệu

    Suy luận qua các bản ghi không nhất quán và đề xuất các quy tắc chuẩn hóa trước khi áp dụng, để quá trình làm sạch có thể được kiểm toán trước.

Ví dụ prompt

Đọc ticket này và các file đính kèm, triển khai thay đổi và liệt kê các bài kiểm thử bạn đã chạy.

Đánh giá bản diff này để tìm lỗi đồng thời (concurrency bugs) và xếp hạng các phát hiện theo mức độ nghiêm trọng.

Hai bản ghi khách hàng này trông có vẻ trùng lặp. Hãy giải thích trường nào xung đột và quy tắc nào sẽ hợp nhất chúng một cách an toàn.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Gemini 3.7 Flash được thiết kế để làm gì?

Lập trình phức tạp, quy trình làm việc của tác nhân và quá trình thực thi nhiều bước đòi hỏi sự ổn định từ bước đầu tiên đến bước cuối cùng. Đây là một mô hình Flash có khả năng suy luận, hỗ trợ công cụ và hình ảnh.

Mô hình này có hỗ trợ suy luận không?

Có. Mô hình có thể lập luận trước khi trả lời, giúp cải thiện kết quả về mã và lập kế hoạch. Hãy giữ mức nỗ lực đó ở mức thấp đối với các lượt tương tác ngắn để giữ phản hồi nhanh chóng.

Mô hình này khác với 3.6 Flash như thế nào?

3.7 Flash là mô hình ra mắt sau và bổ sung khả năng suy luận, với điểm nhấn mạnh hơn vào các ca chạy nhiều bước đáng tin cậy. 3.6 Flash tập trung vào các vòng lặp lập trình và lý luận trực quan mà không có tính năng suy luận.

Liệu 3.8 Flash có phải là lựa chọn tốt hơn không?

Thường là có, đối với côngยthức phần mềm dài hạn (long-horizon software engineering). 3.7 Flash vẫn là một lựa chọn hợp lý khi bạn đã tinh chỉnh các câu lệnh (prompt) cho nó và kết quả đạt yêu cầu của bạn.

Gemini 3.7 Flash có giá bao nhiêu?

Trên TokenLab, Gemini 3.7 Flash có giá Đầu vào $0.375 / Đầu ra $1.88 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Gemini 3.7 Flash là bao nhiêu?

Gemini 3.7 Flash hỗ trợ tối đa 1.048.576 token ngữ cảnh và trả về tối đa 65.536 token mỗi phản hồi.

Gemini 3.7 Flash nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1beta/models/gemini-3.7-flash:generateContent làm mặc định cho Gemini 3.7 Flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Gemini 3.7 Flash hỗ trợ những thao tác nào?

Gemini 3.7 Flash hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Gemini 3.7 Flash

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ Gemini 3

Mô hình liên quan