Chọn Auto, TokenLab Verified hoặc Official cho mỗi yêu cầu, với giá được hiển thị ngay từ đầu.Xem có gì mới

Google: Gemini 3.6 Flash

Gemini 3.6 Flash tập trung vào các vòng lặp lập trình hiệu quả, điều phối công cụ và suy luận hình ảnh. Đây là lựa chọn phù hợp cho các tác tử thường xuyên kiểm tra kết quả, sửa đổi mã nguồn và quyết định hành động tiếp theo trong một tác vụ lớn hơn.
So sánh mô hình
gemini-3.6-flash
Sẵn sàngGoogleTrò chuyệnGiảm 90% cho đầu vào đã lưu
Đầu vào / Đầu ra
$0.75 / $3.75
Ngữ cảnh
1M
Ngày phát hành
21 thg 7, 2026
Độ dài đầu ra tối đa
64K
Phương thức
Thị giácTrò chuyện
Khả năng
Sử dụng công cụBộ nhớ đệm Prompt

Về Gemini 3.6 Flash

Gemini 3.6 Flash là một mô hình Gemini thuộc phân khúc Flash ổn định được Google mô tả là cân bằng giữa tốc độ và khả năng đa phương thức. Mô hình này được phát hành vào tháng 7 năm 2026, nằm giữa 3.5 Flash và 3.7 Flash. Google định hình mô hình này xoay quanh các vòng lặp lập trình hiệu quả, điều phối công cụ và lập luận thị giác, do đó rất phù hợp cho các tác tử kiểm tra kết quả, sửa đổi và quyết định hành động tiếp theo.

Ưu điểm

  • Phù hợp với các vòng lặp trong đó tác tử chạy mã, đọc kết quả đầu ra và sửa đổi.
  • Điều phối công cụ qua nhiều lệnh gọi là một trọng tâm được nêu rõ.
  • Lập luận thị giác trên ảnh chụp màn hình và sơ đồ hoạt động trong cùng một yêu cầu với văn bản.
  • JSON tuân thủ schema và caching hỗ trợ việc sử dụng trong môi trường sản xuất có thể lặp lại.

Khi nào nên chọn model khác

  • 3.7 và 3.8 Flash là các phiên bản mới hơn và được định vị cho việc lập trình phức tạp hơn và các chu trình tự trị dài hơn.
  • Mô hình này không có chế độ suy nghĩ chuyên biệt, vì vậy việc suy ngẫm sâu nên được thực hiện trên mô hình Pro.

Bắt đầu

  1. Tạo API key

    Tạo API key trong Console để dùng cho mọi mô hình trên nền tảng.

  2. Gửi yêu cầu đầu tiên của bạn

    Sao chép ví dụ cho ngôn ngữ của bạn và chạy nó với endpoint.

    Văn bản sang văn bảnGemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    Định dạng API:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

Giá

Giá Verified áp dụng cho Verified, thường rẻ hơn trên hầu hết các model. Giá Official là giá niêm yết từ nhà phát triển, áp dụng cho route Official ổn định hơn. Auto sẽ tính phí dựa trên route hoàn thành yêu cầu.

Thông số mặc định

mỗi 1M token
Giá Official
Đầu vào $0.75 / Đầu ra $3.75 / Đọc bộ nhớ đệm $0.075
Giá Verified
Đầu vào $0.75 / Đầu ra $3.75 / Đọc bộ nhớ đệm $0.075
Giảm giá
—
Giá cache của prompt

Đọc bộ nhớ đệm

Giá Official
$0.075
Giá Verified
$0.075
Giảm giá
—
Phí công cụ

Phí tính theo mỗi lượt gọi khi model sử dụng công cụ.

Tìm kiếm web

Giá Official
$0.014/lượt tìm
Giá Verified
$0.007/lượt tìm
Giảm giá
-50%

Sử dụng & hoạt động

Tỷ lệ thành công là tỷ lệ yêu cầu hoàn tất. Độ trễ là thời gian của một phản hồi đầy đủ; P95 nghĩa là 95% yêu cầu hoàn thành trong khoảng thời gian đó.

Mức sử dụng & tình trạng

24 giờ qua
Yêu cầu
Tỷ lệ thành công
Độ trễ P95
Tổng token
Hiệu năng mô hình
Tỷ lệ thành công 30 ngày
99,7%
Lượt yêu cầu 30 ngày
100+
Hoạt động gần nhất
52 phút trước

Dữ liệu dựa trên các yêu cầu tổng hợp của người dùng, không bao gồm các kiểm tra trạng thái.

Mở trong Console

Mở Gemini 3.6 Flash trong Console để chỉnh sửa và gửi prompt ngay.

Giúp tôi thử gemini-3.6-flash với tin nhắn ngắn tại /v1beta/models/gemini-3.6-flash:generateContent. Hiển thị phản hồi, độ trễ và chi phí.

Tình huống sử dụng

Phù hợp cho
  • Thị giác
  • Vòng lặp sửa lỗi mã nguồn

    Cho phép tác tử chạy kiểm thử, đọc các lỗi, vá tệp và lặp lại cho đến khi vượt qua.

  • Kiểm tra giao diện người dùng (UI)

    So sánh ảnh chụp màn hình với thông số kỹ thuật dạng văn bản và liệt kê từng điểm không khớp về khoảng cách, màu sắc hoặc bố cục mà người đánh giá cần khắc phục.

  • Trợ lý tích hợp nhiều công cụ

    Điều phối các lệnh gọi tìm kiếm, lịch và CRM trong một cuộc hội thoại duy nhất, chuyển kết quả từ mỗi công cụ sang quyết định tiếp theo.

  • Hỏi đáp đa phương thức

    Trả lời các câu hỏi cần cả hình ảnh biểu đồ và văn bản báo cáo xung quanh.

Ví dụ prompt

Chạy các bài kiểm thử, đọc kết quả lỗi và chỉ thay đổi hàm làm hỏng bài kiểm thử thứ hai.

So sánh ảnh chụp màn hình này với thông số thiết kế và liệt kê từng điểm không khớp về khoảng cách hoặc màu sắc.

Kiểm tra lịch và CRM của tôi, sau đó soạn một phản hồi đề xuất hai thời gian họp.

Mô hình này có giá theo điều kiện. Chỉ tổng token hàng tháng không thể tạo ước tính đáng tin cậy; hãy dùng bảng giá chi tiết theo thông số yêu cầu, bộ nhớ đệm và khung giờ áp dụng.

FAQ

Gemini 3.6 Flash giỏi nhất ở việc gì?

Công việc tác tử lặp đi lặp lại: vòng lặp lập trình, điều phối công cụ và lập luận trên hình ảnh. Mô hình này cân bằng giữa tốc độ và khả năng đa phương thức, làm cho nó trở thành một lựa chọn mặc định hợp lý cho các tác tử không cần phiên bản Flash mới nhất.

Mô hình này khác biệt thế nào so với 3.5 Flash?

3.6 là phiên bản ra mắt sau và được mô tả xoay quanh các vòng lặp lập trình và việc sử dụng công cụ, trong khi 3.5 Flash là nền tảng cho công việc khối lượng lớn thường ngày. Hãy kỳ vọng hành vi tác tử tốt hơn từ 3.6.

Tôi có nên chuyển sang 3.8 Flash không?

Nếu bạn chạy các tác vụ phần mềm dài hoặc các quy trình doanh nghiệp phức tạp, 3.8 Flash là mô hình mà Google định vị cho các nhu cầu đó. Đối với các tác tử đơn giản hơn, 3.6 có thể đã đủ; hãy chạy thử cả hai trên các vết thực thi (trace) của riêng bạn.

Mô hình có chấp nhận hình ảnh không?

Có. Hình ảnh và văn bản có thể được kết hợp trong một yêu cầu duy nhất, và mô hình trả lời bằng văn bản hoặc bằng JSON tuân theo schema mà bạn cung cấp. Bản thân mô hình không tạo ra hình ảnh.

Gemini 3.6 Flash có giá bao nhiêu?

Trên TokenLab, Gemini 3.6 Flash có giá Đầu vào $0.75 / Đầu ra $3.75 mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh các điều kiện tương đương trong bảng giá chi tiết của mô hình; một mức giá đơn lẻ không quyết định tổng chi phí.

Giới hạn ngữ cảnh và đầu ra của Gemini 3.6 Flash là bao nhiêu?

Gemini 3.6 Flash hỗ trợ tối đa 1.048.576 token ngữ cảnh và trả về tối đa 65.536 token mỗi phản hồi.

Gemini 3.6 Flash nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent làm mặc định cho Gemini 3.6 Flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Gemini 3.6 Flash hỗ trợ những thao tác nào?

Gemini 3.6 Flash hỗ trợ Văn bản sang văn bản. Chọn một thao tác trong API workbench phía trên để xem endpoint và mã ví dụ tương ứng.

So sánh Gemini 3.6 Flash

Nguồn

Đánh giá ngày 2 thg 10, 2026

Xem thêm từ Gemini 3

Mô hình liên quan