Khả dụngGoogleChatGiảm 90% Cache
gemini-3.8-flashMới

Xây dựng ứng dụng thế hệ mới với gemini-3.8-flash

Ví dụ code API

Giá

Giá chính thức

Đầu vào$0.75
Đầu ra$3.75
Mỗi 1M token

Giá TokenLab

Đầu vào$0.375
Đầu ra$1.88
Mỗi 1M token
价格详情
每 1M Tokens
定价层级
规格
输入 官方 $0.75/1M tokens · 平台 $0.375/1M tokens 输出 官方 $3.75/1M tokens · 平台 $1.88/1M tokens 缓存读取 官方 $0.075/1M tokens · 平台 $0.0375/1M tokens

Kiểm thử một chạm

Sau khi đăng nhập, Web Agent sẽ giữ lại model, prompt và preset request này cho bạn.

Test gemini-3.8-flash trong Web Agent với một request ngắn tại /v1beta/models/gemini-3.8-flash:generateContent, sau đó hiển thị body, độ trễ và response.

Bàn làm việc API

Đây là tuyến mặc định cho production. Mẫu code bên dưới dùng endpoint này với định dạng bạn chọn.

Trò chuyệnTương thích OpenAI
POST/v1beta/models/gemini-3.8-flash:generateContent
Định dạng API:
curl "https://api.tokenlab.sh/v1beta/models/gemini-3.8-flash:generateContent" \
  -H "Content-Type: application/json" \
  -H "x-goog-api-key: sk-xxx" \
  -d '{
    "contents": [
      {"role": "user", "parts": [{"text": "Hello!"}]}
    ]
  }'

Tình huống sử dụng

Phù hợp cho

Thị giác

Đọc ảnh, parse tài liệu và trả lời câu hỏi trực quan

01

Agent và công cụ

Vận hành lập luận, phân loại hỗ trợ, gọi tool và luồng tác vụ nhiều bước.

02

Quy trình của dev

Tạo, review hoặc debug code mà không phải sắp xếp lại stack.

03

Trợ lý tri thức

Đưa chat, search và retrieval lên production với chi phí và hành vi dự đoán được.

04

So sánh trực tiếp

So sánh chất lượng phản hồi thực tế, độ trễ và giá cho các mô hình mặc định trong production.

Ví dụ prompt

Viết một câu trả lời hỗ trợ ngắn gọn và liệt kê các giả định đằng sau.

Review thiết kế API này và chỉ ra ba rủi ro tích hợp lớn nhất.

Biến một changelog dài thành release notes mà người không phải dev cũng đọc được.

此模型采用条件计费。仅凭每月 token 总量无法可靠估算费用;请结合请求规格、缓存及适用时段查看详细价格。

Câu hỏi thường gặp

gemini-3.8-flash có giá bao nhiêu?

Trên TokenLab, gemini-3.8-flash có giá Đầu vào $0.375 / Đầu ra $1.88 Mỗi 1M token. Bảng giá phía trên cho thấy chi tiết đầy đủ. Giá phụ thuộc vào đơn vị tính phí, thông số và mức sử dụng. Hãy so sánh giá chi tiết trong cùng điều kiện; một đơn giá không quyết định tổng chi phí.

gemini-3.8-flash phù hợp nhất với việc gì?

gemini-3.8-flash là lựa chọn tốt cho Chế độ JSON, Bộ nhớ đệm Prompt, Sử dụng công cụ. Bạn có thể gọi nó qua TokenLab chỉ với một API key.

Gọi API của gemini-3.8-flash thế nào?

Lấy một TokenLab API key, rồi gửi request tới https://api.tokenlab.sh/v1beta/models/gemini-3.8-flash:generateContent. API workbench phía trên có endpoint khuyến nghị và đoạn code có thể copy.

gemini-3.8-flash nên dùng endpoint nào?

Dùng https://api.tokenlab.sh/v1beta/models/gemini-3.8-flash:generateContent làm mặc định cho gemini-3.8-flash. Nếu mô hình hỗ trợ định dạng native của nhà cung cấp, API workbench cũng hiển thị endpoint đó.

Tôi có thể test gemini-3.8-flash trước khi tích hợp không?

Có. Nút «Thử trên Web Agent» mở sẵn một bài test cho gemini-3.8-flash và giữ prompt sau khi đăng nhập, không mất ngữ cảnh.

Mô hình liên quan