각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

Google: Gemini 3.6 Flash

Gemini 3.6 Flash는 효율적인 코딩 루프, 도구 오케스트레이션 및 시각적 추론에 중점을 둡니다. 더 큰 작업 내에서 반복적으로 결과를 검사하고, 코드를 수정하며, 다음 행동을 결정해야 하는 에이전트에 유용합니다.
모델 비교
gemini-3.6-flash
사용 가능Google채팅입력 캐싱 시 90% 할인
입력 / 출력
$0.75 / $3.75
컨텍스트
1M
출시일
2026년 7월 21일
최대 출력
64K
모달리티
비전채팅
기능
도구 사용프롬프트 캐시

Gemini 3.6 Flash 소개

Gemini 3.6 Flash는 Google이 속도와 멀티모달 기능의 균형을 맞춘 모델로 설명하는 안정적인 Flash 티어 Gemini 모델입니다. 2026년 7월에 3.5 Flash와 3.7 Flash 사이에 출시되었습니다. Google은 이 모델을 효율적인 코딩 루프, 도구 오케스트레이션, 시각적 추론을 중심으로 구성했으므로, 결과를 검사하고 수정하며 다음 행동을 결정하는 에이전트에 적합합니다.

강점

  • 에이전트가 코드를 실행하고, 출력을 읽고, 수정하는 루프에 적합합니다.
  • 여러 호출에 걸친 도구 오케스트레이션이 주요 초점입니다.
  • 스크린샷과 다이어그램에 대한 시각적 추론이 텍스트와 동일한 요청 내에서 작동합니다.
  • 스키마가 지정된 JSON과 캐싱은 반복 가능한 프로덕션 사용을 지원합니다.

다른 모델이 필요한 경우

  • 3.7 및 3.8 Flash는 더 최신 모델이며, 더 복잡한 코딩과 긴 자율 실행 작업에 맞춰져 있습니다.
  • 전용 사고 모드가 없으므로, 깊은 숙고가 필요한 작업은 Pro 모델에서 수행하는 것이 좋습니다.

시작하기

  1. API 키 만들기

    Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.

  2. 첫 번째 요청 보내기

    사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.

    텍스트-텍스트Gemini API
    POST/v1beta/models/gemini-3.6-flash:generateContent
    API 형식:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

가격 책정

Verified는 TokenLab 가격이 적용되어 대부분의 모델에서 더 저렴합니다. Official은 제조사가 책정한 공식 가격으로 더 안정적인 경로를 제공합니다. Auto는 요청을 완료한 경로의 가격으로 자동 청구합니다.

기본 사양

1M Token 당
Official 가격
입력 $0.75 / 출력 $3.75 / 캐시 읽기 $0.075
TokenLab 가격
입력 $0.75 / 출력 $3.75 / 캐시 읽기 $0.075
할인
—
프롬프트 캐시 가격

캐시 읽기

Official 가격
$0.075
TokenLab 가격
$0.075
할인
—
도구 사용료

모델이 도구를 사용할 때만 호출당 비용이 부과됩니다.

웹 검색

Official 가격
$0.014/검색
TokenLab 가격
$0.007/검색
할인
-50%

사용량 및 활동

성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.

사용량 및 가용성

지난 24시간
요청
성공률
P95 지연 시간
총 토큰
모델 성능
30일 성공률
99.7%
30일 요청 수
100+
마지막 활동
13시간 전

데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.

Console에서 열기

Console에서 Gemini 3.6 Flash을 열고 프롬프트를 수정하거나 전송하세요.

/v1beta/models/gemini-3.6-flash:generateContent에서 gemini-3.6-flash로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.

사용 사례

적합한 용도
  • 비전
  • 코드 수정 루프

    에이전트가 테스트를 실행하고, 실패 내용을 읽고, 파일을 패치하고, 통과할 때까지 반복하도록 합니다.

  • UI 검사

    스크린샷을 작성된 사양과 비교하여 검토자가 수정해야 할 간격, 색상 또는 레이아웃 불일치 항목을 나열합니다.

  • 도구 중심 어시스턴트

    검색, 캘린더, CRM 호출을 하나의 대화 내에서 조정하고, 각 도구의 결과를 다음 결정 단계로 전달합니다.

  • 멀티모달 Q&A

    차트 이미지와 주변 보고서 텍스트가 모두 필요한 질문에 답변합니다.

프롬프트 예제

테스트를 실행하고, 실패 출력을 읽은 뒤, 두 번째 테스트를 실패하게 만드는 함수만 수정하세요.

이 스크린샷을 디자인 사양과 비교하여 간격이나 색상 불일치 항목을 각각 나열하세요.

내 캘린더와 CRM을 확인한 다음, 두 가지 회의 시간을 제안하는 답장을 작성하세요.

이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.

FAQ

Gemini 3.6 Flash의 가장 큰 장점은 무엇인가요?

반복적인 에이전트 작업(코딩 루프, 도구 오케스트레이션, 이미지 추론)입니다. 속도와 멀티모달 능력의 균형을 맞추고 있어, 최신 Flash 모델이 필요하지 않은 에이전트에게 합리적인 기본 선택지입니다.

3.5 Flash와 어떻게 다른가요?

3.6은 더 나중에 출시된 모델로 코딩 루프와 도구 사용에 최적화되어 있으며, 3.5 Flash는 일상적인 대량 작업의 기준이 되는 모델입니다. 3.6에서 더 나은 에이전트 동작을 기대할 수 있습니다.

3.8 Flash로 전환해야 할까요?

긴 소프트웨어 작업이나 복잡한 엔터프라이즈 흐름을 실행한다면 Google은 3.8 Flash를 권장합니다. 더 단순한 에이전트라면 3.6으로도 충분할 수 있으니, 직접 트레이스를 실행해 보고 결정하세요.

이미지를 입력받을 수 있나요?

네. 이미지와 텍스트를 단일 요청으로 결합할 수 있으며, 모델은 텍스트나 사용자가 제공한 스키마를 따르는 JSON으로 답변합니다. 모델 자체가 이미지를 생성하지는 않습니다.

Gemini 3.6 Flash 의 가격은 얼마인가요?

TokenLab 에서 Gemini 3.6 Flash 은 입력 $0.75 / 출력 $3.75 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

Gemini 3.6 Flash의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?

Gemini 3.6 Flash은 최대 1,048,576 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 65,536 토큰까지 출력합니다.

Gemini 3.6 Flash 은 어떤 엔드포인트를 써야 하나요?

Gemini 3.6 Flash에 대해 https://api.tokenlab.sh/v1beta/models/gemini-3.6-flash:generateContent를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.

Gemini 3.6 Flash 은 어떤 오퍼레이션을 지원하나요?

Gemini 3.6 Flash은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.

Gemini 3.6 Flash 비교하기

출처

2026. 10. 2. 검토 완료

Gemini 3의 다른 모델

관련 모델