각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

Google: Gemini 3.1 Flash-Lite

대용량 멀티모달 및 에이전트 워크로드를 위한 저지연 Gemini 모델
모델 비교
gemini-3.1-flash-lite
사용 가능Google채팅입력 캐싱 시 90% 할인
입력 / 출력-50%
$0.25 / $1.50$0.125 / $0.75
컨텍스트
1M
출시일
2026년 5월 7일
최대 출력
64K
모달리티
비전채팅
기능
도구 사용프롬프트 캐시

Gemini 3.1 Flash-Lite 소개

Gemini 3.1 Flash-Lite는 대규모 멀티모달 및 에이전트 워크로드를 위해 구축된 Gemini 3.1 라인업의 저지연, 저비용 모델입니다. Google은 이 모델이 더 큰 모델에 필적하는 최첨단 성능을 훨씬 낮은 비용으로 제공한다고 설명합니다. 텍스트와 이미지를 읽고, 도구를 호출하며, 스키마에 맞는 JSON을 반환하고, 컨텍스트 캐싱을 지원합니다. 성능 면에서는 Flash 등급보다 아래에 위치합니다.

강점

  • 응답 시간이 짧아 각 호출이 즉각적으로 반환되어야 하는 대화형 기능에 적합합니다.
  • 이미지와 텍스트를 동일한 요청으로 처리할 수 있어 영수증, 양식, 스크린샷 처리 등에 적합합니다.
  • 스키마 기반 JSON 출력으로 자유 형식 텍스트를 파싱하는 번거로움을 없애줍니다.
  • 도구 호출 및 컨텍스트 캐싱 지원으로 반복적이고 유사한 에이전트 단계를 대규모로 수행할 수 있습니다.

다른 모델이 필요한 경우

  • 긴 단계의 코딩 에이전트 작업에는 Lite 모델보다 Flash 및 Pro 모델이 더 안정적입니다.
  • 추론 중심 모델이 아니므로, 복잡한 수학 문제나 심층적인 계획 수립은 Gemini 3.1 Pro를 사용하는 것이 좋습니다.

시작하기

  1. API 키 만들기

    Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.

  2. 첫 번째 요청 보내기

    사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.

    텍스트-텍스트Gemini API
    POST/v1beta/models/gemini-3.1-flash-lite:generateContent
    API 형식:
    curl "https://api.tokenlab.sh/v1beta/models/gemini-3.1-flash-lite:generateContent" \
      -H "Content-Type: application/json" \
      -H "x-goog-api-key: sk-xxx" \
      -d '{
        "contents": [
          {"role": "user", "parts": [{"text": "Hello!"}]}
        ]
      }'

가격 책정

Verified 가격은 Verified에 적용되며 대부분의 모델에서 더 저렴합니다. Official 가격은 모델 제조사가 공개한 가격으로, 더 안정적인 Official 경로에 적용됩니다. Auto는 요청을 완료한 경로의 가격으로 청구합니다.

기본 사양

1M Token 당
Official 가격
입력 $0.25 / 출력 $1.50 / 캐시 읽기 $0.025
Verified 가격
입력 $0.125 / 출력 $0.75 / 캐시 읽기 $0.0125
할인
-50%
프롬프트 캐시 가격

캐시 읽기

Official 가격
$0.025
Verified 가격
$0.0125
할인
-50%
도구 사용료

모델이 도구를 사용할 때만 호출당 비용이 부과됩니다.

웹 검색

Official 가격
$0.014/검색
Verified 가격
$0.007/검색
할인
-50%

사용량 및 활동

성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.

사용량 및 가용성

지난 24시간
요청
성공률
P95 지연 시간
총 토큰
모델 성능
30일 성공률
100.0%
30일 요청 수
40K+
마지막 활동
7분 전

데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.

Console에서 열기

Console에서 Gemini 3.1 Flash-Lite을 열고 프롬프트를 수정하거나 전송하세요.

/v1beta/models/gemini-3.1-flash-lite:generateContent에서 gemini-3.1-flash-lite로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.

사용 사례

적합한 용도
  • 비전
  • 대량 데이터 추출

    수천 개의 송장이나 양식에서 필드를 추출하고 각 결과를 검증된 JSON 객체로 작성하세요.

  • 콘텐츠 조정 및 태깅

    사용자가 업로드한 콘텐츠와 댓글을 고정된 정책에 따라 분류하고 한 줄로 이유를 설명하세요.

  • 라우팅 계층

    요청을 처리할 적절한 전문 모델이나 도구를 결정한 후 전달하세요.

  • 실시간 어시스턴트

    자동 완성, 빠른 답장, 음성 어시스턴트 등 대기 시간이 사용자 경험을 저해할 수 있는 기능에 활용하세요.

프롬프트 예제

이 송장 이미지에서 공급업체, 날짜, 합계, 통화를 추출하여 JSON으로 반환하세요.

아래 댓글을 스팸, 악용, 질문, 칭찬 중 하나로 분류하고 그 이유를 한 문장으로 설명하세요.

이 사용자 메시지를 바탕으로 search_docs, create_ticket, answer_directly 중 하나를 선택하세요. 도구 이름만 답변하세요.

이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.

FAQ

Gemini 3.1 Flash-Lite는 어떤 작업에 가장 적합한가요?

추출, 분류, 태깅, 라우팅, 빠른 멀티모달 답변과 같은 대규모의 지연 시간에 민감한 작업에 적합합니다. 속도와 호출당 부하를 줄이기 위해 추론의 깊이를 일부 조정했습니다.

이미지를 입력받을 수 있나요?

네. 텍스트와 이미지를 하나의 요청에 혼합할 수 있어 문서, 스크린샷, 사진을 읽을 수 있습니다. 답변은 텍스트나 사용자가 정의한 스키마에 맞는 JSON 형태로 반환됩니다.

도구를 호출할 수 있나요?

네. 함수 호출(Function calling)을 지원하여, 단순한 요청에 대해 도구를 선택하거나 복잡한 사례를 더 큰 모델로 전달하는 1단계 에이전트 역할을 수행할 수 있습니다.

Gemini 3.5 Flash-Lite와는 어떻게 다른가요?

3.5 Flash-Lite는 Google이 현재 신규 프로젝트에 권장하는 최신 세대 모델입니다. 3.1 Flash-Lite는 이전 Lite 모델이지만 여전히 안정적입니다. 트래픽을 전환하기 전에 두 모델 모두에서 직접 프롬프트를 테스트해 보세요.

Gemini 3.1 Flash-Lite 의 가격은 얼마인가요?

TokenLab 에서 Gemini 3.1 Flash-Lite 은 입력 $0.125 / 출력 $0.75 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

Gemini 3.1 Flash-Lite의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?

Gemini 3.1 Flash-Lite은 최대 1,048,576 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 65,536 토큰까지 출력합니다.

Gemini 3.1 Flash-Lite 은 어떤 엔드포인트를 써야 하나요?

Gemini 3.1 Flash-Lite에 대해 https://api.tokenlab.sh/v1beta/models/gemini-3.1-flash-lite:generateContent를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.

Gemini 3.1 Flash-Lite 은 어떤 오퍼레이션을 지원하나요?

Gemini 3.1 Flash-Lite은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.

Gemini 3.1 Flash-Lite 비교하기

Gemini 3.1 Flash-Lite 활용 가이드

출처

2026. 10. 2. 검토 완료

Gemini 3의 다른 모델

관련 모델