각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

모델 목록으로 돌아가기

Gemini 3.8 Flash 대 Gemini 3.1 Flash-Lite

Gemini 3.8 Flash와 Gemini 3.1 Flash-Lite 비교: TokenLab에서 가격, 컨텍스트 창, 최대 출력 및 기능을 나란히 비교해 보세요.

무엇을 선택할까요

모델이 사고하고 여러 단계에 걸쳐 계획을 유지해야 하는 장기적인 코딩, 자율 에이전트 및 복잡한 워크로드에는 Gemini 3.8 Flash를 선택하세요. 각 호출이 빠르게 반환되어야 하고 작업이 단순한 대화형 기능 및 대용량 멀티모달 작업에는 Gemini 3.1 Flash-Lite를 선택하세요. 결정적인 요소는 속도 티어입니다. Flash-Lite는 Flash 티어보다 하위에 위치하며 깊이 대신 응답 시간을 우선시합니다.

가격 비교

Gemini 3.8 FlashGemini 3.1 Flash-Lite
모델 제공자GoogleGoogle
전달 가용성사용 가능사용 가능
컨텍스트 윈도우1M1M
최대 출력64K64K
Official 가격
입력$0.751M Token 당출력$3.751M Token 당
입력$0.251M Token 당출력$1.501M Token 당
TokenLab 가격
입력$0.3751M Token 당출력$1.881M Token 당
입력$0.1251M Token 당출력$0.751M Token 당
모델 성능
30일 성공률
93.4%
7일 중앙값 지연시간
9.8 sn=931
30일 성공률
97.8%
기능
JSON 모드프롬프트 캐시도구 사용비전
JSON 모드프롬프트 캐시도구 사용비전

Gemini 3.8 Flash 선택이 필요한 순간

  • 여러 도구 호출에 걸친 에이전트나 코딩 작업을 실행하는 경우
  • 계획 및 디버깅을 위한 사고 능력이 필요한 경우
  • 작업이 복잡하여 Lite 모델이 잘못된 답변을 내놓는 경우

Gemini 3.1 Flash-Lite 선택이 필요한 순간

  • 대화형 기능 내에서 각 호출이 빠르게 반환되어야 하는 경우
  • 영수증, 양식, 스크린샷을 대량으로 처리하는 경우
  • 작업이 단순하여 깊은 추론이 불필요한 경우

주요 차이점

구분Gemini 3.8 FlashGemini 3.1 Flash-Lite
티어Google의 가장 지능적인 Flash 모델.Flash 티어보다 하위에 위치한 저지연, 저비용 모델.
추론행동 전 사고 과정을 지원합니다.추론 우선 모델이 아니므로, 어려운 수학이나 깊은 계획이 필요한 작업은 더 강력한 모델에 맡겨야 합니다.
긴 에이전트 실행여러 단계에 걸쳐 스레드를 유지하도록 설계되었습니다.긴 다단계 코딩 에이전트 작업에서는 성능이 다소 떨어집니다.
응답 시간성능을 위해 응답 시간을 다소 희생한 무거운 모델입니다.짧은 응답 시간은 대화형 기능에 적합합니다.
공통 인터페이스텍스트 및 이미지, 도구 호출, 스키마 기반 JSON 및 캐싱 지원.입출력이 동일하므로 모델 간 전환 시 요청 형식을 변경할 필요가 없습니다.

요약

  • Gemini 3.8 Flash: 입력 $0.375 / 출력 $1.88 1M Token 당; Gemini 3.1 Flash-Lite: 입력 $0.125 / 출력 $0.75 1M Token 당. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
Gemini 3.8 Flash
Gemini 3
자세히 보기
Gemini 3.1 Flash-Lite
Gemini 3
자세히 보기

FAQ

Gemini 3.8 Flash가 Gemini 3.1 Flash-Lite보다 나은가요?

복잡한 코딩 및 에이전트 작업의 경우, 사고 후 행동하고 여러 단계에 걸쳐 계획을 유지하므로 3.8 Flash가 더 낫습니다. 단순하고 대용량이거나 지연 시간에 민감한 호출의 경우, 빠른 반환을 위해 설계된 Flash-Lite가 더 적합합니다.

프롬프트 변경 없이 Flash-Lite로 Gemini 3.8 Flash를 대체할 수 있나요?

요청 형식은 동일하지만, 사고나 다단계 계획에 의존하는 프롬프트는 Flash-Lite에서 결과가 더 약하게 나올 수 있습니다. 해당 프롬프트를 먼저 테스트해 보고, 품질이 떨어지면 3.8 Flash를 유지하세요.

이미지에서 데이터를 추출하는 데 무엇이 더 나은가요?

Flash-Lite는 일상적인 영수증, 양식, 스크린샷 추출을 대량으로 처리하고 스키마 기반 JSON을 반환하는 데 적합합니다. 문서가 복잡하거나 레이아웃이 매우 다양하거나 추출에 판단이 필요한 경우에는 3.8 Flash를 사용하세요.

둘을 함께 사용할 수 있나요?

네. 대용량 단순 호출은 Flash-Lite로 보내 사용자에게 빠른 응답을 제공하고, 검증에 실패하거나 계획이 필요한 요청은 Gemini 3.8 Flash로 이관하세요.

Gemini 3.8 Flash와 Gemini 3.1 Flash-Lite 중 어느 것이 더 저렴한가요?

Gemini 3.8 Flash: 입력 $0.375 / 출력 $1.88 1M Token 당; Gemini 3.1 Flash-Lite: 입력 $0.125 / 출력 $0.75 1M Token 당. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

Gemini 3.8 Flash와 Gemini 3.1 Flash-Lite의 주요 차이점은 무엇인가요?

두 모델 모두 유사한 성능을 제공합니다.

출처

2026. 10. 2. 검토 완료