Google: Gemini 3.5 Flash
gemini-3.5-flash- 입력 / 출력-50%
- $1.50 / $9.00$0.75 / $4.50
- 컨텍스트
- 1M
- 출시일
- 2026년 5월 19일
- 최대 출력
- 64K
- 모달리티
- 비전채팅
- 기능
- 도구 사용프롬프트 캐시추론
Gemini 3.5 Flash 소개
Gemini 3.5 Flash는 Google의 안정적인 Flash 티어 모델로, 일상적인 고처리량 워크로드에서 속도와 기본 성능의 기준이 되는 모델입니다. 텍스트와 이미지를 읽고, 도구를 호출하며, 스키마가 지정된 JSON을 반환하고, 캐싱을 지원합니다. 이 모델은 Flash-Lite 3.5와 이후 출시된 3.6, 3.7, 3.8 Flash 릴리스 사이에 위치합니다.
강점
- 대량의 일상적인 채팅, 추출 및 요약 작업을 위한 안정적인 범용 Flash 모델입니다.
- 도구 호출 기능은 몇 단계의 작업을 수행하는 어시스턴트를 지원합니다.
- 이미지 입력 기능을 통해 별도의 비전 모델 없이도 스크린샷, 스캔 문서, 차트를 처리할 수 있습니다.
- 스키마가 지정된 JSON과 컨텍스트 캐싱은 반복적인 파이프라인 호출에 적합합니다.
다른 모델이 필요한 경우
- 이후 출시된 3.6, 3.7, 3.8 Flash 모델은 코딩 및 에이전트 작업에서 더 뛰어난 성능을 보입니다.
- 전용 사고 모드가 없으므로, 복잡한 다단계 추론 작업은 다른 모델을 사용하는 것이 좋습니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트-텍스트Gemini APIPOST/v1beta/models/gemini-3.5-flash:generateContentAPI 형식:curl "https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent" \ -H "Content-Type: application/json" \ -H "x-goog-api-key: sk-xxx" \ -d '{ "contents": [ {"role": "user", "parts": [{"text": "Hello!"}]} ] }'
가격 책정
Verified 가격은 Verified에 적용되며 대부분의 모델에서 더 저렴합니다. Official 가격은 모델 제조사가 공개한 가격으로, 더 안정적인 Official 경로에 적용됩니다. Auto는 요청을 완료한 경로의 가격으로 청구합니다.
기본 사양
1M Token 당- Official 가격
- 입력 $1.50 / 출력 $9.00 / 캐시 읽기 $0.15
- Verified 가격
- 입력 $0.75 / 출력 $4.50 / 캐시 읽기 $0.075
- 할인
- -50%
캐시 읽기
- Official 가격
- $0.15
- Verified 가격
- $0.075
- 할인
- -50%
모델이 도구를 사용할 때만 호출당 비용이 부과됩니다.
웹 검색
- Official 가격
- $0.014/검색
- Verified 가격
- $0.007/검색
- 할인
- -50%
| Official 가격1M Token 당 | Verified 가격1M Token 당 | 할인 | |
|---|---|---|---|
| 기본 사양 | 입력 $1.50 / 출력 $9.00 / 캐시 읽기 $0.15 | 입력 $0.75 / 출력 $4.50 / 캐시 읽기 $0.075 | -50% |
| 프롬프트 캐시 가격 | |||
| 캐시 읽기 | $0.15 | $0.075 | -50% |
| 도구 사용료모델이 도구를 사용할 때만 호출당 비용이 부과됩니다. | |||
| 웹 검색 | $0.014/검색 | $0.007/검색 | -50% |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
- 30일 성공률
- 95.0%
- 30일 요청 수
- 1K+
- 마지막 활동
- 43분 전
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 Gemini 3.5 Flash을 열고 프롬프트를 수정하거나 전송하세요.
/v1beta/models/gemini-3.5-flash:generateContent에서 gemini-3.5-flash로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.
사용 사례
적합한 용도- 추론
- 비전
고객 응대용 채팅
프롬프트 접두사에 캐시된 지식 베이스를 사용하여 제품 관련 질문에 답변합니다.
일괄 요약
통화 녹취록이나 티켓을 요약하고 항목별로 고정된 JSON 요약본을 출력합니다.
양식 및 문서 읽기
스캔된 양식과 배송 명세서에서 필드를 추출하여 다운스트림 시스템이 직접 로드할 수 있는 구조화된 레코드로 만듭니다.
입문 수준의 코딩 지원
코드 설명, 간단한 함수 작성, 깊이 있는 분석이 필요하지 않은 단위 테스트 초안 작성을 수행합니다.
프롬프트 예제
이 지원 상담 내용을 세 개의 불렛 포인트로 요약하고 'resolved(해결됨)' 값을 true 또는 false로 설정하세요.
이 스캔된 배송 명세서를 읽고 주문 번호, 품목, 서명 상태를 JSON으로 반환하세요.
정형화되지 않은 문자열에서 ISO 날짜를 파싱하는 Python 함수와 5개의 테스트 케이스를 작성하세요.
이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.
FAQ
Gemini 3.5 Flash란 무엇인가요?
일상적인 고처리량 작업을 목표로 하는 안정적인 Flash 티어 Gemini 모델입니다. 텍스트와 이미지를 입력받고, 도구를 사용하며, 구조화된 출력을 생성합니다. 최대 깊이보다는 일정한 속도에 중점을 둡니다.
Gemini 3.5 Flash-Lite와 어떻게 다른가요?
Flash-Lite는 Google의 가장 빠르고 경제적인 3.5 모델이며, Flash는 더 세심한 작업이 필요한 경우를 위한 완전한 모델입니다. 태깅 및 추출 작업에는 Lite를, 대화 및 긴 출력물에는 Flash를 선택하세요.
코딩 에이전트에 적합한가요?
간단한 코딩 작업은 처리할 수 있지만, 복잡한 코딩과 장기적인 에이전트 작업에는 Google의 이후 모델인 3.7 및 3.8 Flash가 적합합니다. 작업이 단순하고 처리량이 많을 때 3.5 Flash를 사용하세요.
이미지와 캐싱을 지원하나요?
둘 다 지원합니다. 한 요청 내에서 텍스트와 함께 이미지를 포함할 수 있으며, 컨텍스트 캐싱을 통해 고정된 지침 세트와 같이 긴 공유 접두사를 여러 요청에 걸쳐 재사용할 수 있습니다.
Gemini 3.5 Flash 의 가격은 얼마인가요?
TokenLab 에서 Gemini 3.5 Flash 은 입력 $0.75 / 출력 $4.50 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
Gemini 3.5 Flash의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?
Gemini 3.5 Flash은 최대 1,048,576 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 65,536 토큰까지 출력합니다.
Gemini 3.5 Flash 은 어떤 엔드포인트를 써야 하나요?
Gemini 3.5 Flash에 대해 https://api.tokenlab.sh/v1beta/models/gemini-3.5-flash:generateContent를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
Gemini 3.5 Flash 은 어떤 오퍼레이션을 지원하나요?
Gemini 3.5 Flash은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
Gemini 3.5 Flash 비교하기
Gemini 3.5 Flash 활용 가이드
출처
2026. 10. 2. 검토 완료