OpenAI: GPT-5 mini
gpt-5-mini- 입력 / 출력-30%
- $0.25 / $2.00$0.175 / $1.40
- 컨텍스트
- 400K
- 최대 출력
- 128K
- 모달리티
- 비전채팅
- 기능
- 도구 사용프롬프트 캐시추론
GPT-5 mini 소개
GPT-5 mini는 OpenAI의 더 작은 GPT-5 모델로, 명확하게 정의된 고처리량 작업에 최적화된 더 빠르고 비용 효율적인 GPT-5 버전입니다. 텍스트와 이미지를 입력받아 텍스트를 반환하며, 추론 토큰, 함수 호출, 구조화된 출력을 유지합니다. 최고 수준의 정확도보다 지연 시간과 처리량이 중요할 때 전체 모델 대신 선택하세요.
강점
- 시간에 민감한 고처리량 애플리케이션을 위해 OpenAI가 더 빠른 GPT-5 버전으로 포지셔닝한 모델입니다.
- 추론 토큰을 유지하므로 더 작은 규모에서도 다단계 문제를 해결할 수 있습니다.
- 상위 모델과 마찬가지로 함수 호출, 웹 검색, 파일 검색 및 구조화된 출력을 처리합니다.
- 이미지 입력을 받아 별도의 비전 모델 없이도 스크린샷이나 문서 관련 질문이 가능합니다.
다른 모델이 필요한 경우
- 지식 컷오프는 2024년 5월로 전체 GPT-5보다 이전이므로, 최근 사건에 대한 정보는 더 적습니다.
- 가장 어려운 추론 작업이나 대규모 리팩토링에는 전체 GPT-5나 Pro 티어를 사용하는 것이 더 안전합니다.
- 텍스트만 반환하며 오디오나 이미지 출력은 제공하지 않습니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트-텍스트Responses APIPOST/v1/responsesAPI 형식:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "gpt-5-mini", "input": "Hello!" }'
가격 책정
Verified 가격은 Verified에 적용되며 대부분의 모델에서 더 저렴합니다. Official 가격은 모델 제조사가 공개한 가격으로, 더 안정적인 Official 경로에 적용됩니다. Auto는 요청을 완료한 경로의 가격으로 청구합니다.
기본 사양
1M Token 당- Official 가격
- 입력 $0.25 / 출력 $2.00 / 캐시 읽기 $0.025
- Verified 가격
- 입력 $0.175 / 출력 $1.40 / 캐시 읽기 $0.0175
- 할인
- -30%
캐시 읽기
- Official 가격
- $0.025
- Verified 가격
- $0.0175
- 할인
- -30%
모델이 도구를 사용할 때만 호출당 비용이 부과됩니다.
웹 검색
- Official 가격
- $0.01/검색
- Verified 가격
- $0.007/검색
- 할인
- -30%
| Official 가격1M Token 당 | Verified 가격1M Token 당 | 할인 | |
|---|---|---|---|
| 기본 사양 | 입력 $0.25 / 출력 $2.00 / 캐시 읽기 $0.025 | 입력 $0.175 / 출력 $1.40 / 캐시 읽기 $0.0175 | -30% |
| 프롬프트 캐시 가격 | |||
| 캐시 읽기 | $0.025 | $0.0175 | -30% |
| 도구 사용료모델이 도구를 사용할 때만 호출당 비용이 부과됩니다. | |||
| 웹 검색 | $0.01/검색 | $0.007/검색 | -30% |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 GPT-5 mini을 열고 프롬프트를 수정하거나 전송하세요.
/v1/responses에서 gpt-5-mini로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.
사용 사례
적합한 용도- 추론
- 비전
고객 응대용 어시스턴트
응답 속도가 사용자 경험을 결정하는 주문 시스템에서 도구 호출을 통해 제품 관련 질문에 답변합니다.
배치 분류
구조화된 출력 스키마와 일관된 카테고리를 사용하여 수천 개의 티켓이나 리뷰를 분류합니다.
코드 설명 및 간단한 수정
전체 규모의 모델이 필요하지 않은 작업에서 함수를 설명하고, 테스트를 작성하며, 제한적인 수정을 수행합니다.
에이전트 하위 단계
더 강력한 모델이 계획을 수립하는 동안 워크플로우 내부에서 일상적인 조회 및 요약 작업을 수행합니다.
프롬프트 예제
이 지원 티켓을 청구, 버그, 기능 요청 중 하나로 분류하고 한 문장의 추론과 함께 라벨을 반환하세요.
이 통화 녹취록을 5개의 글머리 기호로 요약하고 담당자가 포함된 작업 항목을 나열하세요.
이 함수에 대한 단위 테스트를 작성하고 처리하지 못하는 입력값이 있다면 지적하세요.
이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.
FAQ
GPT-5 mini란 무엇인가요?
GPT-5 mini는 OpenAI의 GPT-5를 축소한 모델입니다. 빠르고 비용 효율적인 대량 요청 작업에 적합하며, 추론, 도구 사용, 이미지 입력을 지원합니다.
GPT-5 대신 GPT-5 mini를 언제 사용해야 하나요?
속도와 처리량이 중요한 분류, 요약, 일상적인 도구 호출과 같은 명확한 작업에는 mini를 사용하세요. 자체 평가 세트에서 답변이 자주 틀리거나 더 깊은 추론이 필요한 작업에는 전체 GPT-5를 사용하세요.
GPT-5 mini는 이미지를 입력받나요?
네. 텍스트와 이미지를 입력받아 텍스트를 출력합니다. 이를 통해 스크린샷, 양식, 차트를 읽어 질문하거나 데이터를 추출할 수 있지만, 모델이 직접 이미지를 생성하거나 수정할 수는 없습니다.
GPT-5 mini의 지식 컷오프는 언제인가요?
OpenAI는 이 모델의 지식 컷오프를 2024년 5월 31일로 명시하고 있습니다. 그 이후의 정보는 프롬프트, 첨부 파일 또는 웹 검색 도구 호출을 통해 얻어야 합니다.
GPT-5 mini가 GPT-5 nano보다 작은가요?
아니요. Nano가 두 모델 중 더 작고 저렴하며 요약 및 분류 작업에 최적화되어 있습니다. Mini는 성능과 비용 면에서 Nano와 전체 GPT-5 사이에 위치합니다.
GPT-5 mini 의 가격은 얼마인가요?
TokenLab 에서 GPT-5 mini 은 입력 $0.175 / 출력 $1.40 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
GPT-5 mini의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?
GPT-5 mini은 최대 400,000 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 128,000 토큰까지 출력합니다.
GPT-5 mini 은 어떤 엔드포인트를 써야 하나요?
GPT-5 mini에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
GPT-5 mini 은 어떤 오퍼레이션을 지원하나요?
GPT-5 mini은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
GPT-5 mini 비교하기
출처
2026. 10. 2. 검토 완료