각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

OpenAI: GPT-5 mini

반응형 에이전트, 코딩 지원 및 일상적인 자동화를 위한 소형 GPT-5 모델
모델 비교
gpt-5-mini
사용 가능OpenAI채팅입력 캐싱 시 90% 할인
입력 / 출력-30%
$0.25 / $2.00$0.175 / $1.40
컨텍스트
400K
최대 출력
128K
모달리티
비전채팅
기능
도구 사용프롬프트 캐시추론

GPT-5 mini 소개

GPT-5 mini는 OpenAI의 더 작은 GPT-5 모델로, 명확하게 정의된 고처리량 작업에 최적화된 더 빠르고 비용 효율적인 GPT-5 버전입니다. 텍스트와 이미지를 입력받아 텍스트를 반환하며, 추론 토큰, 함수 호출, 구조화된 출력을 유지합니다. 최고 수준의 정확도보다 지연 시간과 처리량이 중요할 때 전체 모델 대신 선택하세요.

강점

  • 시간에 민감한 고처리량 애플리케이션을 위해 OpenAI가 더 빠른 GPT-5 버전으로 포지셔닝한 모델입니다.
  • 추론 토큰을 유지하므로 더 작은 규모에서도 다단계 문제를 해결할 수 있습니다.
  • 상위 모델과 마찬가지로 함수 호출, 웹 검색, 파일 검색 및 구조화된 출력을 처리합니다.
  • 이미지 입력을 받아 별도의 비전 모델 없이도 스크린샷이나 문서 관련 질문이 가능합니다.

다른 모델이 필요한 경우

  • 지식 컷오프는 2024년 5월로 전체 GPT-5보다 이전이므로, 최근 사건에 대한 정보는 더 적습니다.
  • 가장 어려운 추론 작업이나 대규모 리팩토링에는 전체 GPT-5나 Pro 티어를 사용하는 것이 더 안전합니다.
  • 텍스트만 반환하며 오디오나 이미지 출력은 제공하지 않습니다.

시작하기

  1. API 키 만들기

    Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.

  2. 첫 번째 요청 보내기

    사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.

    텍스트-텍스트Responses API
    POST/v1/responses
    API 형식:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "gpt-5-mini",
        "input": "Hello!"
      }'

가격 책정

Verified 가격은 Verified에 적용되며 대부분의 모델에서 더 저렴합니다. Official 가격은 모델 제조사가 공개한 가격으로, 더 안정적인 Official 경로에 적용됩니다. Auto는 요청을 완료한 경로의 가격으로 청구합니다.

기본 사양

1M Token 당
Official 가격
입력 $0.25 / 출력 $2.00 / 캐시 읽기 $0.025
Verified 가격
입력 $0.175 / 출력 $1.40 / 캐시 읽기 $0.0175
할인
-30%
프롬프트 캐시 가격

캐시 읽기

Official 가격
$0.025
Verified 가격
$0.0175
할인
-30%
도구 사용료

모델이 도구를 사용할 때만 호출당 비용이 부과됩니다.

웹 검색

Official 가격
$0.01/검색
Verified 가격
$0.007/검색
할인
-30%

사용량 및 활동

성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.

사용량 및 가용성

지난 24시간
요청
성공률
P95 지연 시간
총 토큰
모델 성능
개인정보 보호 및 데이터 볼륨 임계값이 충족되면 메트릭이 표시됩니다.

데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.

Console에서 열기

Console에서 GPT-5 mini을 열고 프롬프트를 수정하거나 전송하세요.

/v1/responses에서 gpt-5-mini로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.

사용 사례

적합한 용도
  • 추론
  • 비전
  • 고객 응대용 어시스턴트

    응답 속도가 사용자 경험을 결정하는 주문 시스템에서 도구 호출을 통해 제품 관련 질문에 답변합니다.

  • 배치 분류

    구조화된 출력 스키마와 일관된 카테고리를 사용하여 수천 개의 티켓이나 리뷰를 분류합니다.

  • 코드 설명 및 간단한 수정

    전체 규모의 모델이 필요하지 않은 작업에서 함수를 설명하고, 테스트를 작성하며, 제한적인 수정을 수행합니다.

  • 에이전트 하위 단계

    더 강력한 모델이 계획을 수립하는 동안 워크플로우 내부에서 일상적인 조회 및 요약 작업을 수행합니다.

프롬프트 예제

이 지원 티켓을 청구, 버그, 기능 요청 중 하나로 분류하고 한 문장의 추론과 함께 라벨을 반환하세요.

이 통화 녹취록을 5개의 글머리 기호로 요약하고 담당자가 포함된 작업 항목을 나열하세요.

이 함수에 대한 단위 테스트를 작성하고 처리하지 못하는 입력값이 있다면 지적하세요.

이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.

FAQ

GPT-5 mini란 무엇인가요?

GPT-5 mini는 OpenAI의 GPT-5를 축소한 모델입니다. 빠르고 비용 효율적인 대량 요청 작업에 적합하며, 추론, 도구 사용, 이미지 입력을 지원합니다.

GPT-5 대신 GPT-5 mini를 언제 사용해야 하나요?

속도와 처리량이 중요한 분류, 요약, 일상적인 도구 호출과 같은 명확한 작업에는 mini를 사용하세요. 자체 평가 세트에서 답변이 자주 틀리거나 더 깊은 추론이 필요한 작업에는 전체 GPT-5를 사용하세요.

GPT-5 mini는 이미지를 입력받나요?

네. 텍스트와 이미지를 입력받아 텍스트를 출력합니다. 이를 통해 스크린샷, 양식, 차트를 읽어 질문하거나 데이터를 추출할 수 있지만, 모델이 직접 이미지를 생성하거나 수정할 수는 없습니다.

GPT-5 mini의 지식 컷오프는 언제인가요?

OpenAI는 이 모델의 지식 컷오프를 2024년 5월 31일로 명시하고 있습니다. 그 이후의 정보는 프롬프트, 첨부 파일 또는 웹 검색 도구 호출을 통해 얻어야 합니다.

GPT-5 mini가 GPT-5 nano보다 작은가요?

아니요. Nano가 두 모델 중 더 작고 저렴하며 요약 및 분류 작업에 최적화되어 있습니다. Mini는 성능과 비용 면에서 Nano와 전체 GPT-5 사이에 위치합니다.

GPT-5 mini 의 가격은 얼마인가요?

TokenLab 에서 GPT-5 mini 은 입력 $0.175 / 출력 $1.40 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

GPT-5 mini의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?

GPT-5 mini은 최대 400,000 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 128,000 토큰까지 출력합니다.

GPT-5 mini 은 어떤 엔드포인트를 써야 하나요?

GPT-5 mini에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.

GPT-5 mini 은 어떤 오퍼레이션을 지원하나요?

GPT-5 mini은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.

GPT-5 mini 비교하기

출처

2026. 10. 2. 검토 완료

GPT 5의 다른 모델

관련 모델