각 요청에 대해 Auto, TokenLab Verified 또는 Official를 선택할 수 있으며, 가격은 사전에 표시됩니다.새로운 기능 확인하기

MiniMax: MiniMax-M3

긴 컨텍스트 코딩, 인식 및 에이전트 계획을 위한 MiniMax 멀티모달 모델입니다.
모델 비교
minimax-m3
사용 가능MiniMax채팅
입력 / 출력
$0.30 / $1.20
컨텍스트
1M
최대 출력
512K
모달리티
채팅
기능
도구 사용프롬프트 캐시

MiniMax-M3 소개

MiniMax-M3는 코딩, 에이전트 작업 및 긴 문맥(long-context) 작업을 위해 2026년 6월에 출시된 MiniMax의 오픈 웨이트 모델입니다. 이 모델은 MiniMax Sparse Attention을 사용하여 매우 긴 입력값을 경제적으로 처리하며, 답변 전 추론을 수행하고, 도구를 호출하며, 프롬프트를 캐싱합니다. 이 모델은 M2.7의 후속작이자 MiniMax의 최첨단 M 시리즈 모델입니다.

강점

  • MiniMax Sparse Attention은 이전 세대와 비교하여 매우 긴 입력값에 대한 토큰당 연산 비용을 절감합니다.
  • 에이전트를 위한 자율적인 작업 분해, 도구 호출 및 다단계 추론을 목표로 합니다.
  • MiniMax가 오픈 웨이트를 공개하므로, 자체 호스팅 복사본을 통해 동작을 확인할 수 있습니다.
  • 긴 에이전트 루프를 위해 추론, 도구 사용 및 프롬프트 캐싱 기능을 모두 활성화할 수 있습니다.

다른 모델이 필요한 경우

  • 텍스트 입력 전용 모델이므로 차트나 스크린샷을 직접 읽을 수 없습니다.
  • 추론 과정과 매우 긴 입력값으로 인해 고속 M2.x 모델보다 요청 처리 속도가 느립니다.

시작하기

  1. API 키 만들기

    Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.

  2. 첫 번째 요청 보내기

    사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.

    텍스트-텍스트Responses API
    POST/v1/responses
    API 형식:
    curl https://api.tokenlab.sh/v1/responses \
      -H "Content-Type: application/json" \
      -H "Authorization: Bearer sk-xxx" \
      -d '{
        "model": "minimax-m3",
        "input": "Hello!"
      }'

가격 책정

Verified 가격은 Verified에 적용되며 대부분의 모델에서 더 저렴합니다. Official 가격은 모델 제조사가 공개한 가격으로, 더 안정적인 Official 경로에 적용됩니다. Auto는 요청을 완료한 경로의 가격으로 청구합니다.

입력 토큰 <= 512K

1M Token 당
Official 가격
입력 $0.30 / 출력 $1.20 / 캐시 읽기 $0.06
Verified 가격
—
할인
—

입력 토큰 > 512K

1M Token 당
Official 가격
입력 $0.60 / 출력 $2.40 / 캐시 읽기 $0.12
Verified 가격
—
할인
—
프롬프트 캐시 가격

캐시 읽기

Official 가격
$0.06
Verified 가격
—
할인
—

사용량 및 활동

성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.

사용량 및 가용성

지난 24시간
요청
성공률
P95 지연 시간
총 토큰
모델 성능
30일 성공률
100.0%
30일 요청 수
100+
마지막 활동
그저께

데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.

Console에서 열기

Console에서 MiniMax-M3을 열고 프롬프트를 수정하거나 전송하세요.

/v1/responses에서 minimax-m3로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.

사용 사례

  • 전체 저장소(repository) 작업

    대규모 코드베이스를 로드하고 모델이 편집 전 모듈 간의 변경 사항을 추적하도록 합니다.

  • 계획 수립 에이전트

    에이전트에게 도구 세트와 목표를 부여하여 작업을 분해하고 단계별로 도구를 호출하게 합니다.

  • 긴 문서 분석

    긴 분량의 대본, 사양서 또는 보고서를 청크 단위로 나누지 않고 한 번에 검토합니다.

프롬프트 예제

전체 저장소입니다. 재시도 로직은 어디에 구현되어 있으며, 백오프를 변경하면 무엇이 문제가 됩니까?

사건 타임라인과 서비스 로그입니다. 버그 재현 단계를 작성하고 결함이 있을 것으로 예상되는 모듈을 지목하세요.

이 모놀리식을 세 개의 서비스로 분할하는 계획을 세우고, 각 서비스에 대해 가장 먼저 호출할 도구 이름을 지정하세요.

이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.

FAQ

MiniMax-M3는 M2.7과 무엇이 다른가요?

MiniMax는 M3를 매우 긴 문맥을 위한 Sparse Attention을 기반으로 구축되어 코딩 및 에이전트 작업에 최적화된 새로운 세대로 소개하며, M2.7은 초기 에이전트 하네스를 대상으로 합니다.

MiniMax-M3는 오픈 웨이트 모델인가요?

MiniMax는 M3를 오픈 웨이트 모델로 공개하므로 데이터 규정상 필요한 경우 자체 호스팅할 수 있습니다. 실행 전 모델 카드에 기재된 라이선스를 읽어보시기 바랍니다.

이미지와 비디오를 입력받을 수 있나요?

아니요. MiniMax-M3는 텍스트 입력만 가능하므로 스크린샷, 차트, 다이어그램 또는 비디오 프레임을 직접 읽어야 할 때는 이미지 입력이 가능한 모델을 사용하십시오.

도구를 사용할 수 있나요?

네. 도구 호출이 가능하며, MiniMax는 이를 에이전트 계획 수립에 활용하도록 설계했습니다. 작업이 단계별로 분해되고 각 단계에서 도구가 호출됩니다. 요청 시 도구 정의를 함께 전달하면 모델이 호출 시점을 결정합니다.

고속 M2.x 모델 대신 M3를 사용해야 할 때는 언제인가요?

매우 긴 입력값이 필요하거나 더 복잡한 에이전트 계획 수립이 필요할 때 M3를 선택하십시오. 추론의 깊이보다 각 턴의 응답 속도가 더 중요할 때는 고속 M2.x 변형 모델을 선택하십시오.

MiniMax-M3 의 가격은 얼마인가요?

TokenLab 에서 MiniMax-M3 은 입력 $0.30 / 출력 $1.20 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.

MiniMax-M3의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?

MiniMax-M3은 최대 1,048,576 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 524,288 토큰까지 출력합니다.

MiniMax-M3 은 어떤 엔드포인트를 써야 하나요?

MiniMax-M3에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.

MiniMax-M3 은 어떤 오퍼레이션을 지원하나요?

MiniMax-M3은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.

MiniMax-M3 비교하기

출처

2026. 10. 2. 검토 완료

MiniMax의 다른 모델

관련 모델