- 입력 / 출력
- $0.30 / $1.20
- 컨텍스트
- 1M
- 최대 출력
- 512K
- 모달리티
- 채팅
- 기능
- 도구 사용프롬프트 캐시
MiniMax-M3 소개
MiniMax-M3는 코딩, 에이전트 작업 및 긴 문맥(long-context) 작업을 위해 2026년 6월에 출시된 MiniMax의 오픈 웨이트 모델입니다. 이 모델은 MiniMax Sparse Attention을 사용하여 매우 긴 입력값을 경제적으로 처리하며, 답변 전 추론을 수행하고, 도구를 호출하며, 프롬프트를 캐싱합니다. 이 모델은 M2.7의 후속작이자 MiniMax의 최첨단 M 시리즈 모델입니다.
강점
- MiniMax Sparse Attention은 이전 세대와 비교하여 매우 긴 입력값에 대한 토큰당 연산 비용을 절감합니다.
- 에이전트를 위한 자율적인 작업 분해, 도구 호출 및 다단계 추론을 목표로 합니다.
- MiniMax가 오픈 웨이트를 공개하므로, 자체 호스팅 복사본을 통해 동작을 확인할 수 있습니다.
- 긴 에이전트 루프를 위해 추론, 도구 사용 및 프롬프트 캐싱 기능을 모두 활성화할 수 있습니다.
다른 모델이 필요한 경우
- 텍스트 입력 전용 모델이므로 차트나 스크린샷을 직접 읽을 수 없습니다.
- 추론 과정과 매우 긴 입력값으로 인해 고속 M2.x 모델보다 요청 처리 속도가 느립니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트-텍스트Responses APIPOST/v1/responsesAPI 형식:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "minimax-m3", "input": "Hello!" }'
가격 책정
Verified 가격은 Verified에 적용되며 대부분의 모델에서 더 저렴합니다. Official 가격은 모델 제조사가 공개한 가격으로, 더 안정적인 Official 경로에 적용됩니다. Auto는 요청을 완료한 경로의 가격으로 청구합니다.
입력 토큰 <= 512K
1M Token 당- Official 가격
- 입력 $0.30 / 출력 $1.20 / 캐시 읽기 $0.06
- Verified 가격
- —
- 할인
- —
입력 토큰 > 512K
1M Token 당- Official 가격
- 입력 $0.60 / 출력 $2.40 / 캐시 읽기 $0.12
- Verified 가격
- —
- 할인
- —
캐시 읽기
- Official 가격
- $0.06
- Verified 가격
- —
- 할인
- —
| Official 가격1M Token 당 | Verified 가격1M Token 당 | 할인 | |
|---|---|---|---|
| 입력 토큰 <= 512K | 입력 $0.30 / 출력 $1.20 / 캐시 읽기 $0.06 | — | — |
| 입력 토큰 > 512K | 입력 $0.60 / 출력 $2.40 / 캐시 읽기 $0.12 | — | — |
| 프롬프트 캐시 가격 | |||
| 캐시 읽기 | $0.06 | — | — |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
- 30일 성공률
- 100.0%
- 30일 요청 수
- 100+
- 마지막 활동
- 그저께
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 MiniMax-M3을 열고 프롬프트를 수정하거나 전송하세요.
/v1/responses에서 minimax-m3로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.
사용 사례
전체 저장소(repository) 작업
대규모 코드베이스를 로드하고 모델이 편집 전 모듈 간의 변경 사항을 추적하도록 합니다.
계획 수립 에이전트
에이전트에게 도구 세트와 목표를 부여하여 작업을 분해하고 단계별로 도구를 호출하게 합니다.
긴 문서 분석
긴 분량의 대본, 사양서 또는 보고서를 청크 단위로 나누지 않고 한 번에 검토합니다.
프롬프트 예제
전체 저장소입니다. 재시도 로직은 어디에 구현되어 있으며, 백오프를 변경하면 무엇이 문제가 됩니까?
사건 타임라인과 서비스 로그입니다. 버그 재현 단계를 작성하고 결함이 있을 것으로 예상되는 모듈을 지목하세요.
이 모놀리식을 세 개의 서비스로 분할하는 계획을 세우고, 각 서비스에 대해 가장 먼저 호출할 도구 이름을 지정하세요.
이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.
FAQ
MiniMax-M3는 M2.7과 무엇이 다른가요?
MiniMax는 M3를 매우 긴 문맥을 위한 Sparse Attention을 기반으로 구축되어 코딩 및 에이전트 작업에 최적화된 새로운 세대로 소개하며, M2.7은 초기 에이전트 하네스를 대상으로 합니다.
MiniMax-M3는 오픈 웨이트 모델인가요?
MiniMax는 M3를 오픈 웨이트 모델로 공개하므로 데이터 규정상 필요한 경우 자체 호스팅할 수 있습니다. 실행 전 모델 카드에 기재된 라이선스를 읽어보시기 바랍니다.
이미지와 비디오를 입력받을 수 있나요?
아니요. MiniMax-M3는 텍스트 입력만 가능하므로 스크린샷, 차트, 다이어그램 또는 비디오 프레임을 직접 읽어야 할 때는 이미지 입력이 가능한 모델을 사용하십시오.
도구를 사용할 수 있나요?
네. 도구 호출이 가능하며, MiniMax는 이를 에이전트 계획 수립에 활용하도록 설계했습니다. 작업이 단계별로 분해되고 각 단계에서 도구가 호출됩니다. 요청 시 도구 정의를 함께 전달하면 모델이 호출 시점을 결정합니다.
고속 M2.x 모델 대신 M3를 사용해야 할 때는 언제인가요?
매우 긴 입력값이 필요하거나 더 복잡한 에이전트 계획 수립이 필요할 때 M3를 선택하십시오. 추론의 깊이보다 각 턴의 응답 속도가 더 중요할 때는 고속 M2.x 변형 모델을 선택하십시오.
MiniMax-M3 의 가격은 얼마인가요?
TokenLab 에서 MiniMax-M3 은 입력 $0.30 / 출력 $1.20 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
MiniMax-M3의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?
MiniMax-M3은 최대 1,048,576 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 524,288 토큰까지 출력합니다.
MiniMax-M3 은 어떤 엔드포인트를 써야 하나요?
MiniMax-M3에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
MiniMax-M3 은 어떤 오퍼레이션을 지원하나요?
MiniMax-M3은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
MiniMax-M3 비교하기
출처
2026. 10. 2. 검토 완료