xAI: Grok 4.20
grok-4.20- 입력 / 출력-50%
- $1.25 / $2.50$0.625 / $1.25
- 컨텍스트
- 1M
- 최대 출력
- 128K
- 모달리티
- 비전채팅
- 기능
- 도구 사용프롬프트 캐시추론
Grok 4.20 소개
Grok 4.20은 매우 긴 입력에 대한 도구 호출 워크플로우를 위해 구축된 xAI의 추론 가능 모델(4.20 제품군)입니다. 텍스트와 이미지를 읽고 텍스트를 작성하며, 답변하기 전에 사고 과정을 거치는데, 이는 같은 제품군 내의 비추론 모델이나 멀티 에이전트 모델과 차별화되는 점입니다. 여러 문서, 스크린샷, 중간 도구 결과물을 종합해야 하는 답변이 필요할 때 이 모델을 선택하십시오.
강점
- 답변하기 전에 문제를 추론하므로, 다단계 질문에 대해 첫 번째 추측이 아닌 작업된 답변을 제공합니다.
- 텍스트와 함께 이미지를 허용하므로, 한 대화에서 스크린샷, 차트, 작성된 자료를 혼합하여 사용할 수 있습니다.
- 도구를 호출하고 구조화된 JSON을 반환하므로, 에이전트 루프나 추출 파이프라인 내에서 사용할 수 있습니다.
- 매우 긴 대화 기록을 처리할 수 있어, 여러 차례에 걸쳐 증거를 수집하는 조사에 유용합니다.
- 프롬프트 캐싱을 통해 요청 간에 대규모 공유 접두사를 다시 보낼 때 발생하는 비용을 절감합니다.
다른 모델이 필요한 경우
- 사고 단계는 지연 시간을 추가합니다. 단순한 초안 작성이나 추출 작업의 경우, 비추론 4.20 변형 모델이 더 빠르게 답변합니다.
- 4.7과 같은 최신 Grok 릴리스는 코딩 및 에이전트 작업을 더 직접적으로 겨냥하며, 어려운 소프트웨어 작업에서 더 나은 성능을 보일 수 있습니다.
- 출력은 텍스트 전용이므로 이미지, 오디오, 비디오를 생성할 수 없습니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트-텍스트Responses APIPOST/v1/responsesAPI 형식:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20", "input": "Hello!" }'
가격 책정
Official 가격은 모델 제작사의 공식 기본 가격입니다. TokenLab 가격은 TokenLab에서 이 모델을 사용할 때 지불하는 금액입니다.
입력 토큰 <= 200K
1M Token 당- Official 가격
- 입력 $1.25 / 출력 $2.50 / 캐시 읽기 $0.20
- TokenLab 가격
- 입력 $0.625 / 출력 $1.25 / 캐시 읽기 $0.10
- 할인
- -50%
입력 토큰 > 200K
1M Token 당- Official 가격
- 입력 $2.50 / 출력 $5.00 / 캐시 읽기 $0.40
- TokenLab 가격
- 입력 $1.25 / 출력 $2.50 / 캐시 읽기 $0.20
- 할인
- -50%
캐시 읽기
- Official 가격
- $0.20
- TokenLab 가격
- $0.10
- 할인
- -50%
| Official 가격1M Token 당 | TokenLab 가격1M Token 당 | 할인 | |
|---|---|---|---|
| 입력 토큰 <= 200K | 입력 $1.25 / 출력 $2.50 / 캐시 읽기 $0.20 | 입력 $0.625 / 출력 $1.25 / 캐시 읽기 $0.10 | -50% |
| 입력 토큰 > 200K | 입력 $2.50 / 출력 $5.00 / 캐시 읽기 $0.40 | 입력 $1.25 / 출력 $2.50 / 캐시 읽기 $0.20 | -50% |
| 프롬프트 캐시 가격 | |||
| 캐시 읽기 | $0.20 | $0.10 | -50% |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 Grok 4.20을 열고 프롬프트를 수정하거나 전송하세요.
/v1/responses에서 grok-4.20로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.
사용 사례
적합한 용도- 추론
- 비전
증거 기반 조사
사건이나 감사 중에 수집된 보고서, 내보내기 파일, 스크린샷을 입력하고, 추론된 타임라인과 남아 있는 미해결 질문을 요청하십시오.
도구를 사용하는 에이전트 루프
검색, 데이터베이스 또는 티켓팅 기능을 제공하고 모델이 호출할 기능을 결정하게 한 뒤, 결과를 읽고 질문이 해결될 때까지 계속하게 하십시오.
복잡한 입력으로부터의 구조화된 추출
스캔된 양식, 송장 또는 채팅 로그를 고정된 JSON 스키마로 변환하며, 추론 단계가 모호한 항목을 처리하는 데 도움을 줍니다.
프롬프트 예제
세 개의 로그 내보내기 파일과 대시보드 스크린샷이 이어집니다. 중단 사태의 타임라인을 구축하고 로그와 모순되는 내용을 표시하십시오.
이 송장 이미지에서 공급업체, 날짜, 품목, 세금을 아래 스키마와 일치하는 JSON으로 추출하십시오. 확신할 수 없는 필드는 표시하십시오.
search_orders 및 get_customer를 호출할 수 있습니다. 고객이 주문 8812에서 두 개의 품목이 누락되었다고 합니다. 무엇을 확인해야 할지, 어떤 순서로 진행할지 계획을 세우십시오.
이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.
FAQ
Grok 4.20이란 무엇인가요?
Grok 4.20은 텍스트와 이미지를 입력받아 텍스트로 답변하는 xAI의 채팅 모델입니다. 이 모델은 해당 제품군의 추론 버전으로, 답변하기 전에 문제를 해결하는 과정을 거칩니다. xAI는 동일한 생성 모델을 비추론 및 멀티 에이전트 형태로도 제공합니다.
grok-4.20과 grok-4.20-non-reasoning은 어떻게 다른가요?
기본 ID는 답변하기 전에 추론하는 데 시간을 소비하는 반면, 비추론 ID는 즉시 답변합니다. 여러 단계의 분석이 필요한 질문에는 기본 ID를 사용하고, 속도가 깊이보다 중요한 초안 작성, 추출, 채팅에는 비추론 모델을 사용하십시오.
Grok 4.20이 이미지를 읽을 수 있나요?
네. 스크린샷, 차트, 사진으로 찍은 문서 등 텍스트와 함께 이미지를 보내고 같은 대화 내에서 질문할 수 있습니다. 답변은 텍스트로 제공되며, 모델이 이미지를 생성하거나 편집하지는 않습니다.
Grok 4.20은 도구 호출과 JSON 출력을 지원하나요?
네. 함수 호출과 구조화된 JSON 응답을 지원하므로, 자체 함수에 연결하거나 답변을 특정 스키마에 맞출 수 있습니다. 따라서 추출 작업이나 외부 시스템에서 작동하는 에이전트에 사용할 수 있습니다.
기존의 OpenAI 스타일 클라이언트를 Grok 4.20과 함께 사용할 수 있나요?
네. 기존 OpenAI 스타일 클라이언트 코드는 모델 이름만 변경하면 작동하며, 도구 정의와 JSON 스키마는 현재 사용 중인 필드를 그대로 사용합니다.
Grok 4.20 의 가격은 얼마인가요?
TokenLab 에서 Grok 4.20 은 입력 $0.625 / 출력 $1.25 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
Grok 4.20의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?
Grok 4.20은 최대 1,000,000 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 131,072 토큰까지 출력합니다.
Grok 4.20 은 어떤 엔드포인트를 써야 하나요?
Grok 4.20에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
Grok 4.20 은 어떤 오퍼레이션을 지원하나요?
Grok 4.20은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
Grok 4.20 비교하기
출처
2026. 10. 2. 검토 완료