xAI: Grok 4.20 Non-Reasoning
grok-4.20-non-reasoning- 입력 / 출력-50%
- $1.25 / $2.50$0.625 / $1.25
- 컨텍스트
- 1M
- 최대 출력
- 128K
- 모달리티
- 비전채팅
- 기능
- 도구 사용프롬프트 캐시
Grok 4.20 Non-Reasoning 소개
Grok 4.20 Non-Reasoning은 xAI 4.20 모델의 직접 답변 버전입니다. 확장된 사고 단계를 건너뛰므로 텍스트 및 이미지 프롬프트에 빠르게 응답하며, 초안 작성, 정보 추출, 도구 지원 채팅에 적합합니다. xAI는 이 모델이 엄격한 프롬프트 준수와 낮은 환각률을 결합했다고 설명합니다. 문제가 심도 있는 분석을 필요로 할 때는 추론형 또는 멀티 에이전트 변형 모델을 선택하십시오.
강점
- 별도의 사고 단계 없이 응답하므로 대화형 채팅 및 대량 작업 시 지연 시간이 낮게 유지됩니다.
- xAI는 이 모델의 엄격한 프롬프트 준수와 낮은 환각률을 강조하며, 이는 출력이 특정 템플릿을 따라야 할 때 유용합니다.
- 추출 파이프라인 및 도구 기반 어시스턴트를 위한 함수 호출과 구조화된 JSON 출력을 지원합니다.
- 텍스트와 함께 이미지를 입력받을 수 있어 영수증이나 스크린샷을 읽고 한 번에 답변할 수 있습니다.
- 프롬프트 캐싱은 많은 요청이 동일한 긴 지침이나 참조 텍스트를 재사용할 때 도움이 됩니다.
다른 모델이 필요한 경우
- 추론 단계가 없으므로 다단계 논리나 수학 문제에서는 grok-4.20이나 grok-4.7보다 성능이 낮습니다.
- 작업을 에이전트 간에 분할하지 않으므로, 개방형 연구에는 멀티 에이전트 변형 모델이 더 적합합니다.
- 출력은 텍스트 전용이며 이미지, 오디오, 비디오 생성은 지원하지 않습니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트-텍스트Responses APIPOST/v1/responsesAPI 형식:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "grok-4.20-non-reasoning", "input": "Hello!" }'
가격 책정
Official 가격은 모델 제작사의 공식 기본 가격입니다. TokenLab 가격은 TokenLab에서 이 모델을 사용할 때 지불하는 금액입니다.
기본 사양
1M Token 당- Official 가격
- 입력 $1.25 / 출력 $2.50 / 캐시 읽기 $0.20
- TokenLab 가격
- 입력 $0.625 / 출력 $1.25 / 캐시 읽기 $0.10
- 할인
- -50%
캐시 읽기
- Official 가격
- $0.20
- TokenLab 가격
- $0.10
- 할인
- -50%
| Official 가격1M Token 당 | TokenLab 가격1M Token 당 | 할인 | |
|---|---|---|---|
| 기본 사양 | 입력 $1.25 / 출력 $2.50 / 캐시 읽기 $0.20 | 입력 $0.625 / 출력 $1.25 / 캐시 읽기 $0.10 | -50% |
| 프롬프트 캐시 가격 | |||
| 캐시 읽기 | $0.20 | $0.10 | -50% |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 Grok 4.20 Non-Reasoning을 열고 프롬프트를 수정하거나 전송하세요.
/v1/responses에서 grok-4.20-non-reasoning로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.
사용 사례
적합한 용도- 비전
고객 응대용 채팅
긴 사고 단계를 기다리게 하지 않으면서, 필요할 때 조회 함수를 호출하여 일관된 어조로 제품 및 계정 관련 질문에 답변합니다.
대량 문서 추출
엄격한 지침 준수를 통해 필드 일관성을 유지하며, 수천 개의 계약서, 양식 또는 이메일을 고정된 JSON 스키마에 따라 처리합니다.
초안 작성 및 수정
요청된 형식으로 이메일, 요약, 릴리스 노트의 초안을 작성한 뒤, 짧은 후속 지침을 통해 내용을 다듬습니다.
프롬프트 예제
이 지원 스레드를 3개의 글머리 기호와 1개의 제안된 답변으로 요약하세요. 답변은 80단어 미만으로 유지하고 환불을 약속하지 마세요.
이 계약서에서 당사자 이름, 발효일, 해지 통지 기간을 추출하여 아래 JSON 스키마에 넣으세요. 누락된 항목은 null로 반환하세요.
비기술직 고객을 위해 이 변경 로그를 다시 작성하세요. 제목은 유지하고 내부 티켓 번호는 삭제하며 평이한 문장을 사용하세요.
이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.
FAQ
Grok 4.20 Non-Reasoning이란 무엇인가요?
먼저 생각하는 대신 직접 답변하는 xAI Grok 4.20 버전입니다. 텍스트와 이미지를 읽고 텍스트를 작성하며, 함수 호출과 구조화된 출력을 지원합니다. 추출, 초안 작성, 도구 지원 채팅과 같이 지침이 많고 빠른 작업에 최적화되어 있습니다.
grok-4.20 대신 non-reasoning 모델을 언제 사용해야 하나요?
작업이 명확하고 답변이 주로 정보 회상, 다시 쓰기, 서식 지정인 경우에 사용하세요. 추론형 ID보다 더 빨리 응답합니다. 디버깅이나 계획 수립과 같이 여러 단계의 분석이 필요한 답변이 필요할 때는 grok-4.20으로 전환하세요.
Grok 4.20 Non-Reasoning은 JSON 스키마를 따르나요?
네. 구조화된 출력을 지원하므로 스키마를 제공하면 그에 맞는 응답을 받을 수 있습니다. xAI의 엄격한 프롬프트 준수 강조와 결합되어, 추출 및 분류 작업의 합리적인 기본 모델이 됩니다.
이미지 입력을 받을 수 있나요?
네, 촬영된 양식이나 UI 스크린샷과 같은 이미지를 텍스트와 함께 보낼 수 있습니다. 응답은 텍스트로 제공됩니다. 모델이 이미지를 생성하거나 편집할 수는 없습니다.
기존 OpenAI 스타일 클라이언트와 작동하나요?
네. 기존 OpenAI 스타일 클라이언트 코드는 모델 이름만 변경하면 작동하며, 도구 정의와 JSON 스키마는 이전과 동일하게 일반 필드로 전송됩니다.
Grok 4.20 Non-Reasoning 의 가격은 얼마인가요?
TokenLab 에서 Grok 4.20 Non-Reasoning 은 입력 $0.625 / 출력 $1.25 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
Grok 4.20 Non-Reasoning의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?
Grok 4.20 Non-Reasoning은 최대 1,000,000 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 131,072 토큰까지 출력합니다.
Grok 4.20 Non-Reasoning 은 어떤 엔드포인트를 써야 하나요?
Grok 4.20 Non-Reasoning에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
Grok 4.20 Non-Reasoning 은 어떤 오퍼레이션을 지원하나요?
Grok 4.20 Non-Reasoning은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
Grok 4.20 Non-Reasoning 비교하기
출처
2026. 10. 2. 검토 완료