DeepSeek: DeepSeek V4 Pro
deepseek-v4-pro- 입력 / 출력
- $0.66 / $1.98
- 컨텍스트
- 1M
- 출시일
- 2026년 4월 24일
- 최대 출력
- 384K
- 모달리티
- 채팅
- 기능
- 도구 사용프롬프트 캐시추론
DeepSeek V4 Pro 소개
DeepSeek V4 Pro는 DeepSeek V4 세대의 대형 모델로, 총 1.6T 파라미터와 49B 활성 파라미터를 가진 오픈 웨이트 혼합 전문가(MoE) 모델입니다. DeepSeek는 이 모델을 에이전트형 코딩, 수학, STEM 추론 및 광범위한 세계 지식 분야에서 폐쇄형 최첨단 모델들과 경쟁하도록 설계했습니다. 사고 모드와 비사고 모드, 세 가지 노력 수준, 도구 호출 및 JSON 출력을 지원하며 텍스트만 읽을 수 있습니다.
강점
- DeepSeek는 이 모델을 에이전트형 코딩 벤치마크에서 오픈 소스 최첨단 모델로 평가하며, 세계 지식 능력은 Gemini 3.1 Pro에 이어 두 번째라고 밝히고 있습니다.
- 사고 모드는 낮음, 높음, 최대 노력 수준을 지원하므로, 어려운 수학, STEM 및 디버깅 문제에 일상적인 문제보다 훨씬 더 많은 추론을 할당할 수 있습니다.
- 도구 호출, JSON 출력 및 프롬프트 캐싱을 지원하여 긴 시스템 프롬프트를 반복하는 에이전트 루프에 적합합니다.
- 가중치가 공개되어 있어 자체 호스팅을 하는 팀은 도입 전 동일한 모델 제품군을 평가할 수 있습니다.
다른 모델이 필요한 경우
- 텍스트만 읽을 수 있습니다. 스크린샷 및 다이어그램 작업은 deepseek-v4.1-flash 또는 Flash vision-exp 변형 모델이 필요합니다.
- V4 모델 중 더 무거운 모델이므로, 추가적인 추론 깊이가 필요 없는 작업에는 V4 Flash가 더 빠르게 응답합니다.
- 최대 노력 수준은 긴 추론 과정을 생성하여 지연 시간과 토큰 사용량을 늘리며, 도구 대화 시 매번 추론 텍스트를 다시 전달해야 합니다.
시작하기
API 키 만들기
Console에서 키를 만들고 플랫폼의 모든 모델에 사용하세요.
첫 번째 요청 보내기
사용 중인 언어의 예시를 복사하여 엔드포인트에 실행하세요.
텍스트-텍스트Responses APIPOST/v1/responsesAPI 형식:curl https://api.tokenlab.sh/v1/responses \ -H "Content-Type: application/json" \ -H "Authorization: Bearer sk-xxx" \ -d '{ "model": "deepseek-v4-pro", "input": "Hello!" }'
가격 책정
Verified는 TokenLab 가격이 적용되어 대부분의 모델에서 더 저렴합니다. Official은 제조사가 책정한 공식 가격으로 더 안정적인 경로를 제공합니다. Auto는 요청을 완료한 경로의 가격으로 자동 청구합니다.
요금 시간대 · 비피크 시간대
1M Token 당- Official 가격
- 입력 $0.66 / 출력 $1.98 / 캐시 읽기 $0.022 / 캐시 쓰기 $0.66
- Official
- 입력 $0.66 / 출력 $1.98 / 캐시 읽기 $0.022 / 캐시 쓰기 $0.66
- 할인
- —
요금 시간대 · 피크 시간대
1M Token 당- Official 가격
- 입력 $1.32 / 출력 $3.96 / 캐시 읽기 $0.044 / 캐시 쓰기 $1.32
- Official
- 입력 $1.32 / 출력 $3.96 / 캐시 읽기 $0.044 / 캐시 쓰기 $1.32
- 할인
- —
캐시 읽기
- Official 가격
- $0.022
- Official
- $0.022
- 할인
- —
캐시 쓰기
- Official 가격
- $0.66
- Official
- $0.66
- 할인
- —
| Official 가격1M Token 당 | Official1M Token 당 | 할인 | |
|---|---|---|---|
| 요금 시간대 · 비피크 시간대 | 입력 $0.66 / 출력 $1.98 / 캐시 읽기 $0.022 / 캐시 쓰기 $0.66 | 입력 $0.66 / 출력 $1.98 / 캐시 읽기 $0.022 / 캐시 쓰기 $0.66 | — |
| 요금 시간대 · 피크 시간대 | 입력 $1.32 / 출력 $3.96 / 캐시 읽기 $0.044 / 캐시 쓰기 $1.32 | 입력 $1.32 / 출력 $3.96 / 캐시 읽기 $0.044 / 캐시 쓰기 $1.32 | — |
| 프롬프트 캐시 가격 | |||
| 캐시 읽기 | $0.022 | $0.022 | — |
| 캐시 쓰기 | $0.66 | $0.66 | — |
사용량 및 활동
성공률은 완료된 요청의 비율입니다. 지연 시간은 전체 응답에 걸리는 시간이며, P95는 요청의 95%가 해당 시간 내에 완료되었음을 의미합니다.
사용량 및 가용성
지난 24시간- 요청
- 성공률
- P95 지연 시간
- 총 토큰
- 30일 성공률
- 99.9%
- 30일 요청 수
- 100+
- 마지막 활동
- 3시간 전
데이터는 상태 확인을 제외한 집계된 사용자 요청을 기반으로 합니다.
Console에서 열기
Console에서 DeepSeek V4 Pro을 열고 프롬프트를 수정하거나 전송하세요.
/v1/responses에서 deepseek-v4-pro로 짧은 메시지를 테스트합니다. 응답, 지연 시간, 비용을 확인하세요.
사용 사례
적합한 용도- 추론
자율 코딩 에이전트
터미널이나 IDE 에이전트에서 계획자로 실행하여 긴 세션 동안 여러 파일을 편집하고, 테스트를 실행하며, 실패에 대응하게 하세요.
고난도 기술 추론
증명, 알고리즘 설계, 과학적 유도 또는 까다로운 동시성 버그를 해결할 때 최종 단계에서 추론 노력을 최대로 설정하세요.
지식 집약적 질의응답
표준 비교나 두 기술의 상호작용 설명과 같이 여러 분야에 걸친 광범위한 사실적 기억이 필요한 질문을 하세요.
Flash 이후의 에스컬레이션 계층
일상적인 요청은 V4 Flash로 보내고, 검증에 실패하거나 더 깊은 분석이 필요한 경우에만 Pro 모델로 전달하세요.
프롬프트 예제
이 백엔드는 부하가 걸리면 교착 상태에 빠집니다. 스레드 덤프와 두 개의 잠금 획득 모듈이 첨부되어 있습니다. 순서 문제를 찾아 패치를 작성하세요.
아래 알고리즘이 종료됨을 증명하고 최악의 경우 복잡도를 명시한 뒤, 논리를 깨뜨리는 입력값이 있다면 지적하세요.
REST 핸들러에서 새 게이트웨이로의 마이그레이션을 계획하고, 영향을 받는 모듈을 순서대로 나열한 뒤 셸 도구를 사용하여 각 단계마다 테스트를 실행하세요.
이 모델은 조건부 요금제입니다. 월간 토큰 총량만으로는 신뢰할 수 있는 견적을 낼 수 없습니다. 요청 사양, 캐시, 해당 시간대에 맞는 상세 요금을 사용하세요.
FAQ
DeepSeek V4 Pro는 언제 V4 Flash 대신 사용해야 하나요?
에이전트형 코딩, 어려운 추론 및 광범위한 사실 지식이 필요한 질문에는 Pro를 사용하세요. DeepSeek는 Flash도 추론과 간단한 에이전트 작업에서 근접한 성능을 보인다고 설명하므로, Flash가 작업을 잘못 처리하거나 실수가 치명적인 경우에 Pro를 사용하는 것이 중요합니다.
DeepSeek V4 Pro의 사고 노력 수준은 어떻게 작동하나요?
사고 기능을 활성화하고 낮음, 높음, 최대 중 선택할 수 있습니다. 높음이 기본값으로 일상적인 에이전트 작업에 적합하며, 낮음은 간단한 작업에, 최대는 가장 복잡한 문제에 적합합니다. 노력이 높을수록 더 많은 추론 텍스트가 생성되며 답변까지 더 오래 기다려야 합니다.
DeepSeek V4 Pro는 오픈 소스인가요?
DeepSeek는 V4 세대를 오픈 웨이트로 출시했으며, Pro 모델은 토큰당 49B 활성 파라미터를 포함해 총 1.6T 파라미터를 가집니다. API를 통해 호출할 때는 별도의 호스팅이 필요 없으며, 오픈 출시는 평가나 자체 호스팅을 원하는 경우에 의미가 있습니다.
DeepSeek V4 Pro는 이미지를 입력받을 수 있나요?
아니요. 텍스트만 읽고 쓸 수 있습니다. DeepSeek는 별도의 Flash 기반 모델을 통해 이미지 이해 기능을 제공하므로, 스크린샷과 고난도 추론이 모두 필요한 워크플로우는 두 모델에 걸쳐 단계를 나누어야 합니다.
DeepSeek V4 Pro는 OpenAI SDK나 Anthropic SDK와 호환되나요?
둘 다 호환됩니다. DeepSeek는 OpenAI 및 Anthropic API 형식과의 호환성을 지원하므로, 기존 클라이언트를 유지하면서 모델 이름과 기본 URL만 변경하여 사용할 수 있습니다.
DeepSeek V4 Pro 의 가격은 얼마인가요?
TokenLab 에서 DeepSeek V4 Pro 은 입력 $0.66 / 출력 $1.98 1M Token 당 입니다. 자세한 내역은 위 가격 표를 확인하세요. 요금은 청구 단위, 사양, 사용량에 따라 달라집니다. 모델의 상세 요금에서 동일한 조건끼리 비교하세요. 단일 요금으로 총비용이 결정되지 않습니다.
DeepSeek V4 Pro의 컨텍스트 윈도우와 출력 제한은 어떻게 되나요?
DeepSeek V4 Pro은 최대 1,000,000 토큰의 컨텍스트를 지원하며, 한 번의 응답으로 최대 384,000 토큰까지 출력합니다.
DeepSeek V4 Pro 은 어떤 엔드포인트를 써야 하나요?
DeepSeek V4 Pro에 대해 https://api.tokenlab.sh/v1/responses를 사용하세요. 아래 요청 예시는 일치하는 코드 형태를 보여줍니다.
DeepSeek V4 Pro 은 어떤 오퍼레이션을 지원하나요?
DeepSeek V4 Pro은(는) 텍스트-텍스트을(를) 지원합니다. 엔드포인트와 요청 예시를 보려면 위에서 작업을 선택하세요.
DeepSeek V4 Pro 비교하기
DeepSeek V4 Pro 활용 가이드
출처
2026. 10. 2. 검토 완료