미디어 가이드
비디오 생성
명시적인 공개 작업, 비동기 폴링 및 모델별 미디어 입력으로 비디오를 생성합니다.
비디오 생성은 비동기입니다. POST /v1/videos/generations는 공개 작업 ID를 반환하며 일반적으로 poll_url을 포함합니다; 최종 비디오는 이후 상태 응답에서 나타납니다.
선택한 모델이 지원하는 이미지 필드에 공개 HTTP(S) URL 또는 지원되는 data URL을 넣을 수 있습니다. 일반 미디어 입력으로 처리되며 재사용 소재 ID를 자동으로 만들지 않습니다.
명시한 소재가 준비 중이면 POST /v1/videos/generations가 409 seedance_material_preparing과 inactive_asset_ids를 반환합니다. 소재가 ACTIVE가 될 때까지 조회한 뒤 같은 ID로 재시도하세요. FAILED라면 먼저 error_message에 따라 수정하거나 다시 가져오세요.
모델 세부정보
생산 환경에서는 명시적인 operation을 사용하십시오. TokenLab은 입력에서 일부 작업을 유추할 수 있지만, 명시적인 작업 값은 검증, 지원 및 재시도를 더 명확하게 만듭니다.
| 작업 | 필수 또는 일반 입력 | 사용 사례 |
|---|---|---|
text-to-video | prompt | 텍스트만으로 생성 |
image-to-video | image_url 또는 호환 가능한 image | 시작 이미지를 애니메이션화 |
reference-to-video | reference_images 및 선택적 video_urls / audio_urls (지원되는 모델에서) | 정체성, 스타일 또는 자산 참조 유지 |
start-end-to-video | start_image, end_image | 첫 번째 및 마지막 프레임 제어 |
video-to-video | video_url 또는 모델별 task_id | 기존 클립 변환 또는 업스케일 |
motion-control | image_url 및 video_url | 주제에 모션 참조 적용 |
audio-to-video | audio_url | 오디오 조건 비디오 흐름 |
video-extension | task_id, extend_at 또는 모델별 확장 필드 | 생성된 비디오 계속하기 |
모델 발견
curl "https://api.tokenlab.sh/v1/models?recommended_for=video" \
-H "Authorization: Bearer sk-your-api-key"model에는 TokenLab에 표시되는 모델 ID를 사용하고, 기능 변형은 operation과 해당 미디어 입력으로 선택하세요. 예: wan-2.7, happyhorse-1.0, viduq3, viduq3-mix, pixverse-v6, veo3.1, seedance-2.0. 작업별 접미사를 TokenLab 모델명으로 사용하지 마세요.
reference_images, kling_elements, output_audio, duration, resolution, 또는 aspect_ratio와 같은 전문 필드에 의존하기 전에 선택한 모델 세부정보를 읽으십시오.
요청 생성
curl https://api.tokenlab.sh/v1/videos/generations \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "veo3.1",
"operation": "text-to-video",
"prompt": "햇빛이 비치는 정원을 걷는 고양이의 차분한 영화 장면",
"duration": 4,
"aspect_ratio": "16:9"
}'프로덕션 미디어 입력에는 인라인 data: URL보다 공개 https URL을 권장합니다. 임시 URL을 사용하는 경우 TokenLab이 작업 생성을 완료할 때까지 유효하게 유지하세요.
입력 및 모델별 필드
오디오 동작은 선택한 모델과 작업에 따라 다릅니다. 오디오 스위치가 없어도 영상에 소리가 포함될 수 있습니다. 생략과 false 지정은 다릅니다.
veo3.1과veo3.1-fast는 Gemini API 계약에 따라 항상 오디오를 생성합니다.wan-2.6과wan-2.7의 영상 생성도 오디오를 끌 수 없습니다.output_audio를 생략하거나 모델 상세에서 허용하면true로 설정하세요.hailuo-h3와 Grok 영상 모델은 오디오를 기본 생성합니다. 모델 상세에 없는 오디오 스위치를 추가하지 마세요.- Seedance 1.5/2.x와
viduq3-pro/viduq3-turbo는 오디오가 기본으로 켜지며 무음 출력도 지원합니다. PixVerse C1/V5.6/V6는 기본으로 꺼집니다.output_audio는 해당 필드를 명시한 작업에서만 사용하세요. Vidu는 계약에 선언된 불리언audio도 허용합니다. audio_url/audio_urls는 입력 또는 참조 오디오이며 출력 오디오 스위치가 아닙니다. 영상 편집, 동작 전이, 스타일 변환은 입력 음원을 유지할 수 있습니다. 원본 오디오 유지는 음소거가 아닙니다.
허용 값과 오디오별 가격은 모델 상세를 확인하세요. 지원되는 별칭 outputAudio, generate_audio, 불리언 audio를 output_audio와 함께 쓰면 값이 같아야 합니다. 같은 계열도 버전과 작업마다 제어가 다를 수 있습니다.
- Seedance 2.0 패밀리의 4K 출력, Fast/Mini 해상도 제한, 멀티모달 참조 입력을 사용하기 전에 Seedance 2.0 비디오 모델 가이드를 읽으세요.
grok-imagine-video의 video-to-video에는prompt와 공개 HTTPS.mp4video_url을 보냅니다. 이 작업은duration,resolution,aspect_ratio옵션을 사용하지 않습니다.
PixVerse 및 HappyHorse
| 모델 | 작업 | 입력 | 해상도 | 지속 시간 | 오디오 선택기 |
|---|---|---|---|---|---|
pixverse-c1, pixverse-v6 | text-to-video, image-to-video, start-end-to-video, reference-to-video | prompt; image_url; start_image + end_image; reference_images | 360p, 540p, 720p, 1080p | 1초에서 15초 사이의 정수 | output_audio, 기본값 false |
pixverse-v5.6 | text-to-video, image-to-video, start-end-to-video, reference-to-video | C1 및 V6와 동일한 필드 | 360p, 540p, 720p, 1080p | 5초, 8초 또는 10초; 1080p는 5초 또는 8초 지원 | output_audio, 기본값 false |
happyhorse-1.0 | text-to-video, image-to-video, reference-to-video, video-to-video | prompt; image_url; reference_images; video_url + reference_images | 720p, 1080p | 생성 작업의 경우 3초에서 15초; video-to-video 출력은 최대 15초로 제한됨 | output_audio를 전송하지 마십시오 |
TokenLab에서 위의 PixVerse 모델은 operation=video-extension을 허용하지 않습니다.
curl https://api.tokenlab.sh/v1/videos/generations \
-H "Authorization: Bearer sk-your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "pixverse-v6",
"operation": "image-to-video",
"prompt": "A slow camera move through a neon-lit street",
"image_url": "https://example.com/start.jpg",
"resolution": "1080p",
"duration": 5,
"output_audio": true
}'결과 폴링
반환된 poll_url을 먼저 사용하십시오. 고정 엔드포인트가 필요한 경우, 생성 응답에서 동일한 id / task_id로 GET /v1/tasks/{id}를 사용하십시오.
완료된 비디오 작업은 모델 및 출력 수에 따라 video_url, video 또는 videos를 반환할 수 있습니다. billing_transaction_id는 작업 식별자가 아닌 청구 식별자로 취급하십시오.
일반적인 함정
- 오래된 비디오 상태 경로를 하드코딩하지 마십시오;
poll_url을 선호하십시오. - 모델 계약이 허용하지 않는 한 첫 번째 프레임 필드를 전용 참조 이미지 흐름과 결합하지 마십시오.
duration이 입력 참조 비디오 길이를 설명한다고 가정하지 마십시오; 일반적으로 생성된 출력 길이를 제어합니다.- 타임아웃 후 작업이 이미 생성되었는지 확인하지 않고 생성 요청을 재시도하지 마십시오.
API 참조
| 주제 | 참조 |
|---|---|
| 비디오 생성 | 비디오 생성 |
| 비디오 상태 가져오기 | 비디오 상태 가져오기 |
| 작업 상태 가져오기 | 작업 상태 가져오기 |
| 작업 취소 | 작업 취소 |
| 청구 및 가격 책정 | 청구 및 가격 책정 |
OpenAI 스타일 및 Volc 호환 비디오 API
모델 전반의 TokenLab 통합 비디오 API에는 /v1/videos/generations를 사용하세요. 기존 Seedance 2.0 통합이 Volc 스타일 content[] 또는 Action 요청을 이미 사용한다면 /api/v3 아래의 Seedance 호환 엔드포인트를 사용할 수 있습니다. 두 방식 모두 TokenLab Bearer API Key와 비동기 폴링을 사용하지만 요청과 응답 형식은 다릅니다.
Hailuo H3-Max는 텍스트, 첫 프레임 또는 첫 프레임과 마지막 프레임으로 480p 또는 768p의 5~15초 동영상을 생성합니다. 빠른 생성에 초점을 맞춰 장면 아이디어를 짧은 영상으로 신속하게 구현하는 데 적합합니다.
{
"model": "hailuo-h3-max",
"operation": "text-to-video",
"prompt": "A slow camera move through a quiet garden",
"resolution": "768p",
"duration": 5,
"aspect_ratio": "16:9"
}