TokenLab

Hướng dẫn media

Tạo Video

Tạo video với các thao tác công khai rõ ràng, polling bất đồng bộ và đầu vào phương tiện cụ thể cho mô hình.

Việc tạo video là bất đồng bộ. POST /v1/videos/generations trả về một danh tính tác vụ công khai và thường là một poll_url; video cuối cùng sẽ xuất hiện trong các phản hồi trạng thái sau.

Gửi URL HTTP(S) công khai hoặc data URL được hỗ trợ trong trường hình ảnh của mô hình đã chọn. Các đầu vào này được xử lý như media thông thường và không tự tạo ID material tái sử dụng.

Nếu material được chỉ định rõ vẫn đang chuẩn bị, POST /v1/videos/generations trả 409 seedance_material_preparing cùng inactive_asset_ids. Kiểm tra tài nguyên đến khi ACTIVE, rồi thử lại bằng cùng ID. Nếu FAILED, xem error_message và sửa hoặc nhập lại trước khi thử lại.

Các thao tác được hỗ trợ

Sử dụng operation rõ ràng trong sản xuất. TokenLab có thể suy luận một số thao tác từ đầu vào, nhưng các giá trị thao tác rõ ràng giúp việc xác thực, hỗ trợ và thử lại trở nên rõ ràng hơn.

Thao tácĐầu vào yêu cầu hoặc điển hìnhTrường hợp sử dụng
text-to-videopromptTạo từ văn bản chỉ
image-to-videoimage_url hoặc image tương thíchHoạt hình một hình ảnh bắt đầu
reference-to-videoreference_images và tùy chọn video_urls / audio_urls trên các mô hình hỗ trợGiữ danh tính, phong cách hoặc tham chiếu tài sản
start-end-to-videostart_image, end_imageKiểm soát khung hình đầu tiên và cuối cùng
video-to-videovideo_url hoặc task_id cụ thể cho mô hìnhBiến đổi hoặc nâng cấp một clip hiện có
motion-controlimage_url cộng với video_urlÁp dụng tham chiếu chuyển động cho một đối tượng
audio-to-videoaudio_urlDòng video điều kiện âm thanh
video-extensiontask_id, extend_at, hoặc các trường mở rộng cụ thể cho mô hìnhTiếp tục một video đã được tạo

Khám Phá Mô Hình

curl "https://api.tokenlab.sh/v1/models?recommended_for=video" \
  -H "Authorization: Bearer sk-your-api-key"

Dùng model ID hiển thị trong TokenLab ở model, sau đó chọn biến thể tính năng bằng operation và đầu vào media tương ứng. Ví dụ gồm wan-2.7, happyhorse-1.0, viduq3, viduq3-mix, pixverse-v6, veo3.1, và seedance-2.0; không dùng hậu tố riêng của operation làm tên model TokenLab.

Đọc chi tiết mô hình đã chọn trước khi dựa vào các trường chuyên biệt như reference_images, kling_elements, output_audio, duration, resolution, hoặc aspect_ratio.

Tạo Yêu Cầu

curl https://api.tokenlab.sh/v1/videos/generations \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "veo3.1",
    "operation": "text-to-video",
    "prompt": "Một cảnh quay điện ảnh bình yên của một con mèo đi bộ qua một khu vườn ngập nắng",
    "duration": 4,
    "aspect_ratio": "16:9"
  }'

Đối với đầu vào phương tiện trong sản xuất, hãy ưu tiên URL https công khai thay vì URL data: nội tuyến. Nếu dùng URL tạm thời, hãy giữ URL hợp lệ cho đến khi TokenLab tạo xong tác vụ.

Đầu Vào Và Các Trường Cụ Thể Cho Mô Hình

Hành vi âm thanh phụ thuộc vào mô hình và thao tác. Video vẫn có thể có tiếng dù không cung cấp công tắc âm thanh. Bỏ qua tham số khác với gửi false.

  • veo3.1 và veo3.1-fast luôn tạo âm thanh theo hợp đồng Gemini API. Tạo video bằng wan-2.6 và wan-2.7 cũng không hỗ trợ tắt tiếng. Bỏ qua output_audio hoặc dùng true nếu chi tiết mô hình cho phép.
  • hailuo-h3 và các mô hình video Grok tạo âm thanh gốc. Không thêm công tắc không được liệt kê trong chi tiết mô hình.
  • Seedance 1.5/2.x và viduq3-pro / viduq3-turbo bật âm thanh mặc định và hỗ trợ đầu ra im lặng. PixVerse C1/V5.6/V6 tắt âm thanh mặc định. Chỉ dùng output_audio cho thao tác có khai báo; Vidu cũng chấp nhận trường boolean audio đã khai báo.
  • audio_url / audio_urls cung cấp âm thanh đầu vào hoặc tham chiếu, không phải công tắc đầu ra. Chỉnh sửa video, chuyển động và phong cách có thể giữ lại âm thanh nguồn. Giữ âm thanh gốc không có nghĩa là tắt tiếng.

Xem chi tiết mô hình để biết giá trị hợp lệ và giá âm thanh. Các bí danh được hỗ trợ outputAudio, generate_audio và boolean audio phải khớp với output_audio khi dùng cùng nhau. Mỗi phiên bản và thao tác có thể có điều khiển khác nhau.

  • Với họ Seedance 2.0, hãy đọc hướng dẫn mô hình video Seedance 2.0 trước khi dùng đầu ra 4K, giới hạn Fast/Mini hoặc đầu vào tham chiếu đa phương thức.
  • Với video-to-video của grok-imagine-video, gửi prompt và URL HTTPS công khai .mp4 trong video_url. Thao tác này không dùng các tùy chọn duration, resolution hoặc aspect_ratio.

PixVerse và HappyHorse

Mô hìnhThao tácĐầu vàoĐộ phân giảiThời lượngBộ chọn âm thanh
pixverse-c1, pixverse-v6text-to-video, image-to-video, start-end-to-video, reference-to-videoprompt; image_url; start_image + end_image; reference_images360p, 540p, 720p, 1080pBất kỳ số nguyên từ 1 đến 15 giâyoutput_audio, mặc định false
pixverse-v5.6text-to-video, image-to-video, start-end-to-video, reference-to-videoCác trường giống như C1 và V6360p, 540p, 720p, 1080p5, 8 hoặc 10 giây; 1080p hỗ trợ 5 hoặc 8 giâyoutput_audio, mặc định false
happyhorse-1.0text-to-video, image-to-video, reference-to-video, video-to-videoprompt; image_url; reference_images; video_url + reference_images720p, 1080p3 đến 15 giây cho các thao tác tạo; đầu ra video-to-video bị giới hạn ở 15 giâyKhông gửi output_audio

Trên TokenLab, các mô hình PixVerse ở trên không chấp nhận operation=video-extension.

curl https://api.tokenlab.sh/v1/videos/generations \
  -H "Authorization: Bearer sk-your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "pixverse-v6",
    "operation": "image-to-video",
    "prompt": "A slow camera move through a neon-lit street",
    "image_url": "https://example.com/start.jpg",
    "resolution": "1080p",
    "duration": 5,
    "output_audio": true
  }'

Polling Kết Quả

Sử dụng poll_url đã trả về trước. Nếu bạn cần một điểm cuối cố định, sử dụng GET /v1/tasks/{id} với cùng id / task_id từ phản hồi tạo.

Các tác vụ video đã hoàn thành có thể trả về video_url, video, hoặc videos tùy theo model và số lượng đầu ra. Xem billing_transaction_id như một định danh thanh toán, không phải là định danh tác vụ.

Những Cạm Bẫy Thường Gặp

  • Không mã hóa cứng các đường dẫn trạng thái video cũ; ưu tiên poll_url.
  • Không kết hợp các trường khung hình đầu tiên với các dòng hình ảnh tham chiếu dành riêng trừ khi chi tiết model cho phép.
  • Không giả định duration mô tả độ dài video tham chiếu đầu vào; nó thường kiểm soát độ dài đầu ra được tạo.
  • Không thử lại các yêu cầu tạo sau khi hết thời gian mà không kiểm tra xem một tác vụ đã được tạo hay chưa.

Tài Liệu API

Chủ đềTham chiếu
Tạo VideoTạo Video
Lấy Trạng Thái VideoLấy Trạng Thái Video
Lấy Trạng Thái Tác VụLấy Trạng Thái Tác Vụ
Hủy Tác VụHủy Tác Vụ
Thanh Toán & Giá CảThanh Toán & Giá Cả

API video kiểu OpenAI và tương thích Volc

Dùng /v1/videos/generations cho API video hợp nhất của TokenLab trên nhiều mô hình. Nếu bạn đang di chuyển tích hợp Seedance 2.0 đã dùng content[] hoặc yêu cầu Action kiểu Volc, hãy dùng các endpoint tương thích Seedance dưới /api/v3. Cả hai kiểu đều dùng TokenLab Bearer API key và polling bất đồng bộ, nhưng hình dạng yêu cầu và phản hồi khác nhau.

Hailuo H3-Max tạo video dài 5–15 giây ở độ phân giải 480p hoặc 768p từ văn bản, khung hình đầu hoặc khung hình đầu và cuối. Quy trình chú trọng tốc độ giúp nhanh chóng biến ý tưởng cảnh quay thành một đoạn phim ngắn.

{
  "model": "hailuo-h3-max",
  "operation": "text-to-video",
  "prompt": "A slow camera move through a quiet garden",
  "resolution": "768p",
  "duration": 5,
  "aspect_ratio": "16:9"
}

Trên trang này