비디오

선택적 내레이션과 연결된 장면을 지원하는 비동기 비디오 생성.

다른 카테고리와 달리 비디오는 비동기입니다: 호출 즉시 최종 결과가 아니라 job_id(HTTP 202)가 반환됩니다. GET /v1/jobs/{job_id}를 통해 상태를 추적하세요.

생성 시작하기

http
POST /v1/video/generate
json
{
  "prompt": "Un drone survole une plage au coucher du soleil.",
  "image_url": null,
  "duration_seconds": 5,
  "narration_text": null,
  "scenes": null,
  "model": null,
  "routing_strategy": "auto"
}
json
{ "job_id": "8b2a3be3-...", "status": "queued" }

상태 추적하기

http
GET /v1/jobs/{job_id}
json
{
  "id": "8b2a3be3-...",
  "category": "video",
  "type": "text_to_video",
  "status": "completed",
  "provider": "vidu",
  "model": "viduq1",
  "result_url": "https://cdn.uploadscenter.com/file_...",
  "error": null,
  "created_at": "2026-08-31T17:14:04Z",
  "updated_at": "2026-08-31T17:24:41Z"
}

statusqueued, processing, completed 또는 failed 값을 가집니다. 두 최종 상태 중 하나가 될 때까지 일정 간격(예: 5초마다)으로 폴링하세요. 공식 SDK는 이 폴링을 대신 수행해 주는 .wait() 단축 메서드를 제공합니다.

내레이션 (보이스오버)

narration_text를 제공하면 생성된 비디오 위에 합성된 보이스오버를 덧입힐 수 있습니다. 이는 비디오 생성기를 위해 장면만을 설명하는 시각적 prompt와는 별개의, 말로 표현되는 텍스트입니다 — 어떤 비디오 제공업체도 오디오를 자체적으로 생성하지 않으며, 내레이션은 별도로 합성된 후(ElevenLabs 음성) 병합됩니다.

json
{
  "prompt": "Documentaire sous-marin, poissons tropicaux, recif corallien.",
  "narration_text": "Sous la surface, un monde silencieux et colore s'anime au rythme des courants.",
  "duration_seconds": 5
}

장면 (한 클립보다 긴 비디오)

단일 제공업체 호출로 생성되는 클립은 요청한 길이와 관계없이 일반적으로 몇 초 정도입니다. 더 긴 비디오(특히 긴 내레이션에 유용)를 위해서는 scenes를 제공하세요 — 약 duration_seconds 길이의 각 구간에 대한 시각적 설명을 순서대로 나열합니다. 각 장면은 별도의 제공업체 호출이며 개별적으로 과금됩니다.

json
{
  "prompt": "Presentation d'un chaton qui joue avec une balle.",
  "scenes": [
    "Un chaton tigre tapote une balle rouge dans un salon ensoleille, camera basse.",
    "Le chaton poursuit la balle sous le canape puis la ramene fierement, gros plan."
  ],
  "duration_seconds": 5,
  "narration_text": "Voici Moka, un chaton joueur qui pourchasse sa balle rouge avec entrain."
}

scenes가 제공되면 생성 시 prompt는 무시됩니다(해당 필드는 여전히 필수이므로 값으로 짧은 요약을 사용하세요).

시작 이미지

image_url을 사용하면 텍스트-투-비디오 생성을 이미지-투-비디오 생성으로 전환할 수 있습니다(첫 번째 클립이 제공된 이미지를 애니메이션화합니다).

제공업체

Vidu, OpenAI(Sora).