Seedance 2.5 is live — 30-second cinematic video with native audio & real-person references
Wan 2.7 영상 생성 API 가이드: 1080p, 음성, 가격 및 제한
2026/08/01

Wan 2.7 영상 생성 API 가이드: 1080p, 음성, 가격 및 제한

Wan 2.7 영상 API를 텍스트, 이미지, 참조, 영상 편집 작업에 사용하세요. 1080p 가격, 음성 제어, 2~15초 제한, 코드 예시를 설명합니다.

Wan 2.7 영상 API는 텍스트-투-비디오만 지원하지 않습니다. 동일한 모델 가족으로 텍스트에서 생성하고, 첫 프레임과 마지막 프레임을 애니메이션화하고, 기존 클립을 계속 진행하고, 참조 이미지나 비디오를 사용하고, 음성을 입력하고, 비디오를 편집할 수 있습니다. 720p와 1080p 출력을 지원하며 2~15초의 정수 지속 시간을 제공합니다.

이러한 폭넓은 기능성으로 인해 실질적인 문제가 하나 발생합니다. 요청 형태가 모드를 결정하고, 모드가 청구 대상에 영향을 미칩니다. 5초 텍스트-투-비디오 작업이 5초 참조-투-비디오 또는 편집 작업과 같은 가격으로 청구되지 않을 수 있습니다.

TL;DR

  • Wan 2.7은 720p와 1080p, 5가지 종횡비, 2~15초 출력을 지원합니다.[1]
  • 텍스트-투-비디오는 선택적 음성 파일을 허용하며, 음성이 없으면 모델이 배경음악이나 음향 효과를 생성할 수 있습니다.
  • reAPI는 현재 720p에서 $0.074/초, 1080p에서 $0.121/초를 표시합니다.
  • reAPI 통합 ID는 wan2.7-video이며 입력에 따라 작업이 텍스트, 이미지, 참조, 연속, 또는 편집인지 결정됩니다.
  • 생성된 URL은 임시입니다. 제품에서 공급자 URL을 제공하는 대신 결과를 내구성 있는 저장소에 다운로드하세요.

Wan 2.7 영상 API 사양

사양Wan 2.7 영상
reAPI 모델 IDwan2.7-video
출력 해상도720p, 1080p
지속 시간2~15초의 정수
종횡비16:9, 9:16, 1:1, 4:3, 3:4
프레임 속도30 fps
텍스트 프롬프트 제한5,000자
부정적 프롬프트 제한500자
커스텀 음성WAV 또는 MP3, 2~30초, 최대 15MB
프롬프트 확장선택적, 기본적으로 활성화됨
워터마크선택적, 기본적으로 비활성화됨
API 패턴비동기 작업 생성 및 폴링

Alibaba의 공식 HTTP API는 Wan 2.7에 비동기 호출을 필요로 합니다. 제출 후 작업 ID와 결과 URL은 24시간 동안 사용 가능합니다.[1] reAPI는 영상 엔드포인트 뒤의 작업 제출을 정규화하지만 애플리케이션은 여전히 반환된 작업 ID를 유지하고, 백오프와 함께 폴링하고, 완성된 자산을 영구 저장소에 복사해야 합니다.

해상도별 Wan 2.7 영상 API 가격

Wan 2.7은 초당 청구를 사용합니다. 현재 reAPI 요금 카드는 할인된 업스트림 요금에 10% 플랫폼 마진을 적용하고 완료된 요청을 전체 크레딧으로 반올림합니다.

해상도현재 reAPI 표시 요금업스트림 정가5초 reAPI 작업15초 reAPI 작업
720p$0.074/초$0.083/초$0.366$1.096
1080p$0.121/초$0.137/초$0.603$1.809

5초 및 15초 예제는 집계 요청 반올림을 사용하므로 표시된 반올림 요금에 지속 시간을 곱한 것보다 약간 낮을 수 있습니다. 요금은 2026년 8월 1일에 확인했습니다.

텍스트-투-비디오 및 일반 이미지-투-비디오의 경우 청구 가능한 수는 출력 지속 시간입니다. 참조-투-비디오 및 영상 편집은 검사된 원본 영상 지속 시간도 포함할 수 있습니다. 추정기 또는 반환된 사용량에서 이러한 모드를 예산에 포함시키고 출력 슬라이더가 전체 청구액이라고 가정하지 마세요.

Wan 2.7 영상 API 모드 및 720p와 1080p 생성, 참조, 연속, 편집에 대한 초당 가격

reAPI를 통해 Wan 2.7을 호출하는 방법

텍스트-투-비디오 요청이 가장 작은 실용적인 예입니다:

curl https://reapi.ai/api/v1/videos/generations \
  -H "Authorization: Bearer $REAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "wan2.7-video",
    "prompt": "Generate a single shot. A paper boat drifts down a rain-soaked city street at dusk. Slow low-angle tracking camera, warm shop reflections, natural rain and distant traffic audio.",
    "negative_prompt": "text, logo, watermark, camera shake",
    "size": "16:9",
    "resolution": "1080P",
    "duration": 5,
    "prompt_extend": true,
    "watermark": false,
    "seed": 31415
  }'

Wan 2.7 영상 모델 페이지에서 사용 가능한 모드를 확인할 수 있으며, API 문서는 현재 페이로드 스키마에 사용해야 합니다.

모드는 암시적입니다. 가상의 mode: "text-to-video" 필드를 추가하지 마세요. 대신 원하는 워크플로에 대한 미디어 필드를 제공하세요.

올바른 Wan 2.7 입력 모드 선택

텍스트-투-비디오

prompt와 일반 출력 제어를 제공하세요. 커스텀 사운드트랙을 위해 audio_url을 전달할 수도 있습니다. Alibaba는 음성을 생략하면 Wan 2.7이 배경음악이나 효과음을 생성할 수 있다고 말합니다.[1]

첫 프레임 또는 첫 프레임과 마지막 프레임 영상

간단한 첫 프레임 워크플로에는 image_urls를 사용하거나 이미지가 명시적인 first_framelast_frame 역할을 필요로 할 때 image_with_roles를 사용하세요. 첫 번째 이미지는 일반적으로 출력 구성과 대략적인 종횡비를 결정합니다.

영상 연속

video_urls를 통해 소스를 하나 제공하세요. 소스 클립은 요청한 총 지속 시간까지 계속됩니다. 예를 들어, duration: 10을 가진 3초 소스는 대략 7초의 새로운 콘텐츠를 생성하고 10초의 결합된 결과를 생성합니다.

참조-투-비디오

외모, 모션 또는 음성 특성을 유지하기 위해 reference_image_urls, reference_video_urls 또는 reference_voice_urls를 사용하세요. 현재 reAPI 표면은 각 참조 카테고리에서 최대 5개의 URL을 허용합니다.

영상 편집

video_url과 편집 프롬프트를 제공하세요. 최대 4개의 지원 이미지가 교체 또는 스타일링을 안내할 수 있습니다. audio_setting: "origin"은 소스 음성을 선호하고, "auto"는 워크플로가 음성을 처리하는 방식을 결정하도록 합니다.

Wan 2.7 프롬프트 작성 방법

Wan 2.7은 프롬프트에서 샷 구조를 해석합니다. 이전 shot_type 필드는 Wan 2.7 텍스트-투-비디오를 제어하지 않습니다. 한 개의 연속 샷을 요청하려면 "Generate a single shot."이라고 말하세요. 멀티샷 작업의 경우 각 샷의 이름을 지정하고 시간 범위를 제공하세요.[1]

Generate a multi-shot video.
Shot 1 [0–4s]: wide shot of a quiet train platform before sunrise.
Shot 2 [4–8s]: medium tracking shot as a traveler walks beside the train.
Shot 3 [8–12s]: close-up of a paper ticket bending in the wind.
Natural station ambience, no dialogue, restrained camera motion.

타임라인을 요청된 지속 시간 내에 유지하세요. 3개의 샷이 각각 10초를 암시하지만 API가 6초 출력을 요청하면 모델은 지시를 압축하거나 삭제해야 합니다. 공식 프롬프트 가이드는 여러 자산이 있을 때 Image 1 또는 Video 1로 참조의 이름을 지정할 것을 권장합니다.[3]

음성 동작 및 경계 사례

커스텀 음성은 타이밍, 대사 또는 배경음을 구동할 수 있지만 지속 시간이 일치해야 합니다. 음성이 요청한 비디오보다 길면 자릅니다. 더 짧으면 나머지는 무음일 수 있습니다. 정확한 종료가 중요할 때는 음성을 미리 자르세요.

입술 동기화 또는 음성 참조 작업의 경우 배경 소음이 제한된 깨끗한 음성을 사용하세요. 음악, 겹치는 대사, 환경 소음이 섞인 사운드트랙은 전용 음성 트랙보다 모델에 덜 신뢰할 수 있는 타이밍 증거를 제공합니다.

또한 음성이 권리와 동의 의무를 변경한다는 것을 기억하세요. 기술적으로 유효한 참조 음성은 복제하거나 게시할 권한이 있다는 증거가 아닙니다.

일반적인 통합 실수

생성을 동기식으로 처리

비디오 작업은 몇 분이 걸릴 수 있습니다. 작업 ID를 저장하고, 지수 백오프로 폴링하고, 실패 상태를 처리하고, 페이지 새로고침 후 UI를 재개 가능하게 만드세요.

임시 결과 URL 제공

Alibaba의 결과 URL은 24시간 후 만료됩니다. 성공한 결과를 다운로드하고 영구 자산 URL을 반환하기 전에 자신의 객체 저장소에 업로드하세요.

1080p가 항상 최고의 테스트 설정이라고 가정

720p에서 프롬프트를 프로토타입하고, 선택한 샷을 1080p에서 다시 실행하세요. 이렇게 하면 최종 배포 품질을 유지하면서 프롬프트 반복을 더 저렴하게 유지합니다.

청구 가능한 입력 지속 시간 무시

참조-비디오 및 편집 워크플로는 청구액에 소스 지속 시간을 포함할 수 있습니다. 요청 모드, 소스 길이, 출력 길이, 해상도, 최종 청구액을 기록하세요.

더 넓은 비호환 청구 단위 비교를 보려면 AI 영상 생성 API 가격 책정을 읽으세요. 워크플로가 정지 이미지에서 시작하고 다른 모션 모델이 필요한 경우 Grok Imagine Video 1.5 API 가이드에서 이미지-투-비디오 전용 표면을 설명합니다.

자주 묻는 질문

Wan 2.7 비디오는 얼마나 길 수 있습니까?

Wan 2.7은 기본 텍스트 및 이미지 워크플로에 대해 2~15초의 정수 지속 시간을 허용합니다.

Wan 2.7은 1080p를 지원합니까?

네. 720p와 1080p를 지원합니다. 해상도가 초당 가격에 영향을 미칩니다.

Wan 2.7은 음성을 생성할 수 있습니까?

네. 커스텀 음성 파일이 없으면 텍스트-투-비디오 경로가 일치하는 배경음악이나 음향 효과를 생성할 수 있습니다. WAV 또는 MP3 입력도 수락합니다.

Wan 2.7은 첫 프레임과 마지막 프레임을 지원합니까?

네. 이미지-투-비디오 API는 첫 프레임 및 첫 프레임과 마지막 프레임 워크플로 및 기존 클립에서의 연속을 지원합니다.

reAPI에서 5초 Wan 2.7 비디오의 비용은 얼마입니까?

2026년 8월 1일에 확인한 요금으로 일반적인 5초 작업은 720p에서 약 $0.366 또는 1080p에서 $0.603입니다. 입력 청구 참조 및 편집 모드의 비용이 더 높을 수 있습니다.

결론

Wan 2.7 영상 API는 한 가족이 생성, 연속, 참조 제어, 음성, 편집을 포괄하기 때문에 가치가 있습니다. 애플리케이션이 명시적으로 요청 모드를 결정하고, 해상도 및 청구 가능한 지속 시간을 올바르게 예산하고, 작업 폴링 및 자산 지속성을 제품의 1급 부분으로 처리할 때 통합이 가장 잘 작동합니다.

참조

  1. Alibaba Cloud Model Studio. Wan2.7 text-to-video API reference. alibabacloud.com/help/en/model-studio/text-to-video-api-reference
  2. Alibaba Cloud Model Studio. Wan2.7 image-to-video API reference. alibabacloud.com/help/en/model-studio/image-to-video-general-api-reference
  3. Alibaba Cloud Model Studio. Wan video prompt guide. alibabacloud.com/help/en/model-studio/text-to-video-prompt