
AI 비디오 자연 연기 연출 비트 시트 가이드
자연스러운 AI 영상 연기 장면 계획 방법을 배웁니다. 연기 비트, 캐릭터 상태, 카메라 진행, 프롬프트 템플릿, 검토 기준, API 예제로 완전한 워크플로우를 다룹니다.
진정한 AI 비디오 연기는 감정 목록이 아닌 비트 시트에서 시작됩니다. 비트 시트는 장면을 모델이 표현할 수 있는 작은 변화로 전환합니다. 캐릭터가 대사를 듣고, 멈추고, 다른 곳을 보고, 결정을 내린 후 말합니다. 또한 각 비트 끝의 가시적 상태를 정의하므로 다음 순간이 구체적인 곳에서 시작할 수 있습니다.
이 초보자 튜토리얼은 짧은 대사 장면을 아이디어에서 검토까지 구성합니다. 세부 프롬프트를 수용하는 모든 비디오 모델에서 이 방법을 사용할 수 있습니다. API 예제는 생성된 오디오와 한 요청에서 최대 30초의 클립을 지원하기 때문에 reAPI의 Seedance 2.5를 사용합니다.[1]
TL;DR
- 장면에서 감정적으로 변경되는 내용을 설명하는 한 문장을 작성합니다.
- 각 캐릭터에 안정적인 시작 상태, 개인 목표, 압박점을 제공합니다.
- 장면을 대략 각 하나의 동작 또는 반응으로 비트로 나눕니다.
- 모든 비트를 눈빛, 자세, 거리, 소품 또는 표정의 가시적 상태로 끝냅니다.
- 대사, 연기, 블로킹, 카메라, 사운드를 별도의 프롬프트 블록에 배치합니다.
- 클립을 수용하기 전에 화자 배치, 일시 정지, 눈빛, 손, 화면 방향, 최종 상태를 검토합니다.

연기 비트는 무엇입니까
연기 비트는 장면에서 의미 있는 가장 작은 변화입니다. 단순히 시간 범위가 아닙니다. 캐릭터가 아는 것, 원하는 것 또는 하는 것을 변경하는 어떤 일이 일어나야 합니다.
다음 대사를 고려합니다.
Maya: "You already packed?""Maya는 슬퍼 보입니다"는 약한 지시입니다. 비트가 더 유용합니다.
Maya notices the suitcase before she speaks. Her shoulders stop moving. She
looks at the suitcase, then at Leo, and asks quietly, "You already packed?"
She ends the beat holding eye contact, waiting for him to answer.두 번째 버전은 모델에 트리거, 순서, 라인 읽기, 끝 상태를 제공합니다. 이는 추상적인 라벨보다 가시적인 지시입니다.
1단계: 장면을 하나의 감정적 변화로 축소합니다
대사를 작성하기 전에 이 문장을 마칩니다.
The scene begins with __________ and ends with __________ because __________.예를 들어:
The scene begins with Maya expecting a normal goodbye and ends with her
realizing Leo planned to leave without telling her because she sees his packed
suitcase before he can hide it.이것은 장면의 척추입니다. 제안된 카메라 이동, 제스처 또는 추가 라인이 뷰어가 해당 변경을 이해하는 데 도움이 되지 않으면 제거합니다. 초보자들은 종종 한 세대에 여러 감정적 전환, 위치 공개, 제품 배치 및 복잡한 카메라 안무를 요청합니다. 그러면 모델은 너무 많은 작업에 주의를 분산시킵니다.
한 번의 전환으로 시작합니다. 간단한 버전이 작동한 후에만 복잡성을 추가합니다.
2단계: 컴팩트 캐릭터 상태 카드를 작성합니다
모델은 전기의 페이지가 필요하지 않습니다. 이 장면에 영향을 주는 세부 정보가 필요합니다.
{
"maya": {
"starting_state": "relaxed, expecting a routine goodbye",
"goal": "get an honest explanation",
"pressure_point": "being excluded from important decisions",
"default_behavior": "stays quiet before confronting someone",
"fixed_visuals": "dark bob, green coat, silver watch"
},
"leo": {
"starting_state": "guarded and eager to leave",
"goal": "end the conversation without admitting guilt",
"pressure_point": "direct eye contact",
"default_behavior": "handles nearby objects when uncomfortable",
"fixed_visuals": "short brown hair, charcoal jacket, black suitcase"
}
}default_behavior 필드는 특히 유용합니다. "신경 쓰임"은 무작위 깜박임과 과장된 얼굴 운동이 될
수 있습니다. "편할 때 수하물 손잡이를 돌린다"는 성능에 물리적 출구를 제공합니다.
닮음이 중요하면 생성 전에 명확한 참조 이미지를 준비합니다. 이 튜토리얼은 성능 계획에 중점을 둡니다. 캐릭터 일관성 워크플로우는 더 자세한 참조 준비를 다룹니다.
3단계: 대사를 타이밍된 비트로 변환합니다
짧은 장면에 4~6개의 비트를 사용합니다. 정확한 초는 가이드이지 프레임 정확한 편집 결정이 아닙니다. 중요한 것은 순서와 명확한 끝 상태입니다.
| 시간 | 트리거 | 가시적 성능 | 대사 | 끝 상태 |
|---|---|---|---|---|
| 0–4s | Maya sees suitcase | Walk stops; eyes move to suitcase | None | Maya still, suitcase between them |
| 4–8s | Leo notices her | Hand tightens on handle; avoids eye contact | Maya: "You already packed?" | Leo looks toward door |
| 8–13s | Silence becomes uncomfortable | Maya steps closer; Leo exhales | Leo: "It was easier this way." | Both hold position |
| 13–19s | Maya understands | Brief look down, then steady eye contact | Maya: "For who?" | Maya calm; Leo cornered |
| 19–24s | Leo cannot answer | Hand leaves suitcase; posture softens | None | Silence, no reconciliation |
모든 비트에 음성이 포함되는 것은 아닙니다. 침묵은 모델이 반응을 보여줄 시간을 제공합니다. 또한 지속적인 중복 대사보다 화자 배치를 더 명확하게 유지합니다.
4단계: 카메라 이동 전에 블로킹을 계획합니다
블로킹은 사람과 물체의 위치를 설명합니다. 카메라 방향은 청중이 해당 블로킹을 어떻게 보는지 설명합니다. 두 번째를 추가하기 전에 첫 번째를 수정합니다.
예제 장면:
- Maya는 프레임 왼쪽, 수하물에서 2미터 떨어져 시작합니다.
- Leo는 프레임 오른쪽에서 손잡이에 오른손을 얹고 시작합니다.
- 수하물은 그들 사이에 남아 있습니다.
- 어느 사람도 중심선을 넘지 않습니다.
- Maya는 세 번째 비트 중에 한 발 앞으로 나아갑니다.
- Leo는 최종 비트 전에 걸어가지 않습니다.
이러한 제약은 화면 방향을 보호하고 나중에 절단을 더 쉽게 만듭니다. 그런 다음 간단한 카메라 진행을 추가합니다.
0-8s: locked medium two-shot.
8-19s: very slow push toward a tighter two-shot.
19-24s: hold. No additional camera movement.카메라가 모든 감정을 수행하도록 하지 마십시오. 갑작스러운 궤도, 크레인 이동, 줌은 배우와 경쟁할 수 있습니다. 대사 테스트의 경우 하나의 절제된 이동으로 충분합니다.
5단계: 6개 블록에서 프롬프트를 조합합니다
별도의 프롬프트 블록은 실수를 진단하기 쉽게 만듭니다. 카메라가 잘못되면 캐릭터 정체성이나 대사를 다시 작성하지 않고도 카메라 블록을 편집할 수 있습니다.
REFERENCES
Image 1 is Maya's identity and wardrobe reference. Image 2 is Leo's identity
and wardrobe reference. Image 3 defines the station entrance, lighting, and
initial blocking.
CHARACTERS
Maya stays quiet before confronting someone. Leo handles the suitcase when he
is uncomfortable. Preserve their age, facial features, hair, clothing, and
body proportions throughout.
SCENE AND BLOCKING
Evening outside a train station. Maya remains frame left. Leo remains frame
right. A black suitcase stays between them. They do not cross positions.
PERFORMANCE TIMELINE
0-4s: Maya enters, notices the suitcase, stops walking, and looks from the
suitcase to Leo. End with Maya still and Leo unaware.
4-8s: Leo notices her and tightens his hand on the handle without looking at
her. Maya asks quietly, "You already packed?" End with Leo looking at the door.
8-13s: Maya takes one step closer. Leo exhales and says, "It was easier this
way." End with both holding position.
13-19s: Maya briefly looks down, regains eye contact, and asks, "For who?"
End with Maya calm and Leo unable to answer.
19-24s: Leo releases the handle and softens slightly. Neither speaks. End in
unresolved silence.
CAMERA
0-8s locked medium two-shot. 8-19s very slow push to a tighter two-shot.
19-24s hold. Keep both faces visible and preserve the left-right axis.
SOUND AND CONSTRAINTS
Natural American English. Keep the exact lines and speaker assignment. Quiet
station ambience. No narration, subtitles, extra dialogue, background music,
or exaggerated crying.ByteDance는 Seedance가 다중 모달 입력에서 구성, 이동, 카메라 언어 및 사운드를 참조할 수 있음을 문서화합니다. 또한 모델이 다중 주제 일관성 및 텍스트 정확도를 개선할 여지가 있음을 주목하며, 이는 참조 역할 및 검토 단계가 중요한 이유입니다.[2]
6단계: 최종 장면 전에 리허설을 생성합니다
짧고 위험이 낮은 리허설을 사용하여 화자 순서, 블로킹 및 감정적 타이밍을 테스트합니다. 아직 의류 질감이나 최종 색상을 판단하지 마십시오.
reAPI에서 최소 Seedance 2.5 요청은 다음과 같습니다.
curl https://reapi.ai/api/v1/videos/generations \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "doubao-seedance-2.5-face",
"prompt": "PASTE_THE_SIX_BLOCK_PROMPT_HERE",
"image_urls": [
"https://example.com/maya.jpg",
"https://example.com/leo.jpg",
"https://example.com/station.jpg"
],
"resolution": "720p",
"size": "16:9",
"duration": 24,
"generate_audio": true
}'요청은 비동기입니다. 반환된 작업 ID를 상태가 completed 또는 failed일 때까지 폴링합니다.
현재 필드 제한 및 청구 규칙은 하드 코딩된 클라이언트 가정이 아닌
Seedance 2.5 API 문서에 속합니다.
7단계: 올바른 순서로 성능을 검토합니다
결과를 각각 다른 목적으로 3번 시청합니다.
패스 1: 소리만
시청하지 않고 듣습니다. 정확한 라인, 화자 배치, 라인 순서, 원치 않는 내레이션, 페이싱, 비트 시트가 요청하는 장소의 일시 정지 여부를 확인합니다.
패스 2: 소리 없는 그림
클립을 음소거하십시오. 눈빛, 신체 위치, 손 동작, 얼굴 연속성, 화면 방향, 각 비트가 계획된 상태에서 끝나는지 여부를 확인합니다.
패스 3: 전체 장면
이제 대사, 반응, 카메라, 사운드가 동일한 차수를 지원하는지 판단합니다. 한 층이 실패하면 먼저 해당 층을 복구합니다. 한 일시 정지가 너무 짧기 때문에 전체 장면을 다시 작성하지 마십시오.
간단한 수용 시트를 사용합니다.
{
"speaker_order": "pass",
"exact_dialogue": "pass",
"left_right_axis": "pass",
"beat_3_end_state": "repair",
"identity": "pass",
"camera": "pass",
"repair_note": "Leo looks at Maya too early; hold gaze on the door through 13s"
}이것은 AI 비디오 비평 루프와 동일한 원칙입니다. 클립이 "좋은 느낌인지" 여부를 묻는 대신 명시적 증거에 대해 수용하거나 복구합니다.
일반적인 초보자 실수
| 실수 | 실패하는 이유 | 더 나은 이동 |
|---|---|---|
| "슬픈, 영화 같은, 감정적인" 쓰기 | 기분 단어는 행동을 정의하지 않습니다 | 트리거, 물리적 반응, 끝 상태 추가 |
| 두 캐릭터에 지속적인 이동 제공 | 장면이 바빠지고 불명확해집니다 | 하나가 작용하고 다른 하나가 수신하게 합니다 |
| 모든 초를 대사로 채우기 | 반응에 등록할 시간이 없습니다 | 침묵을 위한 예약 비트 |
| 모든 비트를 바꾼 카메라 스타일 | 카메라가 성능과 경쟁합니다 | 한 진행과 한 보류 사용 |
| 한 가지 결함 후 모두 재생성 | 좋은 부분이 손실됩니다 | 가장 작은 실패한 블록 복구 |
| 장면 내 정확한 브랜드 텍스트 요청 | 생성된 텍스트는 신뢰할 수 없습니다 | 사후 제작에서 중요한 복사본 추가 |
FAQ
초보자는 얼마나 많은 연기 비트를 사용해야 합니까?
4~6개로 시작하십시오. 각 비트는 하나의 주요 트리거 또는 반응을 포함해야 합니다. 한 행에 변경 사항을 설명하는 데 여러 문장이 필요하면 분할합니다.
타임코드는 정확한 타이밍을 보장합니까?
아니요. 페이싱 지침으로 취급하십시오. 렌더링된 결과를 확인하고 정확한 배달 타이밍이 중요할 때 편집기에서 자르십시오.
모든 감정이 얼굴에 보여야 합니까?
아니요. 자세, 눈빛, 거리, 손 이동, 침묵은 종종 과장된 표정보다 더 명확하게 전달합니다.
캐릭터 참조 이미지 없이 이 워크플로우를 사용할 수 있습니까?
예, 그러나 시각적 정체성은 덜 제한됩니다. 특정 사람이나 반복되는 허구의 캐릭터가 인식 가능하게 유지되어야 할 때 참조가 더 중요해집니다.
대사 장면이 실패할 때 먼저 무엇을 수정해야 합니까?
미묘한 감정 전에 화자 순서 및 블로킹을 수정합니다. 아름답게 렌더링된 반응은 잘못된 캐릭터가 말하거나 잘못된 쪽으로 건너가는 장면을 저장할 수 없습니다.
결론
AI 비디오 연기 비트 시트는 감정적 아이디어를 가시적 작업으로 변환합니다. 트리거, 반응, 대사, 블로킹, 끝 상태 및 검토 기준입니다. 간단한 차수를 구성하고, 침묵에 여유를 주고, 카메라를 절제합니다. 해당 버전이 작동하면 장면 제어를 잃지 않고도 더 복잡한 성능을 추가할 수 있습니다.
참고 자료
- ByteDance Seed. One-take Creation, Flexible Referencing: Introducing Seedance 2.5. July 31, 2026. seed.bytedance.com
- ByteDance Seed. Seedance 2.0 Official Launch. February 12, 2026. seed.bytedance.com
- reAPI. Seedance 2.5 API — Parameters, Modes & Billing. Retrieved August 27, 2026. reapi.ai
작성자

카테고리
더 많은 게시물

Suno 뮤직비디오 워크플로우: 전곡 생성 vs 장면별 제작
Suno 음악 비디오를 제작할 때 워크플로우를 선택하세요: 전곡 한 번 생성, 수동 장면 목록 만들기, 또는 애니매틱-히어로샷 혼합 방식 중 선택하고 비용을 비교합니다.


2026년 무료 AI API: 각 사의 무료 범위는 실제 어디까지인가
Google 무료 tier는 이미지, 동영상, 음악 모델을 전부 제외합니다. 각 프로바이더의 무료 범위와 2026년 7월 현재 공식 가격을 정리했습니다.


GPT-6 Astra 누가 쓸 수 있나: ChatGPT・Work・Codex
ChatGPT, Work, Codex, API에서 GPT-6 Astra 이용 가능 여부를 2026년 9월 7일 기준으로 확인하고, 접근 문제 발생 시 확인해야 할 체크리스트를 알아보세요.
