T2VA
텍스트를 비디오로
텍스트 프롬프트
자유로운 콘셉트, 광고, 시네마틱 장면.
초기 구도, 명확한 동작 하나, 카메라 경로와 사운드를 설명하세요.
이 워크플로 열기올바른 생성 모드를 선택하고, 공식 H3 구조로 프롬프트를 작성하고, 참조 역할을 지정하고, 추측 없이 일반적인 실패를 해결하세요.
01 / MODE PICKER
여기서 시작하세요. 모델이 카메라 지침을 하나도 읽기 전에 잘못된 모드를 선택하면 충돌이 발생합니다.
T2VA
텍스트 프롬프트
자유로운 콘셉트, 광고, 시네마틱 장면.
초기 구도, 명확한 동작 하나, 카메라 경로와 사운드를 설명하세요.
이 워크플로 열기I2VA
첫 이미지 + 프롬프트
인물 식별, 제품 형태 및 구도 제어.
이미지는 정적인 프레임을 담당하고, 프롬프트는 다음에 무엇이 움직이는지 설명해야 합니다.
이 워크플로 열기FL2VA
첫 이미지 + 마지막 이미지 + 프롬프트
변환 및 정확한 최종 상태 수렴
실현 가능한 움직임 경로 하나를 사용하고 두 프레임의 구성을 호환되게 유지하세요.
이 워크플로 열기L2VA
마지막 이미지 + 프롬프트
로고 공개, 제품 엔드 카드 및 디자인된 엔딩.
그럴듯한 이전 상태와 모든 요소가 제공된 프레임에 어떻게 안착하는지 설명하세요.
이 워크플로 열기Ref2VA
이미지, 비디오, 오디오 + 프롬프트
인물 식별, 제품, 움직임, 카메라 또는 음성 전이.
각 에셋에 하나의 명확한 역할을 지정하고 보존해야 할 사항을 명시하세요.
이 워크플로 열기CONTROL RULES
영화 같은 세부 정보를 추가하기 전에 이 규칙을 사용하세요. 단어를 더 많이 써도 충돌하는 작업 설명은 해결되지 않습니다.
입력 유형에 따라 프롬프트에서 제어해야 할 항목이 달라집니다. 모든 워크플로에 하나의 범용 프롬프트를 사용하지 마세요.
짧은 클립에는 이해하기 쉬운 하나의 사건이 필요합니다. 시각 정보가 실제로 바뀔 때만 새 샷을 추가하세요.
정체성, 제품, 움직임, 카메라 및 음성 역할을 분리하여 참조가 서로 충돌하지 않게 하세요.
모호한 부정 표현을 명시적인 상태로 바꾸세요: 카메라 고정, 입술 닫힘, 정확한 얼굴, 의상 변경 없음.
02 / PROMPT BUILDER
빌더는 선택한 H3 모드에 맞춰 정렬 지침, 참조 레이블 및 API 콘텐츠 역할을 변경합니다.
생성 모드
10s. A matte-red portable speaker remains geometrically consistent. A rim light traces the silhouette, then the speaker settles into a clean hero frame. Minimal dark studio, soft haze, precise reflections and generous negative space. The camera performs a Push In with small amplitude at slow speed. One soft dial click, restrained room tone and a synchronized low-frequency pulse. Minimal electronic percussion, moderate tempo, ending cleanly on the hero frame.입력하는 동안 결과가 업데이트됩니다. 구조적 프롬프트는 영어로 유지하고, 대화와 화면 텍스트에는 대상 언어를 사용하세요.
462/700003 / OFFICIAL ANATOMY
필드 이름을 사고 체계로 사용하세요. 먼저 비주얼과 장면, 다음은 현장음, 마지막은 관객만 듣는 음악입니다.
T2VA / I2VA / FL2VA / L2VA
{I2VA / FL2VA / L2VA alignment instruction when applicable}
integrated_multimodal_description:
[Shot 1] {initial composition}. {subject action}.
[Shot 2] At 00:04.000, {new visual information}.
overall_soundscape:
{ambience + physical sounds}
non_diegetic_music:
{instrumentation + tempo + dynamics}; or N/ARef2VA
subject_definitions:
<Subject 1> is the product shown in <Picture 1>; preserve its geometry, material, color and logo.
<Video 1> is the camera-path and pacing reference.
summary:
[reference generation] {creative goal using Subject 1}
retention_analysis:
<Subject 1> (appears in [Shot 1]): fully_preserved - {exact attributes}
<Video 1> (camera and pacing structure): weak_reference - {relationship}
detailed_description:
{style sentence}
[Shot 1] <Subject 1> ...
overall_soundscape:
...
non_diegetic_music:
...tracking shot + medium amplitude + slow speed(S1) says <d>[Chinese] 原句</d>instrumentation + tempo + dynamics; or N/A04 / REFERENCE ROLES
참조를 더 추가하는 것보다 명확한 역할 맵이 더 유용합니다. 반드시 유지해야 할 세부 사항은 텍스트로 반복하세요.
<Subject 1>인물 식별: 얼굴, 헤어스타일, 의상
<Subject 2>Picture 2의 제품: 기하학적 형태, 소재, 색상
<Picture 3>구체적인 첫 프레임, 키 프레임 또는 마지막 프레임 앵커
<Video 1>움직임: 걷기 리듬과 카메라 경로
<Audio 1>음성: 음색만
보존 계약
In Video 1, change only the original package to the exact product from Picture 1.
Preserve the actor identity, hands, timing, camera path, background and lighting.
Keep the product geometry, color and logo from Picture 1 unchanged.PROMPT RECIPES
이는 보장된 결과를 주장하는 것이 아닌 원본 교육 템플릿입니다. 한 번에 하나의 변수만 조정하세요.
10s premium product film. A matte-red speaker in clean negative space. Slow push-in as rim light traces the exact silhouette; cut once to a macro texture shot, then settle into a stable hero frame. One soft dial click, restrained room tone, minimal electronic percussion.
이 프롬프트 사용Picture 1 anchors 0.00s and Picture 2 anchors 8.00s. Use one continuous shot. The hand pulls the ribbon and the paper unfolds in observable stages. Every moving element gradually settles into the exact composition, lighting and hand position of Picture 2.
이 프롬프트 사용In Video 1, change only the package to the exact product from Picture 1. Preserve actor identity, hands, timing, camera path, background, lighting and all other motion. Keep product geometry, color and logo unchanged.
이 프롬프트 사용05 / TROUBLESHOOTING
재시도할 때마다 제어 변수를 하나만 변경하면 어떤 지시가 결과를 개선했는지 파악할 수 있습니다.
| 증상 | 가능한 원인 | 다음으로 변경 |
|---|---|---|
| 얼굴 또는 제품이 변형됨 | 참조 역할은 스타일 및 움직임과 암묵적으로 공유됩니다. | 깨끗한 이미지 하나에 정체성을 지정하고 보존해야 할 정확한 특징을 나열하세요. |
| 카메라 움직임 충돌 | 비디오 참조와 텍스트가 서로 다른 카메라 경로를 설명합니다. | 경로는 참조에 맡기고, 텍스트는 속도나 진폭을 조정할 때만 사용하세요. |
| 대화가 너무 빠르거나 맞지 않음 | 대사가 너무 길거나 화자가 바뀌거나 타이밍이 고정되어 있지 않습니다. | 대사를 줄이고, 화자 ID 하나를 유지하며, 일치하는 샷 안에 배치하세요. |
| 첫/마지막 프레임 점프 | 프레임의 카메라 각도나 배율이 다르거나 독립적인 객체가 너무 많습니다. | 첫 프레임에서 마지막 프레임을 만들고 도달 가능한 상태 하나를 변경한 뒤 하나의 연속 경로를 설명하세요. |
06 / CONTRACT BOUNDARIES
각 지속 시간, 해상도, 매개변수 및 모델 ID에 실제로 제공하는 화면을 표시하세요.
공식 API 길이
4–15s
공식 해상도
768P / 2K
프레임 모드 비율
adaptive
T2V 비율
21:9 → 9:16
공식 요청 스키마, 모델 문자열 및 기능 문서를 기준 정보로 사용하세요.
공식 API 가이드현재 작업 공간에 표시된 모드, 컨트롤, 가격 및 제한만 사용하세요.
워크스페이스 열기T2V, 이미지 프레임 또는 참조 생성에 맞는 워크플로와 가중치를 선택하세요.
ComfyUI 가이드FAQ
스타일을 다듬기 전에 모드, 참조, 대사, 플랫폼 계약을 결정해야 합니다.
텍스트만 사용하는 콘셉트에는 T2VA, 첫 프레임이 구성을 담당할 때는 I2VA, 양쪽 끝점이 중요할 때는 FL2VA, 디자인된 결말에는 L2VA, 기존 이미지·비디오 또는 오디오가 특정 속성을 제어해야 할 때는 Ref2VA를 사용하세요.
제공업체 전반에 걸쳐 하나가 존재한다고 가정하지 마세요. 대신 “카메라는 고정 숏을 유지”, “정확한 얼굴과 의상 유지”, “입술은 닫힌 상태 유지”처럼 보존 조건을 긍정문으로 작성하세요.
화자 ID를 일정하게 유지하고, 대화 언어를 표시하며, 지속 시간에 맞게 줄을 짧게 유지하고, 대화를 분위기음·물리적 소리·관객에게만 들리는 음악과 구분하세요.
아니요. 모델 가중치, 입력 모드, 길이, 해상도, 매개변수는 다를 수 있습니다. 사용 중인 화면의 계약을 항상 확인하세요.
소스 및 검증
마지막 콘텐츠 검증: 2026년 8월 11일. 이 페이지의 템플릿은 연결된 구조를 기반으로 한 독창적인 교육 자료입니다.
소스 자료에 맞는 워크플로를 선택하고 위 프롬프트를 만든 다음 해당 생성기로 가져가세요.