가수는 존재하지 않는다. 노래는 당신의 언어가 아니다. 그래도 당신은 느낀다.
이것은 크리에이터 Cia0가 X에 공유한 클립 아래의 반응입니다: 2026년 7월 19일, 노래 중인 캐릭터의 15초 분량으로, "단어 하나도 이해하지 못해도 느낄 수 있는 노래"라고 소개되었습니다. 캡션은 전체 스택을 한 줄에 담았습니다: 이미지에는 Seedream 5.0 Pro, 비디오에는 Seedance 2.0, CapCut에서 실행. 판매 포인트는 디테일 작업입니다. 입술은 보컬을 따라 움직입니다. 머리카락은 실제 머리카락처럼 움직입니다. 얼굴은 포즈가 아닌 감정을 담고 있습니다.
이 가이드는 그 파이프라인을 단계별로 재구성합니다: 어떤 모델이 어떤 작업을 하는지, 이미지-투-비디오 전환에서 감정을 전달하는 프롬프트, 그리고 완성된 MV의 실제 비용.

핵심 요약
- 워크플로우는 이미지 우선입니다: Seedream 5.0 Pro에서 키프레임을 아트 디렉션하는 데 $0.045, 룩이 확정된 후에야 비디오 요금을 지불합니다. 정지 이미지에서 얼굴을 수정하는 비용은 클립을 다시 생성하는 비용의 약 20분의 1입니다.
- Seedance 2.0 이미지-투-비디오는 첫 번째 프레임과 선택적 마지막 프레임을 받아들여 실행당 4~15초를 생성하며 기본 오디오를 제공하고, 마지막 프레임을 반환하여 다음 클립이 샷을 이어갈 수 있습니다.
- 자신의 트랙에 맞춰 캐릭터 립싱크를 하려면 참조-투-비디오 엔드포인트를 사용합니다: 최대 9개의 이미지, 3개의 비디오, 3개의 오디오 클립을 참조로 사용하고 프롬프트에서 @멘션을 사용합니다.
- 40초, 720p 세로 MV는 2026년 7월 할인 요금 기준 약 $10이며, 사운드트랙만 별도 비용입니다.
따라 할 가치가 있는 Seedream + Seedance MV
이틀 사이에 세 개의 게시물과 초기 립싱크 테스트가 이 페어링이 다루는 전체 영역을 스케치합니다. 그중 어느 것도 실험실 데모가 아닙니다. 각각 사용된 도구를 명시합니다.
| 크리에이터 | 게시일 | 클립 내용 | 도구 체인 |
|---|---|---|---|
| @Cia0_exe | 2026년 7월 19일 | 15초 발라드 공연: 립싱크, 헤어 물리, 담긴 감정 | Seedream 5.0 Pro + Seedance 2.0, 캡션에 따라 CapCut에서 실행 |
| @Cia0_exe | 2026년 7월 20일 | 15초의 "최고의 2.5D 애니메이션 액션", 스튜디오에서 "몇 년이 걸리는" 종류 | 동일한 모델 페어링, 타사 앱에서 실행 |
| @tjb_shizuka | 2026년 7월 20일 | 스위스 호수를 배경으로 한 30초 "점적 왜곡" 여행 밈, 포맷 복사 초대 포함 | Seedream 스틸, Seedance 2.0 모션, Mureka V9 사운드트랙, OpenShot 편집 |
| @CuriousRefuge | 2026년 5월 5일 | 실사 및 애니메이션 전반의 다중 화자 립싱크 테스트 | 참조 이미지, 오디오 파일, 카메라 및 대화 프롬프트 |

네 가지 모두에서 반복되는 두 가지가 있습니다. 첫째, 이미지 모델과 비디오 모델은 별도의 작업으로 취급됩니다: 캐스팅은 Seedream에서, 연기는 Seedance에서 이루어집니다. 둘째, 비디오 모델은 스택의 중간일 뿐입니다. 모든 캡션은 그것을 둘러싼 것들을 명명합니다: 실행된 앱, 사운드트랙 소스, 편집자. 두 Cia0 게시물 모두 답글에서 프롬프트가 "중국어"라고 약속하고, 일본어 게시물은 캡션 자체에 네 가지 도구 조립 라인을 명시합니다.
순수 텍스트-투-비디오보다 Seedream 우선 워크플로우가 나은 이유
Seedance 2.0은 완벽하게 훌륭한 텍스트-투-비디오 모드를 가지고 있습니다. 위의 클립을 만드는 사람들은 그것을 건너뛰는데, 그 이유는 산술과 제어 때문입니다.
Atlas Cloud에서 Seedream 5.0 Pro 스틸은 $0.045입니다. 현재 할인으로 5초, 720p Seedance 2.0 클립은 약 $0.97입니다. 잘못된 얼굴, 잘못된 의상, 또는 잘못된 구도를 스틸 단계에서 발견하면 하나의 스틸로 수정됩니다. 비디오 단계에서 발견하면 약 20배의 비용과 대기 시간이 소요되는 완전한 재생성이 필요합니다.
| 직접 텍스트-투-비디오 | Seedream 키프레임 우선 | |
|---|---|---|
| 잘못된 얼굴 수정 비용 | 5초 재생성당 약 $0.97 | 스틸당 $0.045 |
| 샷 간 캐스팅 일관성 | 클립마다 새로운 주사위 굴림 | 동일한 캐릭터 블록, 동일한 얼굴 |
| 프레이밍 제어 | 프롬프트와 바람 | 정확한 구성을 먼저 승인 |
| 실수가 발생하는 단계 | 비싼 단계에서 | 저렴한 단계에서 |
일관성 포인트는 MV에 가장 중요합니다. 뮤직비디오는 같은 얼굴을 8번 또는 10번 다시 사용합니다. 텍스트-투-비디오는 매 생성마다 캐릭터를 재창조합니다. 키프레임 파이프라인은 두 가지 방식으로 정체성을 유지합니다: 승인된 스틸을 각 클립의 첫 번째 프레임으로 재사용하거나, 모든 생성에 동일한 참조 이미지를 제공합니다. 한 번 아트 디렉션하고, 이미 마음에 드는 결정에 애니메이션을 적용하는 데만 비디오 비용을 사용합니다.
Atlas Cloud에서 Seedream + Seedance 워크플로우 실행하기
파이프라인의 두 부분 모두 한 곳에서 실행됩니다. Atlas Cloud는 전체 ByteDance 모델 제품군을 호스팅하므로 Seedream 5.0 Pro (2026년 7월 8일부터 공개 API)와 Seedance 2.0 (2026년 2월 12일 출시)이 동일한 계정, 동일한 크레딧, 동일한 API 형태 뒤에 있습니다. 두 가지 작업 방식이 있습니다: 플레이그라운드를 통해 클릭하거나 코드에서 엔드포인트를 연결합니다.
방법 1: 플레이그라운드에서 MV 샷 생성
1단계: Seedream에서 캐릭터 캐스팅. Seedream 5.0 Pro 플레이그라운드를 열고 키프레임 프롬프트를 작성합니다(전체 레시피는 두 섹션 아래에 있습니다). 지금 당장 전달 형식에 맞게 종횡비를 설정하세요: Shorts 및 TikTok용 9:16, YouTube용 16:9. 각 실행은 $0.045에 하나의 이미지를 반환하므로 얼굴, 의상, 조명이 정확히 맞을 때까지 반복합니다.

2단계: 스틸을 Seedance에 로드. Seedance 2.0 이미지-투-비디오 플레이그라운드를 엽니다. 양식에는 하나의 필수 이미지(승인된 키프레임)와 샷이 특정 구도로 끝나길 원하는 경우 선택적 마지막 프레임 이미지가 필요합니다.
3단계: 모션 프롬프트 작성 및 클립 설정. 지속 시간은 4초에서 15초 또는 모델이 선택하도록 Auto로 설정합니다. 키프레임과 일치하는 비율을 선택하거나 Auto로 둡니다. 해상도 기본값은 720p입니다.
4단계: 세 개의 토글 확인. "오디오 생성"은 클립에 기본 사운드를 제공합니다. "워터마크"는 깔끔한 마스터를 위해 꺼진 상태로 유지합니다. "마지막 프레임 반환"은 닫는 프레임을 별도의 이미지로 제공합니다; 이를 다음 생성의 첫 번째 프레임으로 다시 공급하면 새 클립이 중단된 지점에서 이어집니다. 이 토글은 네 개의 분리된 클립과 하나의 연속적인 공연의 차이를 만듭니다.
5단계: 가격 확인 후 실행. 실행 버튼은 실행하기 전에 정확한 설정 비용을 알려줍니다. 2026년 7월 21일 기준, 5초 720p 클립은 플랫폼의 20% 한정 시간 할인이 적용되어 약 $0.97(정가 약 $1.21)입니다.
방법 2: 하나의 API를 통해 Seedream과 Seedance 연결
1단계: API 키 획득. Atlas Cloud 콘솔에서 키를 생성하고 환경 변수로 내보냅니다. 클라이언트 코드에 절대 포함하지 마십시오.


2단계: API 문서 확인. 엔드포인트, 매개변수 및 폴링 동작은 API 문서에 있습니다. 전체 파이프라인은 두 번의 제출 및 폴링 사이클입니다.
3단계: 두 번의 호출 실행. 먼저 키프레임:
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateImage \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "bytedance/seedream-v5.0-pro/text-to-image", 6 "prompt": "<your keyframe prompt>", 7 "size": "1152*2048" 8 }'
작업이 완료될 때까지 GET /api/v1/model/prediction/를 폴링하고, 출력에서 호스팅된 이미지 URL을 가져와 비디오 호출에 직접 전달합니다:
plaintext1curl -X POST https://api.atlascloud.ai/api/v1/model/generateVideo \ 2 -H "Content-Type: application/json" \ 3 -H "Authorization: Bearer $ATLASCLOUD_API_KEY" \ 4 -d '{ 5 "model": "bytedance/seedance-2.0/image-to-video", 6 "prompt": "<모션 및 공연 프롬프트>", 7 "image": "<Seedream 출력 URL>", 8 "duration": 10, 9 "resolution": "720p", 10 "ratio": "adaptive", 11 "generate_audio": true, 12 "return_last_frame": true 13 }'
image는 URL, Base64 또는 자산 참조를 사용하며, duration은 -1을 허용하여 모델이 선택하도록 합니다. watermark는 기본적으로 false입니다. return_last_frame이 설정되면 완료된 예측에는 마지막 프레임이 이미지로 포함되므로, 스크립트가 루프를 돌 수 있습니다: 클립 생성, 마지막 프레임 가져오기, 다음 클립 제출. 이 루프는 약 30줄의 코드로 전체 MV 파이프라인입니다.
두 호출 모두 동일한 기본 URL, 동일한 Bearer 헤더 및 동일한 예측 폴링을 사용합니다. 이것이 단일 API 설계의 실질적인 이점입니다: Seedream 통합과 Seedance 통합은 모델 문자열과 몇 가지 필드만 다르며, 다음 ByteDance 릴리스도 동일한 코드에 맞춰집니다.
MV 키프레임을 위한 Seedream 5.0 Pro 프롬프트 레시피
MV 키프레임은 캐스팅 결정이므로 프롬프트의 첫 번째 임무는 다시 소환할 수 있는 사람을 정의하는 것입니다. 작업 패턴은 캐릭터 블록입니다: 얼굴, 머리카락, 의상을 고정하는 한 문장, 40~60단어 정도. 프로젝트의 모든 키프레임 프롬프트에서 그대로 재사용됩니다. 단어 하나를 바꾸면 낯선 사람을 캐스팅할 위험이 있습니다.
다음은 해당 패턴의 전체 키프레임 프롬프트입니다:
허리까지 내려오는 검은 머리, 부드럽고 둥근 이목구비, 은색 드롭 귀걸이를 한 젊은 여성, 오버사이즈 크림 니트 스웨터를 입고 있습니다. 그녀는 황혼 무렵 비에 젖은 옥상에 홀로 서 있으며, 어깨 위부터 눈높이에서 프레임이 잡혔습니다. 눈은 반짝이고, 입술은 마치 노래를 부르려는 듯 살짝 벌어져 있으며, 시선은 카메라 바로 옆을 향하고 있습니다. 그녀 뒤에는 차가운 푸른 도시의 빛, 볼에는 따뜻한 가장자리 조명 하나, 얕은 심도, 시네마틱 필름 스틸, 부드러운 그레인, 9:16.
첫 번째 문장이 캐릭터 블록입니다. 그 이후의 모든 것은 샷에 따라 변경됩니다. MV에는 하나의 이미지가 아닌 소규모 커버리지 세트가 필요합니다:
| 샷 | 목적 | 프롬프트에서 변경되는 사항 | 고정되는 사항 |
|---|---|---|---|
| 와이드 | 장소와 분위기 설정 | 위치 세부 정보, 전신 프레이밍 | 캐릭터 블록, 조명 방향 |
| 미디엄 | 절 공연 | "허리 위부터 프레임," 제스처 | 캐릭터 블록 |
| 클로즈업 | 후렴 감정적 정점 | "어깨 위부터," 얼굴 표정의 단서 | 캐릭터 블록 |
두 가지 Seedream 특정 참고 사항. 감정을 라벨이 아닌 물리적 증거로 작성하세요: "눈은 반짝이고, 턱은 긴장하고, 숨을 참음"은 나중에 애니메이션화되지만, "슬픔"은 진부한 표정으로 평평해집니다. 그리고 종횡비를 텍스트뿐만 아니라 크기 선택기에서도 설정하세요. 매개변수가 우선하기 때문입니다. 제외 패턴 및 모델의 알려진 버그를 포함한 더 깊은 프롬프트 해부학은 Seedream 5.0 Pro 전용 프롬프트 가이드를 참조하세요.
립싱크, 물리 및 감정을 위한 Seedance 2.0 프롬프트
키프레임은 Seedance 2.0에 애니메이션할 가치가 있는 얼굴을 제공합니다. 모션 프롬프트는 클립이 공연하는지 아니면 그냥 움직이는지 결정합니다. Seedance 2.0은 기본적으로 이중 채널 오디오를 생성하고 ByteDance의 출시 게시물에 따라 8개 이상의 언어로 음소 수준에서 립싱크하므로 프롬프트의 임무는 무엇이, 누구에 의해, 카메라가 어떻게 처리하는지 알려주는 것입니다.
노래하는 캐릭터로 가는 두 가지 경로가 있습니다.
경로 A, 생성된 노래: 이미지-투-비디오를 유지하고 "오디오 생성"을 켠 다음 프롬프트에서 보컬을 설명합니다. 모델이 음악을 만들고 자체 트랙에 립을 동기화합니다. 이것이 Cia0 스타일의 공연 클립에 가장 빠른 경로입니다.
경로 B, 자신의 트랙: 참조-투-비디오로 전환합니다. 이 엔드포인트는 실행당 최대 9개의 참조 이미지, 3개의 비디오 및 3개의 오디오 클립을 허용합니다. 노래 섹션을 오디오 참조로 업로드하고 키프레임을 이미지 참조로 추가한 다음 프롬프트에서 @멘션하여 캐릭터를 작업에 바인딩합니다. 이것은 Curious Refuge가 5월에 검증한 다중 화자 립싱크 레시피입니다: "참조 이미지," "오디오가 포함된 검은 비디오 또는 오디오 파일," 그리고 "프롬프트(카메라 모션 + VO/대화)." 업로드하기 전에 오디오를 클립 길이로 자르세요; 청구된 토큰은 입력 지속 시간과 출력 지속 시간을 모두 계산하므로 패딩은 실제 비용이 듭니다.

공연과 화면 보호기를 구분하는 신호:
| 원하는 것 | 작동하는 프롬프트 신호 | 이유 |
|---|---|---|
| 읽을 수 있는 립싱크 | 언어와 보컬 스타일 명명: "그녀는 중국어로 느린 발라드를 부르며 부드럽고 숨쉬는 목소리" | 음소 수준 동기화는 무엇이 불려지는지 알아야 함 |
| 헤어 및 패브릭 물리 | 힘에 원인 제공: "돌풍이 그녀의 머리카락을 들어 올리고, 스웨터가 잔물결 친다" | 물리는 형용사가 아닌 명시된 힘을 따름 |
| 보이는 감정 | 시간이 포함된 물리적 단서: "그녀는 지속되는 음에서 눈을 감고, 바깥쪽 구석에 눈물 한 방울" | 모델은 기분보다 행동을 훨씬 잘 애니메이션함 |
| 카메라 느낌 | 클립당 하나의 움직임: "미디엄에서 클로즈업으로 느린 푸시인" | 겹치는 카메라 움직임은 15초 안에 서로 충돌함 |
| 다중 샷 드라마 | 순서대로 시퀀스 설명: "스카이라인으로 열리고, 보컬이 들어오면서 그녀의 얼굴로 컷" | Seedance 2.0은 한 번의 실행에서 다중 샷 시퀀스를 기본적으로 처리함 |
15초보다 긴 것은 체인 작업입니다: 설정 섹션의 마지막 프레임 반환 트릭을 사용하고, 각 새 프롬프트에 노래의 다음 줄을 포함합니다. Seedream 프롬프트의 캐릭터 블록 문구를 모션 프롬프트 내에서도 유지하세요. 중복은 정체성을 위한 저렴한 보험입니다.
Seedance 클립에서 완성된 MV까지: 편집 및 예산
일본어 "점적 왜곡" 게시물은 마무리 단계에 대한 가장 명확한 그림을 제공합니다. 크리에이터가 캡션에 전체 조립 라인을 나열했기 때문입니다: 스틸용 Seedream, 모션용 Seedance 2.0, 사운드트랙용 Mureka V9, 편집용 무료 데스크톱 편집기 OpenShot. Cia0의 클립은 대신 CapCut을 장소로 명명합니다. 어떤 편집기를 선택하든 컷은 동일한 작업입니다: 먼저 전체 트랙을 깔고, 비트에 맞춰 클립을 자르고, 처음부터 끝까지 하나의 종횡비를 유지합니다.

해당 CapCut 경로에 대한 참고 사항. CapCut 내에서 Seedance 2.0은 Dreamina Seedance 2.0으로 실행되며, 2026년 4월 7일부터 미국에서 사용 가능하고, CapCut의 자체 발표에 따르면 실제 얼굴이 포함된 이미지에서 비디오 생성을 차단하고 출력에 눈에 띄는 워터마크를 포함하는 제한 사항이 있습니다. 밈에는 괜찮지만, 깔끔한 MV 마스터에는 제한적입니다. API 및 플레이그라운드 경로는 워터마크를 기본적으로 끄고 생성한 모든 키프레임을 허용합니다.
2026년 7월 Atlas Cloud 할인 요금 기준 전체 비용:
| 단계 | 모델 또는 도구 | 볼륨 | 비용 |
|---|---|---|---|
| 키프레임 | Seedream 5.0 Pro | 10 스틸 @ $0.045 | $0.45 |
| 모션 드래프트 | Seedance 2.0 Mini 이미지-투-비디오 | 4 클립 × 10초 @ $0.045/초 | $1.80 |
| 최종 클립 | Seedance 2.0 이미지-투-비디오, 720p | 4 클립 × 10초 @ 약 $0.1935/초 | 약 $7.74 |
| 사운드트랙 | 자체 트랙 또는 AI 음악 모델 | 1곡 | 다름 |
| 편집 | CapCut 또는 OpenShot | 1세션 | $0 |
| 총계 | 약 40초 완성 MV | 약 $10 |
드래프트 라인은 사람들이 건너뛰지만 건너뛰어서는 안 되는 부분입니다. Seedance 2.0 Mini는 초당 $0.045(정가 $0.056)부터 동일한 첫 번째 프레임 + 프롬프트 워크플로우를 실행하며, 플래그십의 720p 요금의 약 4분의 1이므로 블로킹, 카메라 움직임 및 물리를 최종 렌더링 전에 저렴하게 디버깅할 수 있습니다. 할인이 없으면 동일한 예산이 정가 기준 약 $12.40이며, 대부분의 스톡 푸티지 구독이 한 달에 청구하는 금액보다 여전히 적습니다.
자주 묻는 질문
Seedance 2.0이 내 노래에 맞춰 캐릭터 립싱크를 할 수 있나요?
네. 참조-투-비디오 엔드포인트를 사용하세요. 생성당 최대 3개의 오디오 클립과 9개의 이미지, 3개의 비디오를 함께 사용할 수 있습니다. 노래 섹션을 오디오 참조로 업로드하고 Seedream 키프레임을 이미지 참조로 추가한 다음 프롬프트에서 @멘션하고 공연과 카메라를 설명하세요. 먼저 오디오를 클립 길이로 자르세요. 청구된 토큰은 입력 및 출력 지속 시간을 모두 계산하기 때문입니다.
Seedream과 Seedance 프롬프트는 중국어로 작성해야 하나요?
아니요. Cia0는 프롬프트를 중국어로 공유하고 ByteDance 모델 주변의 중국어 프롬프트 문화가 강하지만, 두 모델 모두 영어 프롬프트를 받아들이며 Seedance 2.0의 립싱크는 8개 이상의 언어에서 음소 수준에서 작동합니다. 중요한 것은 입 모양이 트랙과 일치하도록 프롬프트에서 보컬의 언어를 명명하는 것입니다.
단일 Seedance 2.0 생성의 최대 길이는 얼마인가요?
실행당 4~15초이며, 해당 창 내에서 다중 샷 시퀀스가 지원되거나 지속 시간을 -1로 설정하면 모델이 선택합니다. 전체 MV의 경우 생성을 연결하세요: "마지막 프레임 반환"을 활성화하고 이전 클립의 닫는 프레임에서 다음 클립을 시작하여 공연이 연속적으로 유지되도록 합니다.
내 MV 클립에 워터마크가 생기나요?
API 또는 플레이그라운드에서는 기본적으로 그렇지 않습니다. watermark 매개변수는 false로 설정되어 있어 마스터가 깔끔하게 나옵니다. CapCut 소비자 버전은 다릅니다. Dreamina Seedance 2.0은 눈에 띄는 워터마크를 적용하고 실제 얼굴이 있는 이미지에서 생성을 차단합니다. 이는 2026년에 다시 출시된 보호 장치 패키지의 일부입니다.
완전한 Seedream + Seedance MV의 비용은 얼마인가요?
2026년 7월 할인 요금 기준, 40초 720p 세로 비디오의 경우 약 $10입니다: 키프레임 $0.45, Mini 드래프트 $1.80, 최종 720p 클립 약 $7.74, 편집은 CapCut 또는 OpenShot에서 무료. 정가로는 동일한 실행이 약 $12.40입니다. 키프레임 단계가 그 비용을 낮게 유지하는 이유입니다. 룩 결정이 $0.045에 이루어지고 재생성당 약 $0.97이 아니기 때문입니다.
결론
이번 달에 유포되는 클립들은 비밀 기능의 결과가 아닙니다. 그들은 작업 분업의 결과입니다: Seedream 5.0 Pro는 누가 화면에 있고 프레임이 어떻게 느껴지는지 결정하고, Seedance 2.0은 그들이 어떻게 움직이고 소리내는지 결정하며, 무료 편집기는 클립을 노래와 얼굴이 있는 노래로 바꿉니다. 모든 단계는 검사 가능하며, 모든 실수는 가장 저렴한 장소에서 잡힙니다.
작업 순서를 훔치세요. 캐릭터 블록을 고정하고, $0.045에 실수를 사고, 이미 승인한 것만 애니메이션화하고, 한 클립의 마지막 프레임이 다음 클립을 열게 하세요. 도구는 새롭습니다. 규율은 그저 영화 제작입니다.






