
두 개의 편집 모니터가 나란히 같은 사막 주유소 장면을 재생하고 있으며, 하나는 아래에 끊김 없는 30초 타임라인이 있고 다른 하나는 두 개의 세그먼트로 분할된 타임라인이 있습니다.
20초에 연료 노즐에서 신선한 녹색 풀이 분출됩니다. 아직 물방울이 맺혀 있습니다. 말이 만족스럽게 눈을 가늘게 뜹니다. 주유원의 이쑤시개가 입에서 떨어집니다.
그 개그는 하나의 연속된 30초 샷 안에서만 작동합니다. 8초짜리 클립 네 개를 이어 붙이면 말의 털색이 바뀌고, 선글라스 모양이 바뀌고, 하늘 색조가 한 스탑 따뜻해지며, 결정타는 이음새 어딘가에서 사라집니다.
따라서 Wan 3.0과 Seedance 2.5가 동시에 네이티브 30초, 원패스, 스티칭 없음을 주장하며 등장했을 때, 이는 단순한 벤치마크 이야기가 아니라 AI 비디오 모델이 단일 테이크로 설정, 전환, 그리고 결말을 담아낼 수 있는 최초의 순간이 되었습니다.
사양을 분석하고 알리바바의 공개 데모 파일을 기준으로 점검한 결과, 이에 대해 글을 쓰는 누구도 인쇄하지 않은 사실을 발견했습니다. 두 모델 모두 30초라고 말하지만, 그 30초 아래의 해상도는 전혀 동일한 제품이 아닙니다.
주요 내용
- 두 모델 모두 실제로 단일 패스로 30초를 생성합니다. 그 부분은 마케팅이 아닙니다. Wan 3.0은 스마트 길이 옵션으로 2
30초를 지원하고, Seedance 2.5는 430초를 지원합니다. - 오직 Wan 3.0만이 30초에서 네이티브 1080p를 렌더링합니다. Seedance 2.5는 네이티브로 480p와 720p만 생성합니다. 1080p, 1440p 및 4K 옵션은 720p 소스를 사후 생성 업스케일한 것이며, 자체 API 문서에는 4K 등급이 "네이티브 4K 생성이 아님"이라고 명시되어 있습니다.
- Seedance 2.5는 참조 볼륨에서 승리합니다: 최대 30개의 이미지와 10개의 비디오, 10개의 오디오 파일로 총 50개입니다. Wan 3.0의 제작자 핸드북은 참조를 20개로 제한합니다.
- Wan 3.0에는 다른 모델에는 없는 입력 방식이 있습니다:
.doc,.xls,.ppt,.pdf,.txt파일 및 라이브 웹 페이지를 직접 창의적 참조로 제공할 수 있습니다. - 오직 하나만이 오늘날 알리바바 외부에서 실제로 실행 가능합니다. Wan 3.0은 알리바바 클라우드 모델 스튜디오와 큐원 클라우드에서 공개 베타로 제공되며, 타사 API 접근은 아직 출시 중입니다. Seedance 2.5는 현재 Atlas Cloud에서 라이브로 제공되며, 지속 시간 컨트롤에 30이 있습니다.
- 단 1초도 지불하기 전에 30초 스토리 구조를 테스트해보고 싶으신가요? Atlas Cloud의 무료 AI 광고 스킷 생성기는 무료로 한 번 실행해볼 수 있습니다: 대사와 음향 효과가 포함된 15초 완성 스팟을 워터마크 없이 다운로드할 수 있습니다.
알리바바의 공식 Wan 3.0 데모, 통이 Wan 3.0 제작자 핸드북에서 가져옴. 단일 테이크, 컷 없음, 30.07초. ffprobe로 측정: 1920x1072, 24fps, AAC 스테레오 오디오 내장. 29초의 꼬리 채찍과 이쑤시개가 땅에 닿는 소리를 들으려면 사운드를 켜세요. 비교 및 논평을 위한 참고 자료로만 사용됨.
Wan 3.0 vs Seedance 2.5 네이티브 30초: 이번 달 실제로 변경된 사항
15초는 오랫동안 벽이었습니다. Wan 2.7은 거기서 한계에 도달합니다. Seedance 2.0도 거기서 한계에 도달했습니다. 지난 1년 동안 여러분이 피드에서 본 모든 "1분 AI 영화"는 NLE에서 붙인 4~8개의 클립이었고, 컬러리스트가 이음새를 숨기기 위해 패스를 했습니다.
같은 몇 주 안에 두 가지가 그 벽을 허물었습니다. 알리바바는 2026년 8월 6일에 Wan 3.0 공개 베타를 열었으며, 네이티브 30초 생성과 완전한 멀티모달 참조 입력을 제공했습니다 (AlphaSignal, 2026년 8월). 바이트댄스는 Seedance를 2.5에서 15초에서 30초로 두 배로 늘렸으며, 이를 클립 스티칭과 그에 따른 시각적 드리프트를 줄이는 방법으로 명시적으로 포지셔닝했습니다.
여기서 네이티브는 특정 기술적 의미를 가집니다. 이는 하나의 잠재 시퀀스에 대한 하나의 순방향 패스를 의미하며, 모델이 클립 A의 마지막 프레임을 가져와서 클립 B를 시작하는 마지막 프레임 확장이 아닙니다. 확장이 캐릭터의 재킷 칼라가 샷 사이에서 조용히 모양을 바꾸는 이유입니다. 네이티브 패스는 전체 30초가 동일한 컨텍스트에 있으므로 말은 동일한 말로 유지됩니다.
주유소 데모는 이를 테스트하는 가장 깨끗한 방법입니다. 구조는 4비트입니다: 08초는 아무 일도 일어나지 않음, 816초는 이상한 일이 발생, 1624초는 결정타, 2430초는 퇴장입니다. 개그는 20초에 터집니다. 즉, 말, 선글라스, 청록색과 주황색 그레이딩, 그리고 무표정한 고정 카메라가 모두 처음 19초 동안 손상되지 않아야만 개그가 성공합니다. 스티칭으로는 이것이 불가능합니다. 편집자가 나쁘기 때문이 아니라, 클립 B가 클립 A를 본 적이 없기 때문입니다.
Wan 3.0 vs Seedance 2.5 네이티브 30초: 실제로 그림이 깨지는 지점
30초는 15초의 두 배입니다. 드리프트 위험은 두 배가 아니라 더 심각하며, 다른 실패 모드로 이동합니다.
스티치 워크플로우의 실패는 클립 간에 발생했습니다. 네이티브 30초의 실패는 클립 내부에서 발생합니다. Seedance 2.5 단편 영화 제작에 대한 실습 리뷰에서, 리뷰어는 "캐릭터 모델의 시각적 스파이크 또는 불안정성"으로 나타나는 탈동조화와 모핑을 발견했으며, 이는 빠른 액션 시퀀스에 집중되어 있었고, 이러한 아티팩트는 업스케일링으로 제거할 수 없다고 구체적으로 언급했습니다 (MindStudio, 2026년 8월). 720p로 렌더링한 후 4K로 업스케일링할 계획인 사람에게 중요한 부분입니다. 업스케일러는 모핑을 선명하게 만들 뿐 제거하지 않습니다.
동일한 제작에서 3.2대 1의 촬영 비율이 기록되었습니다. 최종 2분 22초를 편집하기 위해 약 450초의 원시 생성이 필요했습니다. 모든 작업이 배송되는 렌더 큐처럼 생각하지 말고, 커버리지가 있는 촬영처럼 롱 테이크 작업을 계획하십시오.
해당 제작에서 얻은 두 가지 더 중요한 발견이 있습니다. 전체 영화의 시각적 정체성은 시스템이 최대 50개를 수용함에도 불구하고 세 개의 참조 이미지(두 개의 캐릭터 초상화와 하나의 로케이션 플레이트)에 의존했습니다. 그리고 보이스 캐스팅에서 "American"을 작성하면 의도하지 않은 영국 악센트가 수정되었지만, "American English"를 작성하면 수정되지 않았습니다. "English"라는 단어가 전달을 영국식으로 밀었기 때문입니다.
30초를 견디는 프롬프트 구조는 알리바바가 자체 핸드북에서 사용하는 구조입니다: 명시적인 타임스탬프 비트. 분위기 단락이 아닙니다. 0-8s, 8-16s, 16-24s, 24-30s를 작성하고, 각 블록에 자체 카메라 동작과 자체 이벤트를 제공하고, 전체 클립을 다루는 단일 오디오 라인으로 끝냅니다. 아래 4단계에서 정확히 이 뼈대를 볼 수 있습니다. 알리바바의 구조를 유지하고 번역만 했기 때문입니다.
Wan 3.0 vs Seedance 2.5 네이티브 30초: 사양, 가격, 오늘 실행할 수 있는 것
다음은 정직한 현재 상황이며, 두 모델이 더 이상 비교 가능한 제품이 아닌 부분입니다.
해상도 행을 두 번 읽으십시오. 이것이 전체 기사입니다. Atlas Cloud 자체의 Seedance 2.5 텍스트-투-비디오 API 문서는 720p-esr이 480p 소스를 향상시키고, 1080p-esr, 1440p-esr 및 4k-esr이 모두 720p 소스를 향상시키며, 4K 옵션이 2160픽셀 짧은 가장자리를 제공하지만 "네이티브 4K 생성이 아님"이라고 명시합니다. 따라서 4K로 표시된 30초 Seedance 클립은 실제 디테일의 720p를 리샘플링한 것입니다. 반면 Wan 3.0의 가격표는 초당 $0.20인 직선 1080p 등급을 가지고 있으며, 알리바바의 공개 30초 데모 파일은 1920x1072로 측정됩니다.
이 제약 조건의 장점: 전체 테스트가 하나의 브라우저 탭에서 세 가지 모델로 실행되며, 로컬 설정이 필요 없습니다.
| 이 테스트에서의 역할 | 모델 | 나열된 가격 |
|---|---|---|
| 오프닝 프레임 | GPT Image 2 텍스트-투-이미지 | 이미지당 $0.009부터 |
| 네이티브 30초 실행 | Seedance 2.5 텍스트-투-비디오 | 초당 $0.134부터 |
나열된 가격은 2026년 8월 Atlas Cloud 모델 페이지에서 확인되었습니다. 최저 가격으로 읽으십시오. 이 모든 모델은 실제로 요청한 내용에 따라 청구되며, 실행 버튼은 클릭하기 전에 정확한 설정의 가격을 표시합니다. 이 테스트에서 버튼은 품질 높음 및 2048x1152에서 하나의 GPT Image 2 프레임에 대해 $0.1745를, 720p 및 16:9에서 5초 Seedance 2.5 작업에 대해 $1.514799를 인용했으며, 이는 나열된 $0.134가 아닌 초당 약 $0.30에 해당합니다. 나열된 수치는 480p 요금입니다. 카탈로그가 아닌 버튼을 확인하십시오. Seedance 2.5는 또한 50개 참조 상한을 활용하려는 경우 동일한 초당 $0.134에 참조-투-비디오 엔드포인트를 제공합니다.
Seedance 2.5에서 이 네이티브 30초 테스트를 재현하는 방법
5단계, 3개 모델, 모두 브라우저에서. 프롬프트를 그대로 복사하십시오.
1단계: 타임스탬프가 있는 30초 뼈대 고정
아직 아무것도 실행하지 마십시오. 먼저 구조를 읽으십시오. 이것이 30초가 유지되는지 여부를 결정하는 부분이기 때문입니다.
이 기사 상단의 Wan 3.0 주유소 데모는 머리말에 한 번 명시된 고정 카메라 원칙(차분한 객관적 관찰, 고정된 미디엄 와이드, 터무니없는 비트에만 갑작스러운 극단적 클로즈업)과 함께 네 개의 레이블이 지정된 블록으로 구성되어 있습니다. 모든 이벤트는 시간 범위에 고정되어 있습니다. 오디오는 30초 전체를 다루는 끝에 한 줄입니다.
다음은 빈 뼈대입니다. 채우면 네이티브 30초 모델이 실제로 추적할 수 있는 프롬프트가 됩니다:
Plain1[장소]를 배경으로 한 30초 [장르]. [시각적 스타일, 그레이딩, 채도]. 카메라 언어: [원칙], [예외]로 강조됨. 2 30-8초: [설정, 와이드, 정상적인 세계 구축, 지평선에 이상 현상 소개] 4 58-16초: [이상 현상이 작용하지만 여전히 정상으로 처리됨, 하나의 POV 또는 반응 삽입] 6 716-24초: [결말, 사물 자체의 극단적 클로즈업, 하드 컷으로 반응 얼굴로] 8 924-30초: [퇴장, 개그를 닫는 작은 물리적 버튼] 10 11오디오: [앰비언스, 3~4개의 특정 다이제틱 사운드, 하나의 마지막 작은 소리]. 음악 없음, 대화 없음, 화면상 텍스트 없음.
내 수치를 확인하려는 사람을 위한 알리바바 참조 파일의 측정 가능한 사양: 30.07초, 1920x1072, 24fps, AAC 스테레오. 이것이 Seedance 실행이 측정되는 기준입니다.
2단계: 오프닝 프레임 생성
15초 및 30초 실행이 동일한 세계에서 시작되도록 고정된 시각적 앵커가 필요합니다. GPT Image 2 텍스트-투-이미지를 엽니다.
설정: 품질 high, 화면비 16:9, 1개 이미지.
Plain1밝은 사막에서 외로운 Route 66 스타일 주유소의 넓고 완전히 정지된 설정 샷. 레트로 노란색-주황색-파란색 건물, 페인트가 살짝 햇볕에 바랜; 앞에 빛바랜 빈티지 빨간색 연료 펌프; 옆에 문 옆에 빛바랜 콜라 자판기가 있는 작은 편의점. 전경에 갈라진 주황색 마른 흙, 먼 곳에 따뜻한 테라코타 산맥, 구름 한 점 없는 깨끗한 청록색 하늘. 기름진 파란색 작업복과 큰 검은색 선글라스를 쓴 주유소 직원이 문 옆 의자에 반쯤 잠들어 축 처져 있고, 입에 이쑤시개를 물고 있음. 엄격한 밝은 청록색 및 주황색 컬러 그레이딩, 높은 채도, 높은 밝기, 시네마틱 포토리얼, 고정 카메라, 16:9.

Atlas Cloud의 GPT Image 2 플레이그라운드, 품질이 높음 및 16:9로 설정됨, 출력 패널에 생성된 Route 66 주유소 설정 샷
Atlas Cloud의 GPT Image 2: 품질 높음, 16:9, 1개 이미지. 실행 버튼은 이 프레임에 대해 $0.1745를 인용했으며, 이는 2048x1152 고품질 렌더링의 실제 비용입니다. 모델 페이지의 $0.009는 최저 가격입니다.

GPT Image 2로 생성된 Route 66 주유소 설정 프레임, 청록색 하늘과 주황색 갈라진 땅, 직원이 문 옆에서 졸고 있음
오프닝 프레임. 이것은 3단계의 입력이자 4단계의 시각적 목표입니다. openai/gpt-image-2로 생성됨.
3단계: 15초 벽에 도달
설정: 첫 번째 프레임 = 2단계 출력, duration을 최대 15로 드래그, 해상도 1080P.
Plain1고정된 와이드 샷 유지. 챙 넓은 모자를 쓴 카우걸이 지평선에서 걸어오는 진짜 말을 타고 나타남. 졸고 있던 직원이 발굽 소리에 잠에서 깨고, 선글라스를 위로 밀어 올리며, 앉아서 이쑤시개를 씹으며, 감동하지 않은 표정. 그녀는 깔끔하게 내려서서 말을 빈티지 연료 펌프로 바로 이끔. 밝은 청록색 및 주황색 그레이딩, 높은 채도, 포토리얼, 차분한 관찰 카메라, 컷 없음.
드롭다운은 15에서 멈춥니다. 이것이 이 단계의 핵심입니다. 결정타는 20초에 예정되어 있지만, 이 파이프라인은 20초에 도달할 수 없습니다. 도달하려면 마지막 프레임에서 두 번째 클립을 생성해야 하며, 그 순간 말은 새로운 말이 됩니다.

4단계: 전체 네이티브 30초 패스 실행
Seedance 2.5 텍스트-투-비디오를 엽니다.
설정: duration = 30, resolution = 720p, ratio = 16:9, generate_audio = 켜짐, output_format = mp4, 워터마크 끄기.
1080p-esr이 아닌 의도적으로 720p를 선택하십시오. 720p가 모델의 실제 한계이므로 이는 업스케일러와의 비교가 아닌 동등한 픽셀 비교입니다.
아래 프롬프트는 알리바바 자체 주유소 데모 프롬프트로, Wan 3.0 제작자 핸드북에서 충실하게 번역되고 아무것도 없는 구조로 재구성되었습니다. 동일한 비트, 동일한 타이밍, 동일한 카메라 원칙, 동일한 오디오 목록.
Plain1밝은 사막의 햇볕에 바랜 Route 66 스타일 주유소를 배경으로 한 30초의 터무니없는 데드팬 코미디 단편. 포토리얼, 엄격한 밝은 청록색 및 주황색 그레이딩, 높은 채도 및 높은 밝기, 그래서 터무니없는 사건이 완전히 정상적이고 거의 아름다운 세계에서 발생합니다. 카메라 언어: 차분하고 객관적인 관찰, 대부분 고정된 미디엄 와이드 및 느린 수평 드리프트, 감정적 유도 없음, 터무니없는 비트에서 갑작스러운 극단적 클로즈업으로 강조됨. 2 30-8초: 와이드, 고정. 청록색 하늘, 떠다니는 먼지. 레트로 노란색-주황색-파란색 역이 도로 옆에 홀로 서 있음; 기름진 파란색 작업복과 큰 검은색 선글라스를 쓴 직원이 의자에서 졸고 있고, 입에 이쑤시개를 물고 있음. 바람만. 지평선에 카우걸이 진짜 말을 타고 걸어서 나타남. 미디엄으로 컷: 발굽 소리가 그를 깨우고, 그는 선글라스를 밀어 올리고, 앉아서 두 사람을 "또 방향 묻는 사람이군"이라고 읽음. 4 58-16초: 그녀는 아무 말도 하지 않음. 그녀는 깔끔하게 내려서서 말을 오래된 연료 펌프로 곧장 이끔. 말이 마치 전에 해본 것처럼 펌프 옆에 머리를 대충 놓음. 그의 선글라스 뒤에서 약간 물고기 눈의 POV, 여자와 말이 훨씬 더 이상해 보임. 클로즈업: 그의 이마가 찌푸려지고, 그는 선글라스를 벗으며 소리치려 함. 슬로우 모션 클로즈업: 선글라스가 벗겨지면서 그녀가 연료 노즐을 말의 입에 조준하고 방아쇠를 당김. 6 716-24초: 노즐의 극단적 클로즈업. 나오는 것은 휘발유가 아니라 신선한 밝은 녹색 풀의 제트기, 아직 물방울이 맺혀 있음. 직원의 얼굴의 극단적 클로즈업으로 하드 컷, 얼어붙음: 눈은 접시만큼 커지고, 입은 약간 열리고, 이쑤시개는 씹는 중간에 잊혀짐. 미디엄: 말이 행복하게 먹고, 만족스럽게 눈을 가늘게 뜨고, 그런 다음 만족스러운 강력한 꼬리 채찍을 한 번 하며, 그가 일으킨 먼지가 여전히 멍한 직원의 얼굴에 정확히 떨어짐. 8 924-30초: 풀의 "만땅". 그녀는 노즐을 펌프에 다시 걸고, 주머니에서 동전을 꺼내고, 가게 문으로 걸어가서 계산대 위의 깡통에 동전을 덜컥거리며 떨어뜨림. 그녀는 겁에 질린 직원을 뒤돌아봄; 모자 챙 아래 그녀의 입가가 살짝 올라감. 그녀는 다시 말에 올라타고 먼지 흔적을 남기며 떠남. 카메라가 그에게 천천히 밀착됨: 동일한 얼어붙은 자세, 얼굴은 먼지로 뒤덮이고, 선글라스는 여전히 손에 쥐어져 있으며, 마지막으로 이쑤시개가 작은 딸깍 소리와 함께 그의 입에서 떨어짐. 10 11오디오: 내내 건조한 사막 바람, 발굽 소리, 펌프 핸들의 기계적 덜컹거림, 젖은 풀 분출, 꼬리 채찍, 깡통에 떨어지는 동전, 그리고 이쑤시개가 땅에 닿는 하나의 작은 딸깍 소리. 음악 없음, 대화 없음, 화면상 텍스트 없음.
낭비되는 청구서를 피할 수 있는 한 가지 경고가 있으며, 이는 3단계와 동일한 함정입니다: 지속 시간 슬라이더를 30으로 드래그하고, 숫자 상자에 30을 입력하지 마십시오. 상자는 슬라이더가 5초 기본값에 남아 있는 동안 30을 행복하게 표시하며, 실행 버튼은 5초에 대해 인용합니다. 클릭하기 전에 인용문을 확인하십시오. 720p 및 16:9에서 5초 작업은 $1.514799를 인용하므로 실제 30초 패스는 약 6배를 인용합니다.
이 단계에는 완료된 실행 스크린샷이 없습니다. 세 번의 자동 캡처 시도 모두 슬라이더 기본값을 30초 대신 제출했으며, 30초로 표시된 5초 클립을 보여주기보다는 캡처를 생략했습니다. 위의 프롬프트와 설정은 붙여넣고 설정할 정확한 내용입니다.
5단계: 드리프트를 정직하게 읽기
다음은 정확한 프롬프트의 Seedance 2.5 측면으로, 네이티브 30초, 720p, 16:9, 오디오 켜짐으로 생성되었습니다.
Seedance 2.5, 동일한 Wan 3.0 주유소 프롬프트를 그대로 복사: 단일 생성에서 네이티브 30초, 1280x720, 24fps, 오디오 내장. 동일한 4비트, 카우걸과 말 도착, 연료 노즐 개그, 직원의 인지 부조화 클로즈업. 동등한 비교를 위해 상단의 Wan 3.0 클립 옆에 놓으십시오.
두 클립을 나란히 놓고 다섯 가지 특정 사항을 확인하십시오. "어느 것이 더 좋아 보이는지" 확인하지 마십시오. 그것은 취향 논쟁이며 오후를 낭비할 것입니다.
- 코트 및 의상 정체성. 말이 29초에서 6초와 동일한 색입니까? 선글라스가 벗겨져 손에 다시 들어간 후에도 동일한 모양입니까?
- 그레이딩 안정성. 2초와 28초에서 하늘을 샘플링하십시오. 청록색 및 주황색 그레이딩은 긴 생성 동안 사람들이 예상하는 것보다 더 자주 따뜻하게 표류합니다.
- 20초의 물리적 비트. 연료 노즐에서 나오는 풀은 물리학 요청입니다. 무게를 가지고 아치형으로 떨어지거나 텍스처로 페이드 인됩니까?
- 카메라 규율. 프롬프트는 고정되었다고 말합니다. 카메라가 요청되지 않은 푸시인을 얼마나 자주 발명하는지 세십시오. 이것은 가장 일반적인 긴 생성 실패입니다. 모델이 예정된 이벤트가 부족해져서 움직임으로 시간을 채우는 것입니다.
- 빠른 동작 모핑. 꼬리 채찍과 먼지 차기는 클립에서 가장 빠른 동작입니다. MindStudio 제작 노트에 따르면, 이것이 바로 탈동조화가 집중되는 지점이며, 업스케일이 해결하지 못하는 지점입니다.
분위기가 아닌 이 다섯 가지를 점수로 매기십시오. 그것이 고객에게 변호할 수 있는 비교입니다.
Wan 3.0 vs Seedance 2.5 네이티브 30초 매칭 프롬프트 세 개 더
하나의 데모는 일화일 뿐입니다. 다음은 동일한 핸드북에서 가져온 세 개의 공식 Wan 3.0 30초 파일로, 각각 30초 문제의 다른 부분을 강조합니다. 바다 괴물과 다크 판타지 독백의 경우, Seedance 2.5 측면은 동일한 프롬프트로 네이티브 30초에서 생성되었으며 각각 바로 뒤에 삽입되어 있으므로 제 말을 믿기보다는 직접 시청할 수 있습니다.
| 프롬프트 | 강조 테스트 | Wan 3.0 공식 파일, 측정치 | Seedance 2.5 측면, 동일 프롬프트 |
|---|---|---|---|
| 바다 괴물 재난 영화 | 30초 내에 10개의 대본 샷과 오케스트라 악보 | 1920x1072, 24fps, 30.07s, AAC | 30초에서 생성, 아래에 삽입; 하나의 IP 이름과 보트 브랜드 텍스트는 Seedance의 콘텐츠 필터를 통과시키기 위해 제거되었으며, 스토리보드는 그 외에는 동일 |
| 다크 판타지 영어 독백 | 느린 연속 푸시 전반에 걸친 네이티브 영어 음성 및 립싱크 | 1280x720, 24fps, 30.05s, AAC | 프롬프트를 그대로 사용하여 30초에서 생성, 아래에 삽입 |
| 2D 스포츠 애니메이션, 두 줄 프롬프트 | 모델이 거의 지시 없이 30초를 채울 수 있는지 여부 | 1280x720, 24fps, 30.05s, AAC | 여기서 생성되지 않음; 시간에 따른 구조를 읽기 위한 Wan 전용 프레임 그리드로 표시 |
| 채찍 팬 코미디 단편 (제외) | 컷 없이 8개의 채찍 팬과 8개의 감정 비트 | 1280x720, 24fps, 30.04s, AAC | 실행되지 않음: 대화 밀도가 중국어에 특화되어 있으며, 영어 재작성은 공정한 동등 비교가 아님 |
공식 Wan 3.0 데모: 단일 30초 패스 내에 10개의 대본 샷과 전체 오케스트라 빌드, 1920x1072. 이것은 네이티브 1080p에 대한 가장 강력한 주장입니다. 물의 양과 생물의 젖은 피부 디테일은 720p 업스케일이 해결하기보다는 발명하는 부분이기 때문입니다. 알리바바 통이 제작자 핸드북, 비교 및 논평을 위해 사용됨.
Seedance 2.5, 동일한 10샷 재난 프롬프트를 네이티브 30초, 사운드 켜짐. 폭풍에 휩싸인 어선, 겁에 질린 갑판원, 솟아오르는 너울, 그리고 번개 속에서 수면을 깨고 나오는 심해 거대 생물. 하나의 IP 참조와 선체 브랜드 텍스트는 Seedance의 콘텐츠 필터를 통과시키기 위해 제거되었습니다. 스토리보드는 그 외에는 동일하므로, 물의 양과 젖은 피부 디테일이 위의 Wan 3.0 클립과 공정한 동등 비교가 됩니다.
공식 Wan 3.0 데모, 사운드 켜짐. 네이티브 영어 악당 대사, "Void에 충분히 익었군", 컷 없이 단일 느린 상향 틸트로 전달됨. 영어권 팀이 테스트해야 할 클립입니다. 음성, 립싱크 및 30초 연속 카메라 무브가 모두 동시에 유지되어야 하기 때문입니다.
Seedance 2.5, 동일한 다크 판타지 프롬프트를 그대로 복사, 네이티브 30초, 사운드 켜짐. 동일한 보라색 눈의 악당, 별 룬 문양, 그의 열린 손바닥에 형성되는 그림자 성운, 그리고 두 개의 영어 대사. 립싱크와 단일 연속 푸시가 Wan 3.0 측면에서처럼 전체 30초 동안 유지되는지 확인하십시오.
이것의 Seedance 2.5 측면을 실행하는 경우, 두 개의 영어 대사를 그대로 유지하고 제작 노트의 악센트 특이 사항을 기억하십시오: "American English"가 아닌 "American"을 작성하십시오. "English"라는 단어는 전달을 영국식 읽기로 끌어당깁니다.
세 번째는 조용한 놀라움입니다. 알리바바 핸드북의 2D 스포츠 애니메이션 프롬프트는 두 줄입니다. 타임스탬프, 샷 목록 없이, 단지 피곤하고 고통스러운 권투 선수가 헤비백을 치는 것입니다. 이것으로부터의 30초는 모델이 자체 구조를 발명할 수 있는지에 대한 진정한 테스트입니다. 다음은 자체 런타임에 걸쳐 샘플링된 것입니다:

공식 Wan 3.0 2D 스포츠 애니메이션 데모에서 약 1초, 10초, 20초 및 29초에 샘플링된 네 개의 프레임으로, 전체 30초에 걸친 권투 선수의 디자인과 체육관 배경을 보여줌
공식 Wan 3.0 2D 스포츠 애니메이션 데모에서 약 1초, 10초, 20초 및 29초에 샘플링된 네 개의 프레임. 동일한 캐릭터 디자인, 동일한 탱크탑, 동일한 헤비백, 동일한 사물함 줄, 프롬프트가 요청하지 않은 와이드에서 클로즈업 변화에도 불구하고. 클립이 아닌 정지 그리드인 이유는 비교가 동작이 아닌 하나의 파일 내 시간에 걸쳐 있기 때문입니다.
실용적인 해석: 두 줄 프롬프트로 모델은 자체 커버리지를 발명했으며, 고정된 와이드에서 땀과 피로의 클로즈업으로 이동하고, 그 과정에서 캐릭터 디자인을 유지했습니다. 이것이 좋은 소식입니다. 대가는 언제 무슨 일이 일어날지에 대한 통제권을 포기했다는 것입니다. 특정 초에 특정 비트를 맞추기 위해 30초가 필요하다면 타임스탬프를 작성하십시오.
비용을 지불하기 전에 무료로 네이티브 30초 스토리텔링 테스트
Seedance 2.5에서 30초 720p 실행은 실제 해상도가 아닌 카탈로그 최저 가격으로 가격을 책정하면 약 $9입니다. Wan 3.0의 가격표에서 30초 1080p 실행은 $6.00입니다. 생산 기준으로 보면 둘 다 비싸지 않지만, 3.2대 1의 촬영 비율에서는 하나의 클립이 아니라 서너 개를 구매하는 것입니다.
무엇이든 지출하기 전에 더 저렴한 질문에 답할 가치가 있습니다: 내 대본이 실제로 하나의 연속 샷으로 버틸 수 있습니까? 대부분의 30초 실패는 모델 실패가 아닙니다. 구조 실패, 즉 두 개의 비트를 위한 공간이 있었는데 세 개를 억지로 채워넣거나, 8초에서 20초까지 아무것도 전달하지 않으면서 26초에 결정타를 작성한 것입니다.
Atlas Cloud의 무료 AI 광고 스킷 생성기는 그에 대한 답을 무료로 제공합니다. 하나의 제품 설명과 각각 8MB 미만의 최대 4개의 제품 사진을 제공하고, 6가지 스타일(재미있는 밈, 반전, 시트콤, 감동적인, 럭셔리, 또는 하드 셀) 중 하나를 선택하면, 먼저 3초 후크, 갈등 및 반전이 있는 두 캐릭터 대본을 작성한 다음, 그 대본을 중심으로 모든 샷을 구축합니다. 캐릭터는 대사를 소리내어 말하고 음향 효과는 비디오에 렌더링됩니다.
정직한 한계: 15초이며 30초가 아닙니다. 로그인이 필요하며, 크레딧을 충전하기 전에 무료로 한 번 생성할 수 있습니다. 그러나 후크, 갈등 및 반전이 있는 15초는 세 개의 비트가 숨쉬는지 알려줍니다. 구조가 작동하면 동일한 비트를 가져와 1단계의 0-8s / 8-16s / 16-24s / 24-30s 뼈대에 늘리고 실제 네이티브 30초 패스에 9달러를 지출하십시오.
Wan 3.0 vs Seedance 2.5에서 네이티브 30초 클립의 실제 비용
| 설정 | 요금 | 지속 시간 | 클립 하나 |
|---|---|---|---|
| Wan 3.0, 1080p 네이티브 (알리바바 클라우드 전용) | 초당 $0.20 | 30초 | $6.00 |
| Wan 3.0, 720p 네이티브 (알리바바 클라우드 전용) | 초당 $0.10 | 30초 | $3.00 |
| Wan 3.0, 480p 네이티브 (알리바바 클라우드 전용) | 초당 $0.05 | 30초 | $1.50 |
| Seedance 2.5, 720p 네이티브, Atlas Cloud | 초당 $0.30 (720p에서 측정, $0.134부터 나열됨) | 30초 | 약 $9.09 |
| GPT Image 2 오프닝 프레임, 품질 높음, 2048x1152 | 이미지당 $0.009부터 나열됨 | 1개 이미지 | $0.1745 (인용됨) |
실제로 결정하는 비교: 720p에서 Wan 3.0은 720p에서 Seedance 2.5보다 초당 더 저렴하며, 1080p에서는 두 제품 중 실제 픽셀을 판매하는 유일한 제품입니다. Seedance 2.5의 대답은 50개의 참조 슬롯, 라이브 가용성, 그리고 오늘 오후에 배송할 수 있는 작동하는 API입니다.
이러한 네이티브 30초 클립의 출처 및 라이선싱 참고 사항
이 기사의 모든 Wan 3.0 클립 및 모든 Wan 3.0 프롬프트는 알리바바가 공개적으로 배포한 통이 Wan 3.0 제작자 핸드북에서 가져온 것이며, 비교 및 논평을 위해 여기에 재현되었고, 출처를 밝히고, 수정되지 않았으며, 워터마크를 제거하지 않았습니다. Seedance 2.5 출력의 상업적 사용은 바이트댄스 및 Volcengine 이용약관에 따릅니다. Atlas Cloud 측의 API 청구 및 데이터 처리는 Atlas Cloud 자체 이용약관에 따릅니다. 이 테스트에서 실제 사람의 초상은 재현되지 않습니다. 클라이언트 작업을 배송하는 경우, 블로그 요약이 아닌 호출하는 특정 엔드포인트에 대한 모델 이용약관을 읽으십시오.
자주 묻는 질문
Wan 3.0의 네이티브 30초가 실제로 하나의 패스입니까, 아니면 스티치된 클립입니까?
하나의 패스입니다. Wan 3.0은 스마트 지속 시간 옵션으로 2~30초를 단일 생성으로 생성하므로, 클립이 전체 30초가 필요하지 않다고 결정할 수도 있습니다. 이는 첫 번째 클립의 마지막 프레임에서 두 번째 클립이 시드되어 이음새에서 정체성이 표류하는 마지막 프레임 확장과 다릅니다.
30초에서 실제로 1080p인 것은 Wan 3.0과 Seedance 2.5 중 어느 것입니까?
Wan 3.0입니다. 가격표에 네이티브 1080p 등급이 있으며, 알리바바 자체 30초 데모 파일은 1920x1072로 측정됩니다. Seedance 2.5는 네이티브로 480p 및 720p만 생성합니다. 1080p, 1440p 및 4K 옵션은 720p 소스의 향상이며, API 문서는 4K 등급을 "네이티브 4K 생성이 아님"으로 설명합니다.
25초에서 그림이 여전히 무너집니까?
그럴 수 있지만, 실패 형태가 변경되었습니다. 클립 사이의 눈에 띄는 이음새 대신, 샷 내부에서 모핑 및 탈동조화가 발생하며, 빠른 동작 구절에 집중되어 있으며, 업스케일링이 제거하지 않습니다. 문서화된 Seedance 2.5 단편 영화 제작은 3.2대 1의 촬영 비율을 기록했으므로, 커버리지가 있는 롱 테이크를 계획하십시오.
어떤 모델이 더 많은 참조 자료를 사용합니까?
Seedance 2.5, 큰 차이로: 30개의 이미지와 10개의 비디오, 10개의 오디오 파일로 총 50개이며, 참조 비디오 및 오디오는 각각 요청당 최대 30초로 제한됩니다. Wan 3.0의 핸드북은 참조를 20개로 제한하지만, .pdf, .ppt, .xls, .doc, .txt 파일 및 라이브 웹 페이지를 창의적 입력으로 받아들이는 유일한 모델입니다.
Wan 3.0은 오픈 웨이트를 가질 예정입니까?
공식적인 약속은 없습니다. 2026년 8월 공개 베타 기준으로, Wan 3.0 웨이트, Hugging Face 체크포인트 또는 ComfyUI 노드는 게시되지 않았으며, 플래그십 비디오 라인에 대한 공식 오픈 웨이트는 Wan 2.2에서 중단됩니다 (Kingy AI, 2026년 8월). 3.0 웨이트 드롭에 대해 읽은 다른 내용은 알리바바가 달리 말할 때까지 추측으로 처리하십시오.






