Seedance 2.5 ใช้งานได้แล้ววันนี้ — ที่แรกบน Atlas Cloud

วิธีเขียนพรอมต์ Wan 3.0: สามกรณีตัวอย่างทางการสอนสิ่งที่ไม่มีรายการพารามิเตอร์ใดสามารถ

วิธีการเขียนพรอมต์ Wan 3.0 ที่ถูกถอดรหัสย้อนกลับจากกรณีตัวอย่าง 30 วินาทีอย่างเป็นทางการ: โครงสร้างสามชั้น, การเขียนเชิงประสิทธิภาพ, ไวยากรณ์เสียง, และการควบคุมการเคลื่อนไหว

ตระกูล Wan เป็นตระกูลวิดีโอโอเพนซอร์สที่มีการ fork มากที่สุดบนอินเทอร์เน็ตอยู่แล้ว คลังเก็บ Wan 2.2 และ Wan 2.1 มีดาวประมาณ 17,000 ดาวต่อคลัง (GitHub, สิงหาคม 2026) และหน้า Wan-AI มียอดดาวน์โหลดหลายแสนครั้งต่อเดือนจาก checkpoint ต่างๆ (Hugging Face, สิงหาคม 2026) ดังนั้น เมื่อ Wan 3.0 เข้าสู่ช่วง early access ด้วยความสามารถในการสร้างวิดีโอความยาว 30 วินาทีแบบเนทีฟ, อินพุตอ้างอิงสูงสุด 20 รายการ, และเสียงที่สร้างพร้อมกับภาพในรอบเดียวกัน คำถามแรกไม่ใช่ว่าผู้คนจะใช้งานมันหรือไม่ แต่เป็นว่าจะมีใครรู้วิธีเขียนพรอมต์สำหรับมันหรือไม่

เพราะการสร้างวิดีโอความยาว 30 วินาทีในครั้งเดียวไม่ใช่แค่การขยายคลิป 5 วินาทีให้ใหญ่ขึ้น มันเป็นปัญหาด้านการเขียนที่แตกต่างกัน พรอมต์สำหรับ 5 วินาทีอธิบายภาพที่เคลื่อนไหว พรอมต์สำหรับ 30 วินาทีคือการควบคุมเวลา: ใครเปลี่ยนไป, เมื่อไหร่, ในคัตไหน, ด้วยเสียงอะไรที่อยู่ข้างใต้

คู่มือผู้สร้าง Wan 3.0 ที่แจกจ่ายในช่วง early access มีตัวอย่างพรอมต์และผลลัพธ์ที่ได้รับการยืนยันอย่างเป็นทางการ 19 รายการ ฉันศึกษาทั้ง 19 รายการ จากนั้นเลือกสามรายการที่สอนเทคนิคที่สามารถนำไปประยุกต์ใช้ได้มากที่สุด และแยกส่วนประกอบแต่ละรายการออกมาว่า: พรอมต์ควบคุมอะไรจริงๆ, เหตุใดจึงสร้างขึ้นมาแบบนั้น, และวิธีนำโครงสร้างของมันไปใช้กับช็อตของคุณเอง วิดีโอทุกชิ้นด้านล่างนี้เป็นผลลัพธ์จริงที่ไม่ผ่านการตัดต่อสำหรับกรณีที่กำลังพูดถึง พรอมต์ต้นฉบับของกรณีศึกษาเขียนเป็นภาษาจีน; โครงสร้างที่นำเสนอที่นี่เป็นการเรียบเรียงภาษาอังกฤษของโครงสร้างนั้น และตระกูล Wan รองรับพรอมต์ทั้งสองภาษา

ประเด็นสำคัญ

  • พรอมต์ยาวของ Wan 3.0 มีโครงสร้างร่วมกัน: การผูกข้อมูลอ้างอิงก่อน, กฎสากลเป็นลำดับที่สอง, และรายการช็อตที่มีการระบุเวลาที่สาม พรอมต์ทดสอบสั้นสามารถละเลเยอร์ได้ แต่พรอมต์สำหรับการผลิตจริงไม่ควร
  • เขียนการแสดงเป็นลำดับของการกระทำที่มองเห็นได้ อย่าเขียนเป็นป้ายกำกับอารมณ์ "กังวล" คือความหวัง "การเคี้ยวช้าลง, คิ้วขมวด, สายตาจ้องลงไปที่มือของเธอ" คือคำสั่ง
  • เสียงเป็นส่วนหนึ่งของพรอมต์ ไม่ใช่ขั้นตอนหลังการผลิต บทสนทนาอยู่ในวงเล็บปีกกา, เสียงประกอบและดนตรีมีประโยคของตัวเอง, และความเงียบจำเป็นต้องถูกขออย่างชัดเจน
  • กรณีศึกษาอย่างเป็นทางการมักจะย้ำข้อจำกัดที่สำคัญที่สุดและห้ามความล้มเหลวที่คาดว่าจะเกิดขึ้น พรอมต์ในคู่มือฉบับหนึ่งห้าม "การเคลื่อนที่แบบลื่นไหล" ถึงสามรูปแบบที่แตกต่างกัน เพราะโมเดลมีค่าเริ่มต้นเป็นแบบลื่นไหล
  • การเคลื่อนไหวสามารถวัดปริมาณได้: จำนวนเฟรมต่อการระเบิด, เปอร์เซ็นต์ของความกว้างเฟรมต่อการเคลื่อนที่, จำนวนครั้งที่ทำซ้ำ กรณีศึกษาแมลงปอด้านล่างคือข้อพิสูจน์

การสร้างครั้งเดียว, 30 วินาที, จังหวะสตอรีบอร์ดที่มีหมายเลขสิบจังหวะ และส่วนโค้งของดนตรีเต็มรูปแบบที่เขียนไว้ในพรอมต์เดียว: เรือประมง, พายุ, และสัตว์ทะเลที่ปรากฏตัวตามกำหนดเวลา กรณีศึกษาอย่างเป็นทางการจากคู่มือ Wan 3.0 แสดงผลโดยไม่ผ่านการตัดต่อ

อะไรที่ทำให้การเขียนพรอมต์ Wan 3.0 แตกต่าง

ความสามารถสามประการเปลี่ยนงาน และแต่ละอย่างเพิ่มทักษะการเขียนที่โมเดลที่สั้นกว่าไม่เคยต้องการ

30 วินาทีแบบเนทีฟหมายถึงโครงสร้าง เมื่อโมเดลสร้าง 5 วินาที พรอมต์สามารถเป็นประโยคเดียวที่หนาแน่นได้ ที่ 30 วินาที พรอมต์ที่ไม่มีโครงสร้างจะล่องลอย: ตัวละครเปลี่ยนเสื้อผ้า, กล้องลืมกฎของมัน, ตอนจบไม่เกี่ยวข้องกับตอนเริ่มต้น ทุกกรณีศึกษาระยะยาวในคู่มือต่อสู้กับการล่องลอยด้วยวิธีเดียวกัน: ด้วยขั้นตอนและสถานะสิ้นสุดที่ชัดเจน โครงสร้างนั้นคือแกนหลักของคู่มือนี้

เสียงร่วมหมายถึงการควบคุมเสียง Wan 3.0 สร้างซาวด์แทร็กพร้อมกับภาพ บทสนทนา, เสียงประกอบ, เสียงรอบข้าง และดนตรีล้วนสามารถกำหนดด้วยพรอมต์ได้ ซึ่งหมายความว่าซาวด์แทร็กที่ไม่ได้เขียนไว้ก็คือซาวด์แทร็กที่ถูกสร้างขึ้นแบบกะทันหัน กรณีศึกษาอย่างเป็นทางการปฏิบัติต่อเสียงด้วยระเบียบวินัยเดียวกับแสง: ระบุไว้, กำหนดขอบเขต, และบางครั้งก็จงใจทำให้เงียบ

การอ้างอิงสูงสุด 20 รายการหมายถึงไวยากรณ์การผูก ใบหน้า, เครื่องแต่งกาย, สถานที่, เสียง และแม้แต่ภาพสตอรีบอร์ดสามารถถูกปักหมุดกับเนื้อหาที่อัปโหลดได้ กรณีศึกษาในคู่มือผูกข้อมูลอ้างอิงแต่ละรายการเข้ากับหัวข้อที่มีชื่อเพียงครั้งเดียว จากนั้นใช้ชื่อนั้นซ้ำในทุกช็อตต่อมา หากคุณได้ทดสอบระเบียบวินัยเดียวกันกับรุ่นปัจจุบัน เช่นบน Wan 2.7 reference-to-video เวอร์ชัน 3.0 จะรู้สึกคุ้นเคยมากกว่าใหม่

ไม่มีสิ่งใดต้องเขียนนิยายทุกครั้ง กรณีศึกษาที่ดีที่สั้นที่สุดในคู่มือคือประโยคเดียวเกี่ยวกับยูเอฟโอที่ขโมยวัวในสไตล์วาดด้วยมือ ทักษะคือการรู้ว่าช็อตของคุณต้องการเลเยอร์ใด ซึ่งเป็นสิ่งที่สามกรณีศึกษาด้านล่างนี้มีไว้เพื่อ

โครงสร้างพรอมต์ Wan 3.0: สามเลเยอร์ที่ทุกกรณีศึกษาระยะยาวมีเหมือนกัน

ลอกกรณีศึกษาอย่างเป็นทางการทั้ง 19 รายการออกจนเหลือแต่โครงกระดูก แล้วกรณีศึกษาที่ยาวทั้งหมดจะมีโครงสร้างสามเลเยอร์เดียวกันนี้

เลเยอร์ 1: การผูกข้อมูลอ้างอิง หนึ่งบรรทัดต่อเนื้อหาที่อัปโหลดหนึ่งรายการ ระบุว่ามันคืออะไรและสามารถนำอะไรไปใช้ได้บ้าง กำหนดผู้หญิงในภาพที่ 1 เป็นหัวข้อที่ 1 นำเฉพาะเครื่องแต่งกายจากภาพที่ 2 เสียงสำหรับหัวข้อที่ 2 ตามเสียงที่ 1 ผูกครั้งเดียว จากนั้นอ้างอิงด้วยชื่อตลอดไป พหูพจน์ที่คลุมเครือเช่น "ภาพกำหนดตัวละคร" คือสิ่งที่เลเยอร์นี้มีไว้เพื่อป้องกัน

เลเยอร์ 2: กฎสากล ทุกสิ่งที่ต้องคงอยู่ตลอดทั้งคลิป เขียนก่อนการกระทำใดๆ: รูปแบบภาพและจุดอ้างอิง, ระบบสีที่มีชื่อ, พฤติกรรมของแสง, หลักไวยากรณ์ของกล้อง, ระเบียบวินัยการแสดง, ระเบียบวินัยด้านเสียง, และรายการข้อห้ามความล้มเหลว เลเยอร์นี้คือจุดที่กรณีศึกษาในคู่มือมีความก้าวร้าวมากที่สุด กรณีศึกษาศิลปะการต่อสู้กรณีหนึ่งจำกัดภาพสโลว์โมชั่นไว้ที่สองครั้ง ครั้งละต่ำกว่าหนึ่งวินาที, ห้ามคำบรรยายบนหน้าจอ, ห้ามดนตรีประกอบโดยสิ้นเชิง, และห้ามกล้องอยู่นิ่งนานเกิน 1.5 วินาที

เลเยอร์ 3: ไทม์ไลน์ จังหวะที่มีการระบุเวลาหรือหมายเลข แต่ละจังหวะมีเหตุการณ์หลักหนึ่งเหตุการณ์และสถานะสิ้นสุดที่มองเห็นได้ ไม่ใช่ "พวกเขาสู้กันสักพัก" แต่เป็น "0 ถึง 1.5 วินาที: เขายืนอยู่ที่แนวต้นกก, แสงจากด้านหลัง, ลมในเสื้อคลุมของเขา, และพูดประโยคเดียวของเขา" สถานะสิ้นสุดคือสิ่งที่ทำให้วินาทีที่ 15 สอดคล้องกับวินาทีที่ 5

วิธีที่มีประโยชน์ในการจดจำ: เลเยอร์ 1 คือการแคสต์, เลเยอร์ 2 คือกฎกติกา, เลเยอร์ 3 คือรายการช็อต สามกรณีศึกษาต่อไปนี้แต่ละกรณีเน้นหนักไปที่เลเยอร์ใดเลเยอร์หนึ่งมากที่สุด

กรณีที่ 1: วิธีเขียนพรอมต์ Wan 3.0 สำหรับการแสดง ใบหน้าเดียวตลอด 30 วินาที

กรณีศึกษาที่ดูไม่เด่นที่สุดในคู่มือคือกรณีที่คนส่วนใหญ่ควรศึกษาก่อน: ภาพระยะใกล้คงที่ของหญิงสาวในชุดครุยสีน้ำเงิน ถ่ายค้างไว้เต็ม 30 วินาทีในขณะที่เธอพูด, กังวล, และสุดท้ายมองลงไปที่มือของเธอ

สามสิบวินาที, หนึ่งช็อต, ไม่มีคัต ชุดครุยบอกคุณถึงฉาก, คิ้วบอกคุณถึงความเสี่ยง, และการก้มมองลงไปลงจอดตรงจุดที่พรอมต์กำหนดไว้ทุกประการ กรณีศึกษาอย่างเป็นทางการ, ผลลัพธ์ที่ไม่ผ่านการตัดต่อ

นี่คือสิ่งที่พรอมต์อย่างเป็นทางการทำ ทีละการเคลื่อนไหว ในคำพูดของฉันแทนที่จะเป็นของมันเอง:

  1. กล้องมาก่อนหัวข้อ มันเปิดโดยการล็อกเฟรม: ภาพระยะใกล้ด้านหน้า, ศีรษะและร่างกายส่วนบน, และความไม่สมบูรณ์แบบที่ตั้งใจหนึ่งอย่าง, บุคคลที่สองที่ขอบซ้ายซึ่งเบลออย่างเต็มที่ พื้นหลังที่คุณตั้งชื่อแล้วเบลอคือพื้นหลังที่โมเดลจะไม่ทำให้คมชัดขึ้นกลางช็อต
  2. เครื่องแต่งกายเป็นข้อมูลอธิบาย ชุดครุยสีน้ำเงินหนึ่งชุดแทนที่การอธิบายฉากเป็นย่อหน้า โมเดลอนุมานพิธี, ฝูงชน, วันนั้นได้ เลือกเสื้อผ้าหรืออุปกรณ์ประกอบฉากหนึ่งชิ้นที่บ่งบอกถึงโลก และข้ามการอธิบายโลก
  3. อารมณ์เป็นลำดับของการกระทำที่มองเห็นได้ พรอมต์ไม่เคยขอ "ความวิตกกังวล" มันเขียนการขยับปากขณะที่เธอพูด, คิ้วขมวดเล็กน้อย, สีหน้าที่จริงจังของใบหน้า แต่ละรายการเป็นสิ่งที่กล้องสามารถตรวจสอบได้ ป้ายกำกับอารมณ์คือความหวัง การเคลื่อนไหวของกล้ามเนื้อคือคำสั่ง
  4. การเคลื่อนไหวระดับจุลภาคที่ทำให้สมจริง รายละเอียดสองอย่างทำงานได้มากกว่าสิ่งอื่นใดรวมกัน: กล้องคงการแกว่งไกวแบบถือกล้องด้วยมือที่แผ่วเบา และสายตาของเธอเคลื่อนจากข้างหน้าไปยังมือของเธอ ตามวิถีที่ระบุไว้ ให้ช็อตยาวใดๆ มีการเปลี่ยนแปลงที่ช้าและตั้งใจเช่นนั้นหนึ่งครั้ง แล้วช็อตนั้นจะดูเหมือนถูกกำกับมากกว่าถูกสร้างขึ้น

โครงสร้างที่สามารถนำไปใช้ซ้ำได้ ในภาษาอังกฤษ โครงสร้างเหมือนกับกรณีศึกษา:

Plain
1[ขนาดช็อต] ด้านหน้าของ [หัวข้อ], [รายละเอียดการจัดเฟรม] [องค์ประกอบที่เบลอ] อยู่ที่
2[ขอบ] ของเฟรม [หัวข้อ] สวมใส่ [เสื้อผ้าหนึ่งชิ้นที่บ่งบอกถึงฉากทั้งหมด]
3[หัวข้อ] กำลัง [การกระทำ], ปากขยับ, [รายละเอียดคิ้ว / ตา / กราม] แสงส่องจาก
4[ทิศทาง], รักษา [หมายเหตุเนื้อผิว / ผ้า] กล้องถูกล็อกแต่มีการแกว่งไกวแบบถือกล้องด้วยมือที่แผ่วเบา
5ตลอดทั้งช็อต, [การเปลี่ยนแปลงที่มองเห็นได้ช้าๆ หนึ่งครั้ง: วิถีการมอง, การเปลี่ยนท่าทาง, การวางวัตถุลง]

กรอกเทมเพลตนั้นด้วยหัวข้อของคุณเองก่อนที่จะแตะมหากาพย์ 30 วินาที หากใบหน้าคงอยู่ได้สามสิบวินาที แสดงว่าโครงสร้างของคุณใช้ได้

กรณีที่ 2: วิธีจัดโครงสร้างพรอมต์ Wan 3.0 ความยาว 30 วินาทีเหมือนผู้กำกับ

เรื่องสั้นแนวเหนือจริงในคู่มือเป็นวัตถุสอนโครงสร้างที่ดีที่สุดในเอกสารทั้งหมด: หญิงสาวคาวบอยขี่ม้าจริงเข้าไปในปั๊มน้ำมัน Route 66 ที่เปลี่ยว, หยิบหัวจ่าย, และเติมน้ำมันให้ม้าด้วยหญ้าสด ในขณะที่โลกทัศน์ของพนักงานปั๊มค่อยๆ พังทลายลงอย่างเงียบๆ

สามสิบวินาทีของการตั้งค่าที่เรียบเฉยและมุขภาพที่สมบูรณ์แบบหนึ่งมุข ตลกถูกเขียนลงในโครงสร้าง: การจัดเฟรมแบบสังเกตการณ์คงที่ จากนั้นภาพระยะใกล้สุดขั้วอย่างกะทันหันในจังหวะที่เหตุการณ์ไร้สาระเกิดขึ้น กรณีศึกษาอย่างเป็นทางการ, ผลลัพธ์ที่ไม่ผ่านการตัดต่อ

พรอมต์ของมันถูกจัดเป็นห้าโมดูลที่มีชื่อ และรายการโมดูลนั้นคือบทเรียน:

  1. โลจไลน์ สองประโยคของสิ่งที่เกิดขึ้นและมุขคืออะไร ไม่ใช่ภาพ แต่เป็นเรื่องราว การเขียนสิ่งนี้ก่อนจะบังคับให้คุณรู้ว่า 30 วินาทีมีไว้เพื่ออะไร
  2. ระบบสีที่มีชื่อ ไม่ใช่ "มีสีสัน" แต่เป็นกฎสองสี: ท้องฟ้าสีฟ้าเทาและพื้นดินสีส้ม จากนั้นวัตถุหลักทุกชิ้นถูกกำหนดให้อยู่ฝ่ายใดฝ่ายหนึ่ง: หัวจ่ายสีแดงซีด, ผ้าพันคอสีส้ม, ภูเขาสีเทอร์ราคอตตา ตั้งชื่อระบบ จากนั้นแจกจ่ายมัน ความสม่ำเสมอในวิดีโอ AI มักเป็นปัญหาที่จานสีก่อนที่จะเป็นปัญหาที่ตัวละคร
  3. รายชื่อนักแสดงพร้อมบทบาทการเล่าเรื่อง ตัวละครแต่ละตัวได้รับลักษณะที่มองเห็นได้สองหรือสามอย่าง และที่สำคัญคือ หน้าที่: พนักงานปั๊มถูกกำหนดอย่างชัดเจนให้เป็นผู้แบกรับภาพปฏิกิริยาของภาพยนตร์ การกำหนดหน้าที่บอกโมเดลว่าความสนใจของกล้องควรอยู่ที่ไหนในทุกจังหวะที่ตัวละครนั้นปรากฏ
  4. ปรัชญากล้องที่มีชื่อ กรณีศึกษาสร้างกฎขึ้นมาและกำหนดในหนึ่งบรรทัด: การสังเกตอย่างสงบ บวกกับภาพระยะใกล้ที่ไร้สาระ หมายถึงภาพระยะกลางคงที่และแพนช้าเป็นค่าเริ่มต้น ถูกขัดจังหวะด้วยภาพระยะใกล้สุดขั้วอย่างกะทันหันเมื่อเหตุการณ์ไร้สาระเกิดขึ้นเท่านั้น การตั้งชื่อกฎกล้องของคุณแล้วอ้างอิงถึงมัน ดีกว่าการอธิบายการเคลื่อนไหวของกล้องซ้ำในทุกจังหวะ มันยังเป็นกลไกตลกทั้งหมดด้วย: สายตาที่ราบเรียบทำให้ภาพระยะใกล้ของหัวจ่ายหญ้าส่งผลกระทบ
  5. ไทม์ไลน์สี่องก์พร้อมสถานะสิ้นสุด การตั้งค่า, การเพิ่มความรุนแรง, มุขเด็ด, ผลที่ตามมา แต่ละองก์มีช่วงเวลา, เหตุการณ์หลักหนึ่งเหตุการณ์, และภาพสุดท้ายที่หยุดนิ่ง ลงไปจนถึงไม้จิ้มฟันที่หลุดจากปากพนักงานในจังหวะสุดท้าย

โมเดลที่สามารถถ่ายโอนได้นั้นใหญ่กว่าตลก โลจไลน์, กฎสี, นักแสดงพร้อมหน้าที่, กฎกล้องที่มีชื่อหนึ่งข้อ, สี่องก์พร้อมสถานะสิ้นสุด: นั่นคือบทสรุปการผลิต และ Wan 3.0 คือรุ่นแรกของตระกูลนี้ที่มีรันเวย์เพียงพอ 30 วินาทีของมัน ที่บทสรุปจะมีความหมาย การแสดงสัตว์ทะเลที่ด้านบนของบทความนี้คือโครงร่างเดียวกันที่สิบจังหวะพร้อมส่วนโค้งของดนตรีที่ให้คะแนน เขียนในลักษณะเดียวกัน: แต่ละจังหวะหนึ่งเหตุการณ์, แต่ละจังหวะมีสถานะสิ้นสุดที่มองเห็นได้

กรณีที่ 3: การเขียนฟิสิกส์การเคลื่อนไหวลงในพรอมต์ Wan 3.0

สิ่งที่ยากที่สุดที่จะได้รับจากโมเดลวิดีโอใดๆ คือการเคลื่อนไหวที่ไม่ราบรื่น โมเดลมีแนวโน้มไปทางการเคลื่อนไหวที่นุ่มนวลและต่อเนื่อง ซึ่งเป็นสาเหตุที่นางฟ้า AI ทุกคนลอยเหมือนบอลลูนช้าๆ นางฟ้าในคู่มือไม่ลอย เธอเคลื่อนไหวเหมือนแมลงปอ: โฉบนิ่ง, พุ่งทันที, หยุดนิ่ง, เปลี่ยนทิศทางใหม่

นางฟ้าตัวเล็กผมสีชมพูมีปีกโฉบเหนือพรม

โฉบ, พุ่ง, หยุดนิ่ง ความเบลอตรงกลางของการระเบิดแต่ละครั้งกว้างหนึ่งหรือสองเฟรม ตรงตามที่พรอมต์กำหนดงบประมาณไว้ กรณีศึกษาอย่างเป็นทางการ, แสดงเป็น GIF เงียบ; คลิปที่ส่งมอบมีเสียงรอบข้างของตัวเอง

พรอมต์นี้ชนะด้วยเทคนิคสี่ประการที่คุณสามารถนำไปใช้ได้โดยตรง:

  1. การประกาศลำดับความสำคัญไว้ข้างบน บรรทัดแรกประกาศข้อกำหนดสำคัญสูงสุดเพียงข้อเดียว กฎการเคลื่อนไหวแบบแมลงปอ ก่อนทิวทัศน์ใดๆ ความสนใจคืองบประมาณ ใช้โทเค็นเริ่มต้นกับกฎที่ตัดสินความสำเร็จ ไม่ใช่กับสีของพรม
  2. จุดยึดฟิสิกส์ในโลกจริง แทนที่จะใช้คำคุณศัพท์ เช่น "เร็วและว่องไว" พรอมต์ตั้งชื่อสัตว์ที่มีลายเซ็นการเคลื่อนไหวที่โมเดลเคยเห็นมาหลายพันครั้ง: โฉบจุด, พุ่งตัว, หยุดเต็มที่, เปลี่ยนเป้าหมายอย่างคมชัด จุดยึดที่คุ้นเคยหนึ่งจุดมีประสิทธิภาพเหนือกว่าคำวิเศษณ์นามธรรมสิบคำ
  3. ตัวเลขที่คำคุณศัพท์จะทำให้คลุมเครือ การพุ่งต้องข้าม 60 ถึง 90 เปอร์เซ็นต์ของความกว้างเฟรมภายใน 3 ถึง 5 เฟรม การหยุดต้องคงอยู่ 2 ถึง 4 เฟรม ต้องมีการระเบิดที่แยกออกจากกันอย่างน้อยหกครั้งในแปดวินาทีแรก ความเบลอของการเคลื่อนไหวที่เหลือถูกกำหนดงบประมาณไว้ที่ 1 ถึง 2 เฟรม ณ จุดนี้คุณไม่ได้เขียนบทกวี คุณกำลังเขียนข้อกำหนด และโมเดลให้เกียรติมัน ดูแถบด้านล่าง: เฟรมกลางการพุ่งคือเส้นล้วนๆ เฟรมด้านข้างทั้งสองด้านคมชัด
  4. การห้ามค่าเริ่มต้น พรอมต์ห้ามความล้มเหลวที่มันคาดการณ์ไว้อย่างชัดเจน ในหลายรูปแบบ: ไม่มีการลอยของนางฟ้าช้าๆ, ไม่มีการเคลื่อนที่ด้วยความเร็วคงที่, ไม่มีการร่อนเรียบต่อเนื่อง และจากนั้นประโยคแก้ไขที่บอกว่าการเคลื่อนไหวไม่ใช่อะไร "ไม่ใช่เส้นทางการบินต่อเนื่อง แต่เป็นการเคลื่อนที่แบบสั้น คมชัด เกือบจะข้ามเฟรม" เมื่อคุณรู้ว่าโมเดลจะทำอะไรบนระบบอัตโนมัติ ให้เขียนระบบอัตโนมัตินั้นออกจากช็อต

นางฟ้าของเล่นผมสีชมพูบินอยู่ท่ามกลางตุ๊กตาหมีและบล็อกสีสันสดใส

สี่ภาพนิ่งต่อเนื่องกันจากกรณีแมลงปอ: โฉบข้างตุ๊กตาหมี, ความเบลอของการเคลื่อนไหวกลางพุ่ง, การมาถึงเหนือบล็อก, การโฉบหยุดนิ่ง

สี่เฟรมจากผลลัพธ์ด้านบน คม, เป็นเส้น, คม, คม: งบประมาณความเบลอจากพรอมต์ มองเห็นได้ทีละเฟรม

เทคนิคสี่อย่างเดียวกันนี้สามารถนำไปใช้กับปัญหาการเคลื่อนไหวใดๆ: การแพนแบบแส้ที่ต้องไม่กลายเป็นคัต, การกระแทกที่ต้องมีน้ำหนัก, การเคลื่อนไหวเชิงกลที่ต้องไม่กลายเป็นออร์แกนิก ยึด, วัดปริมาณ, จัดลำดับความสำคัญ, และห้ามค่าเริ่มต้น

บทสนทนา เสียง และไวยากรณ์การอ้างอิงในพรอมต์ Wan 3.0

สามกรณีศึกษาข้างต้นเงียบเกี่ยวกับกลไกที่ทำให้พรอมต์ Wan 3.0 พูดได้ ดังนั้นนี่คือเลเยอร์ไวยากรณ์ รวบรวมจากกรณีศึกษาที่เหลือในคู่มือ

บทสนทนาอยู่ในวงเล็บปีกกา บทพูดถูกห่อด้วย {กล้ามเนื้อส่วนไหนวันนี้} แทนที่จะปล่อยเป็นร้อยแก้วเปิด ซึ่งช่วยให้โมเดลไม่เล่าบทสนทนาของคุณเป็นคำบรรยาย บทพูดจะลงตรงกับริมฝีปาก และฉากสนทนาจะถูกเขียนเป็นการสลับระหว่างการกระทำและบรรทัดในวงเล็บปีกกา เหมือนกับบทภาพยนตร์ทุกประการ

เสียงสามารถแคสต์ได้ ไวยากรณ์การอ้างอิงขยายไปถึงเสียง: กำหนดผู้หญิงในภาพที่ 1 เป็นหัวข้อที่ 1 จากนั้นระบุว่าเสียงของหัวข้อที่ 1 ตามเสียงที่ 1 ใบหน้าจากไฟล์หนึ่ง เสียงจากอีกไฟล์หนึ่ง ทั้งคู่ถูกล็อกตลอดระยะเวลา

เสียงต้องการคำชี้แจงระเบียบวินัย กรณีศึกษาที่แข็งแกร่งที่สุดประกาศซาวด์สเคปของพวกเขาแบบเดียวกับที่ประกาศจานสี กรณีศึกษาแอนิเมชันระบุประเภทเสียงล่วงหน้า: เสียงรอบข้างและดนตรีเท่านั้น ไม่มีคำพูด กรณีศึกษาศิลปะการต่อสู้ไปไกลกว่านั้น ห้ามดนตรีประกอบโดยสิ้นเชิง คงไว้เพียงการหายใจ, เสียงเสียดสีของผ้า, เสียงต่อยและลม และมันได้ผลลัพธ์นั้นอย่างแม่นยำ ดนตรี เมื่อต้องการ จะถูกเขียนเป็นส่วนโค้งตลอดไทม์ไลน์ จากเสียงดังก้องต่ำน่าหวาดกลัว ผ่านการเพิ่มความรุนแรงของสาย ไปจนถึงการกระทบของทองเหลืองและโน้ตแห่งหายนะที่ยาวนาน ซึ่งแมปไปยังจังหวะที่ต้องตี

ความเงียบก็เป็นคำขอเช่นกัน หากไม่มีการระบุ โมเดลจะเติมเต็มแทร็ก หากช็อตของคุณต้องการเพียงเสียงในห้องและเหตุการณ์เสียงเดียว ให้พูดเช่นนั้น การควบคุมเสียงใน Wan 3.0 ไม่ใช่เครื่องปรุง มันคือครึ่งหลังของสื่อ

ฝึกฝนสูตรพรอมต์ Wan 3.0 ได้ที่ไหนในวันนี้

Wan 3.0 ยังมาไม่ถึง และผู้ใช้ยังไม่สามารถใช้งานได้ในตอนนี้ โครงสร้างข้างต้นยังคงมีประโยชน์ในตอนนี้ เพราะไม่มีอะไรในนั้นถูกล็อกกับเวอร์ชัน: การผูกข้อมูล, กฎสากล, ไทม์ไลน์, บทสนทนาในวงเล็บปีกกา และการห้ามค่าเริ่มต้น ทั้งหมดทำงานบน Wan รุ่นปัจจุบัน

ทั้งตระกูลปัจจุบันใช้งานได้บน Atlas Cloud, Wan 2.7 text-to-video, image-to-video, reference-to-video และ video editing ด้วยคีย์เดียว ราคาต่อรันแสดงก่อนที่คุณจะกดรัน แบบฝึกหัดปฏิบัติ: นำโครงกระดูกกรณีที่ 1 มาใส่หัวข้อของคุณเอง แล้วรันเป็นช็อตสั้นบน Wan 2.7 text-to-video หากห่วงโซ่การแสดงใช้ได้ที่นั่น ไฟล์เดียวกันนั้นคือร่าง Wan 3.0 ของคุณในวันแรก โดยปรับระยะเวลาให้ยาวขึ้นแทนที่จะเขียนใหม่ Atlas Cloud มีนิสัยในการเข้าถึง Day-0 เมื่อตระกูลนี้อัปเดต ดังนั้นสภาพแวดล้อมการฝึกฝนและปลายทางมีแนวโน้มที่จะเป็นหน้าเดียวกัน

คำถามที่พบบ่อย

พรอมต์ Wan 3.0 ควรยาวแค่ไหน?

ยาวเท่าที่ช็อตต้องการและไม่ยาวไปกว่านั้น คู่มืออย่างเป็นทางการมีตั้งแต่หนึ่งประโยค (มุขยูเอฟโอวาดด้วยมือ) ไปจนถึงพรอมต์ที่มีความยาวกว่าพันคำสำหรับภาพยนตร์สัตว์ประหลาดสิบจังหวะ ตัวแปรที่ตัดสินคือระยะเวลาและขนาดของนักแสดง: การทดสอบหัวข้อเดียวยาว 5 วินาทีต้องการหนึ่งประโยคที่หนาแน่น เรื่องราวหลายตัวละครยาว 30 วินาทีต้องการทั้งสามเลเยอร์: การผูกข้อมูล, กฎสากล และไทม์ไลน์

Wan 3.0 สร้างเสียงจากพรอมต์หรือไม่?

ใช่ เสียงถูกสร้างในรอบเดียวกันกับภาพ บทสนทนาเขียนในวงเล็บปีกกาและลงตรงกับริมฝีปาก เสียงประกอบและเสียงรอบข้างเขียนเป็นร้อยแก้ว และดนตรีสามารถควบคุมได้เป็นส่วนโค้งตลอดไทม์ไลน์ ระเบียบวินัยนั้นใช้ได้ทั้งสองทาง: หากคุณต้องการความเงียบเกือบสมบูรณ์ หรือเสียงรอบข้างที่ไม่มีดนตรีประกอบ คุณต้องพูดเช่นนั้น มิฉะนั้นโมเดลจะเติมเต็มแทร็กด้วยตัวเอง

ไวยากรณ์วงเล็บปีกกาในพรอมต์ Wan 3.0 คืออะไร?

วงเล็บปีกกาทำเครื่องหมายคำที่ตัวละครพูดออกมา เช่น {เจอกันที่เส้นชัย} การเก็บบทสนทนาไว้ในวงเล็บปีกกาจะแยกมันออกจากคำอธิบายฉาก ดังนั้นโมเดลจะแสดงบทสนทนานั้นแทนที่จะแสดงภาพประกอบ สำหรับงานหลายภาษา ให้ระบุภาษาก่อนบรรทัดและรูปแบบการนำเสนอด้วย

จะรักษาความสม่ำเสมอของตัวละครตัวหนึ่งในวิดีโอ Wan 3.0 ยาว 30 วินาทีได้อย่างไร?

ผูกตัวละครเข้ากับข้อมูลอ้างอิงครั้งเดียว โดยกำหนดขอบเขต: กำหนดบุคคลในภาพที่ 1 เป็นหัวข้อที่ 1 นำเฉพาะใบหน้า ผม และเครื่องแต่งกาย จากนั้นพูดชื่อหัวข้อซ้ำในทุกจังหวะไทม์ไลน์ที่พวกเขาปรากฏ และระบุลักษณะสองหรือสามอย่างที่ถูกล็อกอีกครั้งในทุกช่วงเวลาที่มีความเสี่ยงสูง เช่น การกระทำที่เกี่ยวข้องกับเครื่องแต่งกายหรือการเปลี่ยนแปลงแสง กรณีศึกษาฉากต่อสู้ในคู่มือยังระบุการล็อกลักษณะซ้ำต่อโมดูล ซึ่งเป็นเวอร์ชันที่รัดกุมเป็นพิเศษ

สามารถฝึกเขียนพรอมต์ Wan 3.0 ก่อนที่จะมีสิทธิ์เข้าถึงได้หรือไม่?

ได้ และคุณควรทำ โครงสร้างสามเลเยอร์, บทสนทนาในวงเล็บปีกกา, การผูกข้อมูลอ้างอิง และเทคนิคการห้ามค่าเริ่มต้น ทั้งหมดทำงานบนตระกูลปัจจุบันในวันนี้ Wan 2.7 บน Atlas Cloud ครอบคลุม text-to-video, image-to-video, reference-to-video และ video editing ด้วยคีย์เดียว ดังนั้นเทมเพลตที่พิสูจน์แล้วที่นั่นสามารถถ่ายโอนไปยัง 3.0 โดยเป็นการเปลี่ยนแปลงระยะเวลาแทนที่จะเป็นการเขียนใหม่

บทสรุป

กรณีศึกษาอย่างเป็นทางการ 19 รายการพูดสิ่งเดียวกันในสามวิธีที่แตกต่างกัน: พรอมต์ Wan 3.0 คือเอกสารการผลิต ไม่ใช่คำบรรยายภาพ แคสต์ข้อมูลอ้างอิงของคุณ, กำหนดกฎสไตล์ของคุณ, กำหนดเวลาจังหวะของคุณ, และปฏิบัติต่อเสียงเป็นครึ่งหนึ่งของภาพ เริ่มต้นด้วยโครงกระดูกภาพระยะใกล้ของบัณฑิต, ก้าวไปสู่บทสรุปห้าโมดูล, และเก็บข้อกำหนดการเคลื่อนไหวที่กำหนดงบประมาณเฟรมไว้สำหรับช็อตที่ต้องการมัน โมเดลจะเปลี่ยนแปลงต่อไป วินัยในการเขียนเวลาแทนที่จะอธิบายภาพคือส่วนที่คุณจะได้เก็บไว้

โมเดลล่าสุด

API เดียวสำหรับ AI สื่อทุกประเภท

สำรวจโมเดลทั้งหมด