HANYA DUA MINGGU | DISKON 20% untuk Seedream 5.0 Pro!

Panduan Prompt MiniMax H3: Saya Membaca Semua 45 Prompt Resmi, Lalu Membakar Anjing This Is Fine

Panduan prompt MiniMax H3 yang disusun dari semua 45 contoh prompt MiniMax: struktur enam blok, trik end_image, isyarat audio asli, dan perbaikan teks berantakan.

Kamu sudah tahu cara memberi prompt pada model video. "Pencahayaan sinematik, push in pelan, 4K." Kosakata itu sudah menemanimu selama dua tahun.

Lalu kamu tempel ke MiniMax H3 dan mendapat klip 2K yang datang dengan soundtrack-nya sendiri. Gambarnya tampak bagus. Ritmenya berantakan. Dua huruf di judulmu salah eja. Audionya semacam room tone yang dipilihkan model untukmu.

Modelnya bukan masalahnya. Kamu memberinya satu kalimat. Ia menginginkan jadwal.

Jadi saya membaca semua 45 contoh prompt yang disertakan MiniMax dengan H3, plus klip jadi yang menyertainya, dan membedah bingkai-bingkainya. Prompt resmi itu bukan deskripsi. Yang bagus adalah daftar shot dengan lembar isyarat musik yang ditempel di belakangnya. Di bawah ini strukturnya, parameter yang benar-benar terbuka saat ini, dan satu demo yang bisa kamu reproduksi dalam sekitar dua puluh menit.

Poin-poin penting

  • Prompt H3 adalah linimasa, bukan deskripsi. Contoh resmi terkuat benar-benar mengiris klip dengan penanda [0s-2s], [2s-4s], dan film jadinya tepat di setiap beat.
  • Suara dan gambar keluar dari proses yang sama, jadi audio harus hidup di dalam tubuh prompt. Prompt resmi memberinya blok sendiri, sampai ke "groove bass jazz masuk di detik ke-6."
  • Teks yang kamu eja akan kembali bersih. Teks yang tidak kamu eja kembali sebagai noise berbentuk huruf. Saya punya potongan bingkai dari satu klip resmi yang membuktikan keduanya sekaligus.
  • image-to-video menerima end_image. Beri bingkai pertama dan bingkai terakhir, dan arc emosional sudah terkunci sebelum kamu menghabiskan satu detik pun komputasi.
  • Panjang prompt bukan sebuah keunggulan. Prompt resmi pendek berhasil ketika gambar referensi yang melakukan deskripsi. Panjang mengikuti seberapa banyak pekerjaan yang kamu tolak untuk diserahkan ke referensi.

Anjing This Is Fine, masih di kiri dan terbakar dalam 10 detik output MiniMax H3 di kanan

Itu gambar yang sama di kedua sisi. Kiri panel asli KC Green, tak tersentuh. Kanan satu panggilan image-to-video: bingkai pertama masuk, bingkai terakhir masuk, sepuluh detik keluar, dan kresek api serta "this is fine" datar kecil itu track audio buatan model sendiri. Tidak ada yang mengisi musik. Semua dalam panduan ini diarahkan untuk membawamu ke paruh kedua itu.

Seperti Apa Sebenarnya Prompt MiniMax H3 (Saya Membaca Semua 45)

Setiap "panduan prompt MiniMax H3" yang saat ini ada di halaman pertama pencarian adalah lembar spesifikasi: 2K, 24fps, 5 hingga 15 detik, audio native. Itu kartu model. Bukan prompt.

Ini yang asli. Ini potongan prompt resmi di balik sekuens judul noir MiniMax, diterjemahkan dari bahasa Mandarin aslinya, kira-kira sepertiga dari panjang penuhnya:

Hasilkan sekuens judul film kriminal ringan-suspense 15 detik 16:9. Gaya keseluruhan mengacu pada bahasa visual gambar-gambar ini: kartu judul anime Jepang retro, siluet bertepi keras, kolase komik, layar terbelah asimetris, blok warna geometris kuat, kredit judul bahasa Inggris, sedikit dekorasi katakana Jepang, nuansa jazz-kriminal. Suasananya 60% suspense, 40% jazz: misterius, keren, lincah, kriminal-perkotaan, bukan horor, tidak berat, dan jangan jadikan MV jazz yang ceria.

[...] Kredit bahasa Inggris harus terbaca jelas [...] Jangan tambahkan bahasa Mandarin, jangan hasilkan teks kacau, jangan salah eja bahasa Inggris. Aturan untuk keseluruhan karya: setiap kredit bahasa Inggris dan jabatan muncul tepat satu kali. Jangan ulangi jabatan, jangan ulangi nama, jangan beri satu orang beberapa jabatan.

Transisi harus bervariasi: mask cakram vinyl melingkar, wipe pintu mobil vertikal, bayangan panjang sesosok figur menyapu layar, potongan garis merah, mask huruf Inggris raksasa, komposisi ulang bingkai layar terbelah, potongan blok warna tegas, panel ditempel blok demi blok. Semua transisi mendarat di pukulan drum: renyah, suspense, lincah, kolase-komik. Tanpa dissolve lembut, tanpa transisi mengalir.

BGM: musik judul asli 15 detik, 60% suspense, 40% jazz. Dibangun dari nada bass yang berkelanjutan, senar pizzicato tegang, denyut synth dingin, kick drum, brush jazz jarang, fragmen walking bass, frase bariton saksofon pendek, dan stab brass singkat. 2 detik pertama membangun suspense dengan frekuensi rendah dan hi-hat, di detik ke-3 drum rendah masuk, di detik ke-6 groove bass jazz bergabung, di detik ke-10 riff saksofon/brass pendek muncul, 2 detik terakhir menguncinya dengan akord tegang dan pukulan drum.

Perhatikan ke mana kata-kata itu pergi. Hampir tidak ada yang pergi ke "indah" atau "sinematik". Kata-kata itu pergi ke daftar negatif, daftar transisi, dan lembar isyarat musik per detik. Itulah bentuk pekerjaannya. Spanduk anime noir menampilkan figur siluet di kereta bawah tanah Sekuens judul noir resmi MiniMax H3: MIDNIGHT LINE, dengan kredit STARRING yang bersih

Lihat kredit di klip itu. MIDNIGHT LINE, STARRING, MAYA CROSS, REN KATO, LENA WARD, DIRECTED BY NOAH VOSS. Dieja dengan benar, tidak ada jabatan yang dipakai dua kali, dekorasi katakana duduk di tempat yang diminta. Prompt-nya tidak mengatakan "buat judul yang bagus." Ia mengatakan tanpa pengulangan, tanpa salah eja, tanpa bahasa Mandarin, dan menyebut estetika dengan lima cara berbeda. Lima panel noir sinematik menampilkan karakter siluet dalam biru dan oranye Lima papan referensi gaya yang diberikan ke MiniMax H3 bersama prompt judul noir

Lima papan itu masuk bersama teks. Lima gambar plus satu brief panjang, satu generasi. Itulah seperti apa pekerjaan ini sekarang.

Dan alasan begitu banyak dari 45 prompt yang pendek ada tepat di gambar itu. Di seluruh kumpulan, median prompt sekitar 130 karakter Mandarin, tapi dua yang terpanjang mencapai 657 dan 858. Yang pendek pendek karena papan referensi yang membawa deskripsi. Yang panjang panjang karena tidak ada hal lain yang bisa membawanya.

Mengapa Kebanyakan Prompt MiniMax H3 Keluar Datar, dan Perbaikan Teks Kacau

Tiga hal yang salah, dan semuanya adalah ketiadaan, bukan kesalahan.

Tidak ada linimasa. Kamu minta sepuluh detik dan menggambarkan satu momen, jadi kamu dapat satu push-in pelan yang diregangkan selama sepuluh detik. Model tidak punya aktivitas di detik ketujuh.

Tidak ada blok audio. Suara dihasilkan dalam proses yang sama dengan gambar. Jika kamu tidak mengatakan apa-apa, model tetap mengirimkanmu sebuah track. Ia hanya memilih satu.

Tidak ada daftar negatif. Dibiarkan sendiri, model meraih dissolve lembut, menciptakan teks layar tambahan, dan menambahkan strip subtitle yang tidak diminta siapa pun.

Bukti paling jelas adalah prompt UI gim resmi, yang dibangun dari enam beat berstempel waktu: [0s-2s] menu, [2s-4s] panel lengan kanan, [4s-7s] grid persenjataan, [7s-8.5s] konfirmasi, [8.5s-10s] bilah pemuatan, [10s-15s] dunia dimuat. Klip jadinya mengenai keenamnya, berurutan, tepat waktu. Menu gim menampilkan pemilihan lengan Phantom Grip robotik Klip UI gim MiniMax H3: menu, panel perlengkapan, bilah pemuatan, pemuatan dunia

Sekarang bagian jujurnya, dari klip yang sama, pada resolusi penuh 2560x1440. Perbandingan teks UI gim yang terbaca dan teks AI yang kacau Kiri: teks yang dieja di prompt tampil bersih. Kanan: teks yang tidak dieja tampil sebagai noise berbentuk huruf

Di kiri, setiap string yang benar-benar diketik prompt: RIGHT ARM EQUIPMENT, PHANTOM GRIP, CHRONOS CLAW. Tajam, benar, kerning-nya seperti menu gim sungguhan.

Di kanan, HUD di shot jalanan terakhir, yang oleh prompt hanya disebut "elemen HUD". Terbaca ETR METNO CITFEP. Di atas ikon perlengkapan, di mana prompt tidak mengatakan apa-apa, kamu dapat MNALEαIN IAMG. Itu bukan bug rendering. Model menggambar tekstur bahasa Inggris karena tidak pernah diberi string-nya.

Jadi perbaikannya bukan pengaturan. Ini kebiasaan:

Jika sebuah kata perlu terbaca, ketik kata itu. Lalu tambahkan baris negatif: jangan salah eja, jangan tambahkan teks lain, jangan tambahkan subtitle.

Dan ini bentuk enam blok yang ternyata dimiliki bersama oleh setiap prompt resmi yang kuat.

BlokIsinyaContoh dari prompt resmiJika dilewati, kamu dapat
1. Kontrak gayaMedium, tekstur, palet, era, tampilan yang tidak boleh hilang"kartu judul anime Jepang retro, siluet bertepi keras, kolase komik, blok warna geometris kuat"Render glossy generik yang melayang di detik keenam
2. LinimasaIrisan waktu literal dengan aksi di masing-masing[2s-4s] Zoom halus ke lengan kanannya. Panel UI meluncur masuk dari kananSatu ide diregangkan sepanjang durasi
3. KameraPergerakan, atau penolakan eksplisit untuk bergerak"dikunci, wide shot statis, tanpa push in, tanpa potongan"Dolly pelan default yang tidak kamu minta
4. AudioSetiap suara, dan kapan masuknya"di detik ke-6 groove bass jazz bergabung, 2 detik terakhir menguncinya dengan akord tegang"Room tone apa pun yang disukai model hari itu
5. Teks, diejaString literal, dalam tanda kutip"THIS IS FINE." / CONFIRM CONFIGNoise berbentuk huruf, seperti di atas
6. Daftar negatifTransisi, objek, dan klise yang harus ditolak"Tanpa dissolve lembut, tanpa transisi mengalir, jangan tambahkan bahasa Mandarin, jangan ulangi jabatan"Dissolve lembut, teks ciptaan, drift aneh

Blok 5 dan 6 gratis. Tidak ada biaya tambahan untuk membuatnya, dan di sanalah sebagian besar kualitas hidup.

Alur Kerja Prompt MiniMax H3: Prompt-mu untuk Endpoint yang Mana

Kunci yang sama, bentuk submit-dan-poll yang sama, tiga pintu. Yang mana yang kamu pilih menentukan apa yang masih harus dilakukan prompt-mu.

EndpointYang kamu berikanYang dikunci untukmuParameter yang layak diketahuiGunakan saatPenagihan
minimax/h3/text-to-videoPrompt sajaTidak ada. Teks membawa segalanyadurasi 5-10 (default 8), resolusi 2K, rasio harus diatur eksplisitMenguji tampilan atau desain suara sebelum kamu berkomitmenDitagih per detik output, tarif saat ini di halaman model
minimax/h3/image-to-videoPrompt + gambar (bingkai pertama), end_image opsionalDi mana klip dimulai, dan opsional di mana klip berakhirend_image, durasi 5-10 (default 8), rasio adaptif secara defaultKamu punya artwork dan ingin ia bergerak tanpa digambar ulangDitagih per detik output
minimax/h3/reference-to-videoPrompt + refers[]Identitas subjek dan gaya, di dalam scene yang kamu ciptakanrefers[] array campuran, durasi 5-15, rasio hingga 21:9Karakter atau produk yang sama, lingkungan baruDitagih per detik output

refers[] adalah satu-satunya yang benar-benar kurang terdokumentasi di lapangan, jadi ini bentuk yang ia inginkan:

json
1"refers": [
2  { "url": "https://.../subject.png", "type": "image" },
3  { "url": "https://.../style-board.png" },
4  { "url": "https://.../motion-ref.mp4", "type": "video" },
5  { "url": "https://.../beat.mp3",       "type": "audio" }
6]
7

Empat aturan yang masing-masing akan menghematmu satu generasi yang terbuang:

  1. Audio tidak bisa berjalan sendiri. Setidaknya satu gambar atau video harus ada di array. Track beat sendirian akan ditolak.
  2. type opsional. Ia disimpulkan dari URL, tapi tetap nyatakan saat ekstensinya ambigu.
  3. Batasnya nyata. Hingga 9 gambar, 3 video, dan 3 klip audio, total 12 file, dengan video dan audio referensi masing-masing berdurasi 2 hingga 15 detik (dokumentasi API MiniMax, Juli 2026).
  4. Beri setiap referensi tugas di dalam teks prompt. Ini kebiasaan dengan leverage tertinggi di daftar ini. Prompt resmi dibuka dengan baris seperti "Gambar 1 adalah referensi mood dan gaya keseluruhan, Gambar 2 adalah referensi karakter utama." Tanpa kalimat itu, model harus menebak papan yang mana berarti apa. Teks hitam besar bertuliskan BASS HITS di atas seorang wanita tersenyum Video musik dark-pop MiniMax H3: tipografi CUT BACK, ONE LOOK, DETONATE Tiga wanita bergaya grunge di samping poster tipografi tebal Dua papan referensi tipografi di balik klip dark-pop

Klip itu adalah argumen untuk aturan 4. Prompt-nya tidak pernah mendeskripsikan satu bentuk huruf pun. Ia mengatakan "gaya dan tekstur pengemasan teks mengacu pada gambar-gambar," dan menyerahkan dua papan. Tata letaknya datang karena diperlihatkan, bukan dideskripsikan.

Satu tabel lagi, karena kartu model dan API saat ini tidak mengatakan hal yang sama, dan celah itulah tempat orang kehilangan satu sore.

HalDokumentasi MiniMax sendiriYang sebenarnya diterima endpoint saat iniArtinya bagi prompt-mu
Durasi4 hingga 15 detik, bilangan bulat sajatext-to-video dan image-to-video: 5 hingga 10, default 8. reference-to-video: 5 hingga 15, default 8Daftar shot 15 detik hanya muat di reference-to-video saat ini. Tulis ulang papan yang lebih panjang menjadi 10
Resolusi2Kresolusi default 2K, dan 2K saat ini satu-satunya nilai yang berjalan. Job 768p kembali dengan model MiniMax-H3 does not support resolution 768P, supported resolutions: 2K, meskipun 768p muncul di tabel hargaTulis untuk sisi pendek 1440px. Detail yang kamu minta akan benar-benar bertahan
Rasio aspekRasio umum atau adaptifimage-to-video dan reference-to-video default adaptif. Text-only menolak adaptif dan mengembalikan set yang diizinkan: 16:9, 4:3, 1:1, 3:4, 9:16, 21:9Di text-to-video, atur rasio secara eksplisit atau job gagal validasi
Referensi campuran9 gambar, 3 video, 3 audio, 12 file, audio tidak pernah sendirirefers[] menerima {url, type} dengan image, video, atau audio, setidaknya satu gambar atau videoKamu benar-benar bisa menyinkronkan gerak ke beat yang disuplai. Kamu hanya tidak bisa menyuplai beat saja
Audio nativeAudio stereo di proses yang samaSetiap satu dari sembilan klip resmi yang saya periksa: 2560x1440, 24fps, AAC stereo pada 32kHzBlok audio bukan dekorasi. Ia separuh deliverable

Semua di atas dijalankan di Atlas Cloud, di mana ketiga endpoint H3 berada di belakang satu kunci dan satu loop submit-dan-poll, jadi berpindah di antara mereka hanyalah perubahan string model dan tidak ada yang lain.

Tutorial Prompt MiniMax H3: Bakar Anjing This Is Fine, dengan Suara

Ini semuanya dari awal sampai akhir. Leluconnya bekerja karena anjingnya tidak melakukan apa-apa. Regangkan penolakan itu menjadi sepuluh detik waktu nyata, tambahkan api sungguhan, dan biarkan dua detik terakhir pergi ke tempat komik aslinya sebenarnya pergi, dan itu menjadi lebih lucu dan sedikit lebih buruk bagimu. Kebanyakan orang hanya pernah melihat dua panel pertama.

Langkah 1: Unduh komik aslinya. Jangan biarkan AI menggambar ulang.

Stripnya enam panel, dua kolom kali tiga baris, 600 kali 887. Kita hanya ingin panel 2 dan panel 6.

bash
1curl -L -o gunshow-648.png https://gunshowcomic.com/comics/20130109.png
2# 600x887, 6 panels, 2 cols x 3 rows
3
4# crop panel 2 (the "THIS IS FINE." panel):  x 302-584, y 20-293
5# crop panel 6 (the melting dog):            x 302-584, y 595-868
6# upscale each 4x with Lanczos  ->  1128x1092
7

Katakan dengan terus terang: jangan minta model gambar menggambar "anjing yang mirip This Is Fine." Rekreasi AI langsung ketahuan palsu dalam setengah detik dan leluconnya mati di tempat. Sapuan cat air, huruf tangan yang goyah, dan grain kertas adalah seluruh kontraknya. Upscale Lanczos 4x hanya ada karena 282px sumber terlalu tipis; ia memberi model piksel nyata untuk dipegang tanpa menciptakan apa pun. Dua panel anjing This is Fine meleleh dalam api Panel 2 dan panel 6 komik asli, diberi label sebagai input bingkai pertama dan end image

Langkah 2: Jalankan di image-to-video dengan end_image.

Model: minimax/h3/image-to-video. Pengaturan: resolution 2K, image = panel 2, end_image = panel 6, ratio 1:1 agar sesuai dengan sumber yang hampir persegi. Atur duration ke 10; slider-nya di 8 secara default, jadi seret.

text
1Panel webcomik 2D lukis tangan, dihidupkan. Pertahankan tekstur cat air asli,
2garis tinta yang terlihat, grain kertas yang tidak sejajar, dan palet komik
3datar di setiap bingkai. Jangan menghaluskan, jangan me-render ulang dalam 3D,
4jangan membersihkan garis, jangan menambah objek baru, jangan menambah teks baru.
5
6[0s-3s] Hampir tidak ada yang bergerak. Anjing duduk diam sempurna, memegang
7cangkir, mata lurus ke depan. Hanya api di belakangnya yang bergerak: jilatan
8oranye lambat memanjat dinding, satu bara melayang naik. Gelembung ucapan
9bertuliskan "THIS IS FINE." tetap persis di tempatnya, terbaca penuh, tidak
10berubah, huruf tangan.
11
12[3s-6s] Anjing mengangkat cangkir dan menyeruput satu tegukan kecil yang tenang.
13Gelembung ucapan memudar setelah seruputan itu. Api semakin terang. Dinding di
14belakangnya mulai melengkung karena panas. Topinya mulai membara di tepinya.
15
16[6s-8.5s] Panas mencapainya. Telinganya melorot, garis luarnya melunak dan mulai
17mengalir ke bawah seperti cat basah. Ia tetap tidak menggerakkan matanya.
18Cangkir tetap di cakarnya.
19
20[8.5s-10s] Meleleh penuh. Wajahnya berubah bentuk, satu mata bergeser, gigi
21terbuka dalam seringai kaku, bulunya mengalir merah dan oranye. Ia menahan
22pose. Tahan bingkai terakhir selama setengah detik terakhir.
23
24Kamera: dikunci, satu wide shot statis, tanpa push in, tanpa genggam, tanpa
25potongan. Bingkai tidak pernah bergerak. Ini satu take berkelanjutan di dalam
26satu panel komik.
27
28Audio: room tone api interior sepanjang durasi - kresek pelan, letupan kayu
29terbakar sesekali, derit struktural samar. Di detik ke-3, satu cangkir keramik
30menyentuh gigi dan satu telan kecil. Suara pria datar yang tenang, tidak
31terganggu, mengucapkan persis: "This is fine." - tanpa ekspresi, tanpa emosi,
32sedikit terlalu santai. Dari detik ke-6 kresek mengeras dan room tone mengental;
332 detik terakhir menambahkan swell sub-bass rendah. Tanpa musik, tanpa laugh
34track, tanpa efek suara yang tidak ada di daftar ini.
35
36Jangan tambahkan subtitle. Jangan tambahkan watermark. Jangan mengeja kata apa
37pun selain kata-kata yang sudah ada di gambar. Jangan mengubah "THIS IS FINE."
38Jangan cut away.
39

Prompt itu adalah tabel struktur, hidup. Paragraf pertama adalah kontrak gaya. Empat irisan dalam kurung adalah linimasanya. Lalu kamera, lalu audio, lalu daftar negatif. Tidak ada yang dekoratif di dalamnya. Tangkapan layar generator video AI menampilkan meme This is fine MiniMax H3 image-to-video di Atlas Cloud: bingkai pertama dan end image dimuat, 10 detik di 2K, klip jadi di panel output

Langkah 3: Baca output-nya seperti QA pass.

Empat pemeriksaan, masing-masing menguji blok prompt yang berbeda.

  1. Apakah THIS IS FINE. di gelembung masih terbaca dan masih dieja benar? Itu menguji blok 5.
  2. Apakah garisnya bertahan, atau ada sesuatu yang "memperbaikinya" menjadi 3D bersih? Itu menguji blok 1.
  3. Apakah audio hanya berisi suara yang kamu daftarkan? Periksa wadahnya: ia harus kembali sebagai h264 plus AAC stereo.
  4. Apakah bingkai terakhir mendarat di pose panel 6? Itu menguji end_image.
bash
1ffprobe -v error -show_entries stream=codec_type,codec_name,width,height,r_frame_rate,channels,sample_rate \
2        -of default=noprint_wrappers=1 output.mp4
3

Punyaku kembali di 1472x1440, 24fps, h264 plus AAC stereo, 10.13 detik. Perlu dicatat: saya minta ratio: 1:1 dan mendapat 1472x1440, jadi di image-to-video bentuk bingkai sumber yang menang. Sesuaikan dua panelmu dengan bentuk yang sebenarnya kamu inginkan. Anjing kartun mengatakan this is fine lalu meleleh dalam api Empat bingkai dari klip jadi di 0s, 3s, 6.5s, dan 10s, cocok dengan empat irisan waktu di prompt

Langkah 4: Pindahkan anjing ke tempat baru dengan reference-to-video.

Karakter yang sama, ruangan baru. Model: minimax/h3/reference-to-video. Pengaturan: refers[] = panel 2 sebagai image, duration 8, resolution 2K, ratio 16:9.

text
1Gambar 1 adalah referensi karakter dan gaya seni: pertahankan tampilan webcomik
22D lukis tangan yang persis ini, tekstur cat air yang sama, ketebalan garis
3tinta yang sama, anjing yang sama, topi kecil yang sama, cangkir yang sama.
4Jangan menggambar ulang dia dalam 3D, jangan mengubah proporsinya, jangan
5membersihkan garis.
6
7Letakkan dia di ruangan berbeda dan pertahankan ketenangannya. Kantor terbuka
8sempit di malam hari, lampu neon berkedip, dinding monitor semuanya menampilkan
9status error merah, kertas printer berterbangan turun melewati bingkai, api
10listrik kecil di sudut. Ia duduk di kursi kantor di tengah bingkai, cangkir di
11cakar, menatap lurus ke kamera, benar-benar santai.
12
13Kamera: dikunci, wide shot statis. Tanpa push in, tanpa potongan.
14
15Audio: dengung neon, mesin printer menggerinda, bunyi alarm lembut berulang
16setiap dua detik, kresek listrik dari kejauhan, satu seruputan tenang di detik
17ke-4. Tanpa musik. Tanpa suara.
18
19Jangan tambahkan teks di layar apa pun. Jangan tambahkan subtitle. Jangan
20tambahkan karakter lain.
21

Aturan yang bisa ditransfer: refers[] membawa identitas dan gaya, teks membawa scene. Pembagian itulah seluruh trik konsistensi karakter, dan itulah mengapa baris pertama prompt itu ada. Mari coba: "Anjing kartun memegang cangkir kopi di tengah layar merah dan printer terbakar Anjing webcomik yang sama dipindahkan ke kantor terbuka yang terbakar di malam hari, dibuat oleh MiniMax H3 reference-to-video

Topi yang sama, cangkir yang sama, ketebalan tinta yang sama, ruangan baru. Satu gambar referensi melakukan semua itu.

Tiga Pola Prompt MiniMax H3 Lain yang Layak Dicuri

Pola 1: poster gerak, di mana tata letak tidak boleh bergerak. Karakter kartun berlari maju dengan latar belakang pink solid Poster gerak MiniMax H3: tata letak POPUP! beranimasi sementara bingkai dan tipografi tetap terkunci Bocah kartun dalam hoodie monster pink menjangkau dengan cakar raksasa Poster statis asli yang diberikan ke MiniMax H3

Seluruh prompt-nya dua baris: pertahankan bingkai putih galeri, bingkai dalam, palet merah-putih-hitam, nuansa figur 3D, dan struktur tata letak tidak berubah, dan letakkan efek suara lincah di bawah kemunculan teks. Aturannya: sebut bagian-bagian yang harus bertahan. "Pertahankan tata letak" bukan catatan gaya, itu kendala, dan model memperlakukannya seperti itu.

Pola 2: demo antarmuka, di mana kata kerja mengalahkan kata sifat. Sepatu lari Nike ZoomX hijau mint dengan sol gradien pink Demo halaman arahan MiniMax H3: scroll, hover, inversi warna di halaman produk Sepatu lari Nike biru muda dengan aksen hijau dan pink Satu gambar referensi produk di balik klip halaman arahan

Prompt itu meminta scroll halaman ke bawah, status hover, scale-up kuat, dan inversi warna. Empat kata kerja. Ia tidak pernah mengatakan "modern" atau "ramping." Interaksi adalah aksi, jadi tulis sebagai aksi. Tipografi miring besar dan latar anyaman karbon datang dari kata sifat; hal yang membuatnya terbaca sebagai halaman sungguhan datang dari kata kerja.

Pola 3: live action plus gambar tangan, disatukan oleh penolakan. Tunas bercahaya hijau beranimasi tumbuh di telapak tangan terbuka Klip MiniMax H3 memadukan rekaman dapur live-action dengan makhluk bercahaya gambar tangan

Yang ini dapur malam yang direkam dengan ponsel dengan makhluk bercahaya kecil gambar tangan di dalamnya, dan alasan ia tetap menggemaskan alih-alih berubah menjadi film horor pendek adalah daftar larangan: tanpa mata raksasa, tanpa mulut terbelah, tanpa taring, tanpa postur mengancam, tanpa menerjang, tanpa potongan mendadak ke hitam, tanpa jump scare. Daftar negatif adalah kontrol gaya utama, bukan tambalan. Ia juga tempat kamu menyandikan selera. Empat panel menampilkan seorang wanita di terowongan gelap dengan teks Empat bingkai dari trailer fiksi ilmiah resmi: THE STARS WERE LISTENING Poster The Stars Were Listening dan lembar desain karakter Mood board dan referensi karakter di balik trailer

Trailer di atas menutup lingkaran kedua ide. Prompt mengeja satu judul, THE STARS WERE LISTENING, secara detail: sangat sempit, tebal, semua huruf kapital, merah gelap bercampur karat, sedikit grain dan tepi berkabut. Yang satu itu kembali persis seperti yang dipesan. Dua papan referensi menangani mood dan karakter utama, jadi teks tidak perlu mendeskripsikan wajah. Pembagian kerja, sampai ke bawah.

Berapa Biaya Menjalankan Prompt MiniMax H3 Ini

H3 ditagih per detik video yang dihasilkan, berdasarkan resolusi, jadi model biayanya sangat sederhana: take 15 detik berharga sekitar tiga percobaan 5 detik. Segala hal lain mengikuti dari itu.

  • Iterasi di 5 detik, kirim di 10 atau 15. Komposisi, palet, dan desain suara semuanya selesai di 5. Tidak ada apa pun tentang shot terkunci yang membutuhkan durasi penuh untuk memberi tahumu bahwa ia salah.
  • end_image adalah alat biaya, bukan hanya alat kreatif. Kebanyakan percobaan ulang terjadi karena akhirannya melayang. Mengunci bingkai terakhir menghilangkan mode kegagalan itu sebelum kamu membayarnya.
  • Daftar negatif dan teks yang dieja gratis. Mereka menambah karakter pada prompt yang ditagih per detik, bukan per token. Gunakan secara deras.
  • Sesuaikan duration dengan endpoint sebelum menulis. Membangun daftar shot 15 detik dan kemudian menemukan endpoint-mu berhenti di 10 membuatmu menulis ulang, bukan sekadar menjalankan ulang.

Satu hal yang belum bisa direncanakan: tabel harga mencantumkan tier 768p yang lebih murah, tetapi hingga tulisan ini dibuat, job 768p ditolak mentah-mentah dan 2K adalah satu-satunya resolusi yang berjalan. Anggarkan seolah setiap detik adalah detik 2K. Tarif per detik saat ini ada di halaman model, yang juga tempat tier 768p akan muncul begitu ia dibuka.

Prompt MiniMax H3, Meme, dan Hak Cipta

Anjing itu bukan domain publik. This Is Fine berasal dari webcomik KC Green, Gunshow #648, diterbitkan pada 9 Januari 2013, dan hanya dua panel pertama yang pernah viral (Know Your Meme, Januari 2013). Green telah berbicara di muka publik, dan dengan cukup lelah, tentang melihat gambar itu digunakan ulang selamanya, termasuk oleh orang-orang yang politiknya tidak ia bagikan (NPR, Januari 2023).

Walkthrough ini adalah komentar dan pengajaran, bukan perpustakaan stok. Jika kamu ingin mengirim sesuatu secara komersial, gambarlah bingkaimu sendiri atau lisensikan yang kamu gunakan. Dan jalankan pemeriksaan kebijakanmu sendiri sebelum pekerjaan klien: H3 menerapkan aturan konten pada orang sungguhan yang dikenali dan IP terkenal, dan mengetahuinya di tengah deadline itu tidak menyenangkan.

Pertanyaan yang Sering Diajukan

Apakah MiniMax H3 menghasilkan audio, atau saya tambahkan setelahnya?

Proses yang sama. Gambar dan suara keluar bersama, persis itulah mengapa audio harus ditulis ke dalam tubuh prompt daripada ditempel kemudian. Beri blok Audio: sendiri dan nyatakan kapan setiap suara masuk. Setiap satu dari sembilan klip resmi yang saya periksa kembali sebagai AAC stereo pada 32kHz di samping stream video 2560x1440, 24fps.

Berapa panjang prompt MiniMax H3?

Hingga 7.000 karakter, menurut dokumentasi MiniMax. Dalam praktiknya contoh resmi terbentang di rentang lebar, dengan median sekitar 130 karakter Mandarin dan dua terpanjang di 657 dan 858. Prompt pendek bekerja baik ketika gambar referensi yang melakukan deskripsi. Jika kamu tidak punya referensi, perkirakan untuk menulis daftar shot.

Mengapa teks keluar kacau di video MiniMax H3 saya?

Karena kamu tidak mengetiknya. String yang muncul secara literal di prompt tampil bersih; apa pun yang kamu isyaratkan secara generik ("elemen HUD," "beberapa label") kembali sebagai tekstur berbentuk huruf. Eja setiap kata yang harus terbaca, lalu tambahkan jangan salah eja, jangan tambahkan teks lain, jangan tambahkan subtitle.

Berapa banyak gambar referensi, video, dan klip audio yang bisa dipakai satu prompt MiniMax H3?

Sembilan gambar, tiga video, dan tiga klip audio, total dua belas file, dengan video dan audio referensi masing-masing antara 2 dan 15 detik. Audio tidak bisa menjadi satu-satunya referensi. Perhatikan bahwa kemampuan model dan apa yang diekspos endpoint tertentu adalah dua hal berbeda, jadi periksa halaman model untuk daftar input saat ini.

Bisakah prompt MiniMax H3 mengontrol bagaimana klip berakhir, bukan hanya bagaimana ia mulai?

Ya, di image-to-video, melalui parameter opsional end_image. Beri bingkai pertama dan bingkai terakhir dan klip menginterpolasi di antara keduanya. Demo di atas persis itu: panel komik 2 masuk, panel komik 6 keluar. Pertahankan kedua gambar pada rasio aspek yang mirip atau transisinya menjadi jelek.

Durasi dan resolusi apa yang sebenarnya bisa saya dapatkan sekarang?

2K, dan hanya 2K. Job 768p saat ini ditolak dengan supported resolutions: 2K, meskipun 768p muncul di tabel harga. Durasi berbeda per endpoint: text-to-video dan image-to-video menerima 5 hingga 10 detik dengan default 8, sementara reference-to-video menerima 5 hingga 15. Satu jebakan lagi: pada generasi text-only, API menolak adaptive dan memerlukan ratio eksplisit.

Model Terbaru

Satu API untuk semua AI multimedia.

Jelajahi semua model