Panduan Prompt MiniMax H3 untuk Dialog dan Pengaturan Waktu
Panduan prompt MiniMax H3 praktis untuk mengontrol dialog, atribusi pembicara, pengaturan waktu pengambilan gambar, suara, dan konsistensi produk, dengan pengujian video A/B nyata.
Panduan Prompt MiniMax H3: Kontrol Dialog, Potongan, dan Pengaturan Waktu
Panduan prompt MiniMax H3 ini menunjukkan cara mengontrol pembicara, sinkronisasi bibir, potongan, suara, dan konsistensi produk, alih-alih hanya mengandalkan deskripsi adegan yang terlihat bagus tetapi ambigu.
Contoh MiniMax H3 dari komunitas yang menampilkan dialog terarah, aksi, properti yang mudah dibaca, pergerakan kamera, dan shot reaksi yang diatur waktunya.
Klip pembuka berasal dari prompt terstruktur yang dibagikan oleh pengguna Reddit GrayingGamer. Prompt tersebut mengarahkan dua pembicara, beberapa aksi, properti yang mudah dibaca, pergerakan kamera, suara, dan shot reaksi sekitar detik kesepuluh. Proyek komersial harus menggunakan karakter, suara, produk, dan aset merek yang berizin. Pelajaran bergunanya adalah logika naskah pengambilannya.
Mengapa Panduan Prompt MiniMax H3 Penting
Prompt singkat dapat berfungsi untuk satu subjek dan satu aksi. Struktur menjadi berguna saat terdapat beberapa pembicara, suara di luar layar, beberapa shot, atau aksi produk yang diatur waktunya. Jika tidak, suara yang benar mungkin diputar saat karakter yang salah menggerakkan bibirnya. Potongan dapat muncul terlalu awal, dan produk dapat berubah di antara shot.
Panduan prompt MiniMax H3 yang praktis harus mengurangi ambiguitas tersebut. Lebih banyak kata sifat tentang gaya tidak dapat menggantikan identitas pembicara atau linimasa yang jelas.
Pilih Panduan Prompt MiniMax H3 Resmi yang Tepat
MiniMax menyediakan dua sumber resmi:
| Sumber resmi | Paling cocok untuk | Struktur utama |
|---|---|---|
| Panduan Penulisan Prompt Video | Teks ke video, gambar ke video, frame pertama dan terakhir, serta tugas frame terakhir | integrated_multimodal_description, overall_soundscape, non_diegetic_music |
| Panduan Mode Referensi Penuh | Tugas yang menggunakan referensi subjek, gambar, video, gerakan, atau audio terpisah | Enam bagian dari subject_definitions hingga non_diegetic_music |
Panduan Penulisan Prompt Video

Panduan Mode Referensi Penuh

Gunakan panduan prompt MiniMax H3 pertama untuk pembuatan berbasis teks atau frame. Gunakan panduan referensi penuh saat gambar menentukan produk, video mengontrol gerakan, atau audio mengontrol penyampaian suara.
Sintaks resmi saat ini memberikan ID stabil kepada pembicara seperti (S1) dan (S2). Identitas dan penyampaian pembicara tetap berada di luar <d>. Hanya bahasa dan kata-kata yang diucapkan yang dimasukkan ke dalamnya:
Host wanita dengan suara jernih dan percaya diri (S1) bertanya:
<d>[English] Ready for the pressure test?</d>
Untuk kalimat di luar layar, identifikasi sebagai sulih suara di luar layar dan nyatakan bahwa bibir karakter yang terlihat tetap tertutup.
Empat Aturan untuk Linimasa yang Dapat Dikontrol
- Tetapkan pembicara dan keheningan. Perkenalkan setiap suara satu kali, gunakan ID yang sama di seluruh shot, dan identifikasi siapa yang tidak boleh berbicara.
- Letakkan potongan pada linimasa. Mulai dengan
[Shot 1]tanpa cap waktu. Berikan waktu potong yang meningkat untuk shot berikutnya:
[Shot 1] Sebuah shot medium menampilkan host, teknisi, dan tangki pengujian.
[Shot 2] At 00:04.000, kamera memotong ke close-up jam tangan.
[Shot 3] At 00:08.000, kamera memotong ke teknisi yang mengangkat jam tangan.
- Pisahkan ucapan dan suara. Letakkan dialog di
<d>, suara fisik dioverall_soundscape, dan musik yang hanya didengar penonton dinon_diegetic_music. - Sesuaikan naskah dengan durasi output. Jika dialog saling bertumpuk atau aksi produk berlangsung terlalu cepat, pendekkan naskah atau perpanjang klip.
Panduan prompt MiniMax H3 ini mengontrol tempo serta penyuntingan. Jeda antarcap waktu adalah waktu yang tersedia untuk setiap aksi dan dialog.
Uji Prompt MiniMax H3: Singkat vs. Terstruktur
Kami menguji satu konsep tekanan jam tangan dengan dua gaya prompt. Konsep ini memerlukan tiga shot, dua orang, tiga dialog, satu dialog pria di luar layar, dua potongan, dan satu jam tangan selam yang konsisten. Perbandingan panduan prompt MiniMax H3 ini adalah demonstrasi praktis, bukan benchmark formal.
Perbedaan utama prompt adalah:
| Kontrol | Prompt singkat | Prompt terstruktur |
|---|---|---|
| Pembicara | Dijelaskan berdasarkan peran dalam paragraf | Ditetapkan sebagai (S1) dan (S2) |
| Dialog di luar layar | “Teknisi berbicara dari luar layar” | Sulih suara di luar layar yang eksplisit ditambah instruksi mulut tertutup |
| Potongan | Ditulis sebagai arahan waktu biasa | Ditulis sebagai [Shot 2] At 00:04.000 dan [Shot 3] At 00:08.000 |
| Suara | Permintaan umum untuk suara realistis | Dipisahkan menjadi overall_soundscape dan non_diegetic_music |
Pengujian 1: Prompt Singkat
Versi singkat menghasilkan studio yang meyakinkan dan membuat jam tangan tetap mudah dikenali. Namun, selama dialog teknisi di luar layar, host wanita yang terlihat menggerakkan bibirnya seolah berbicara dengan suara teknisi. Potongannya muncul sekitar 3,54 dan 6,79 detik, sehingga penampilan akhir dimulai terlalu awal.
Pengujian 2: Format Panduan Prompt MiniMax H3 Terstruktur
Versi panduan prompt MiniMax H3 terstruktur menggunakan ID pembicara, sulih suara di luar layar, instruksi mulut tertutup, dan shot yang diatur waktunya. Potongannya muncul sekitar 3,92 dan 7,88 detik, mendekati tanda waktu empat dan delapan detik yang diminta.
Tidak terlihat sinkronisasi bibir palsu yang jelas. Jam tangan memenuhi latar depan sementara host tetap berada di latar belakang. Mulutnya sebagian tertutup, sehingga hal ini tidak membuktikan eksekusi yang sempurna. Namun, panduan prompt MiniMax H3 terstruktur menghindari ketidaksesuaian yang terlihat pada Pengujian 1.
| Hasil | Prompt singkat | Prompt terstruktur |
|---|---|---|
| Atribusi pembicara | Suara pria dengan gerakan bibir wanita yang terlihat | Tidak ada sinkronisasi bibir orang yang salah secara jelas |
| Waktu potongan | Sekitar 3,54 dtk dan 6,79 dtk | Sekitar 3,92 dtk dan 7,88 dtk |
| Konsistensi produk | Jam tangan tetap mudah dikenali | Jam tangan tetap mudah dikenali dengan close-up yang lebih kuat |
| Masalah tersisa | Ketidaksesuaian pembicara yang terlihat | Teks semu kecil pada baju teknisi |
| Prompt singkat pada 4,5 detik | Prompt terstruktur pada 4,5 detik |
|---|---|
![]() | ![]() |
Pada 4,5 detik, hasil singkat menunjukkan host yang terlihat menggerakkan bibirnya mengikuti suara teknisi di luar layar. Hasil terstruktur menghindari ketidaksesuaian jelas yang sama.
Kedua klip terlihat layak secara komersial. Pengujian panduan prompt MiniMax H3 ini tidak menunjukkan bahwa prompt yang lebih panjang selalu menghasilkan frame yang lebih indah. Pengujian ini menunjukkan bahwa struktur yang tepat dapat meningkatkan kontrol.
Template Panduan Prompt MiniMax H3 yang Dapat Digunakan Ulang
integrated_multimodal_description:
[Shot 1] Gaya, komposisi, produk, pembicara (S1), aksi, dan dialog.
[Shot 2] At 00:SS.mmm, framing baru, aksi produk, pembicara (S2),
penyampaian di luar layar atau di layar, dialog persis, dan siapa yang tetap diam.
[Shot 3] At 00:SS.mmm, aksi akhir, konsistensi produk, dan frame akhir.
overall_soundscape: Suara ambient dan fisik dalam urutan pemutaran.
non_diegetic_music: Musik latar yang hanya untuk penonton, atau N/A.
Untuk mode referensi, ikuti panduan prompt MiniMax H3 resmi kedua sebagai gantinya. Tentukan apa yang dikontrol oleh setiap <Subject N>, <Picture N>, <Video N>, atau <Audio N> sebelum menulis linimasa.
Daftar Periksa Kualitas Komersial
Sebelum menyetujui video ecommerce atau media sosial, periksa:
- Setiap dialog berasal dari pembicara yang dimaksud, dan karakter diam tidak menghasilkan sinkronisasi bibir palsu.
- Potongan terjadi mendekati waktu yang diminta, dengan ruang yang cukup untuk dialog dan aksi produk.
- Warna, struktur, logo, tekstur, dan proporsi produk tetap stabil.
- Tangan, wajah, pantulan, bayangan, titik kontak, dan teks yang terlihat lolos peninjauan.
- Framing sesuai untuk PDP, listing marketplace, Reel, TikTok, atau iklan yang dituju.
Ubah Prompt menjadi Alur Kerja WeShop AI
Buka alur kerja MiniMax H3 di WeShop AI dan pilih mode input yang sesuai dengan aset Anda. Gunakan teks untuk membuat dari awal, frame pertama untuk mengunci komposisi pembuka, atau mode referensi penuh saat aset terpisah mengontrol identitas produk, gerakan, atau suara.
Kemudian ikuti lima langkah:
- Tentukan hasil akhir dan durasi.
- Tetapkan pembicara, referensi, dan detail produk yang dikunci.
- Tulis linimasa panduan prompt MiniMax H3 yang realistis.
- Buat satu draf dan tinjau kegagalan kontrol.
- Buat variasi kampanye hanya setelah video dasar lolos peninjauan.
Untuk iklan dialog, demo, video penjelasan, dan video dengan banyak karakter, pelajaran dari panduan prompt MiniMax H3 ini sederhana: detail yang lebih banyak tidak otomatis menghasilkan video yang lebih indah. Detail yang tepat menghasilkan video yang lebih mudah dikontrol.
Catatan editorial: Konfirmasikan izin sebelum menerbitkan rekaman pihak ketiga, kemiripan karakter, atau referensi suara apa pun.

