GLM-5.3 FlashX and MiniMax H3 Max are now live on CometAPI โ†’
ai-model/Riset CometAPI

Apa itu MiniMax H3 Max

Pelajari apa itu MiniMax H3 Max serta arsitektur, kecepatan, tolok ukur, fitur, harga, audio, dan akses API-nya.

CometAPI
Deon GoodwinTim riset model AI dan API
Diperbarui Sep 21, 2026 13 menit baca
Apa itu MiniMax H3 Max
Gunakan pola ini

Lakukan API call pertama.

from openai import OpenAI

client = OpenAI(
    api_key="YOUR_COMETAPI_KEY",
    base_url="https://api.cometapi.com/v1",
)

response = client.chat.completions.create(
    model="gpt-5-mini",
    messages=[{"role": "user", "content": "Build this workflow."}],
)

print(response.choices[0].message.content)

TL;DR

MiniMax H3 Max bukan model fondasi baru yang menggantikan MiniMax H3. Ini adalah varian pascapelatihan dari MiniMax H3 yang dibuat oleh fal Research, menggunakan bobot terbuka H3 dan pascapelatihan tambahan yang berfokus pada kepatuhan terhadap prompt, estetika visual, dan efisiensi inferensi.

Pembedaan itu menjelaskan sebagian besar perbedaan antara kedua model. MiniMax H3 Max dioptimalkan untuk inferensi produksi yang cepat dan kepatuhan prompt yang lebih kuat, sementara MiniMax H3 tetap menjadi sistem omni-modal yang lebih luas, termasuk pengkondisian multimodal yang lebih kaya, alur kerja penyuntingan video, dan output hingga 2K melalui H3-Regenerate-2K.

Per 18 September 2026, data preferensi independen menunjukkan H3 Max pada 1227 Elo dalam teks-ke-video dengan audio versus 1220 untuk H3, dan 1195 Elo dalam gambar-ke-video dengan audio versus 1181 untuk H3. Kesenjangannya cukup bermakna untuk dipantau, tetapi tidak cukup besar untuk menyiratkan perbedaan kualitas yang dramatis pada setiap prompt.

Key Takeaways

  • H3 Max adalah varian H3 pascapelatihan, bukan H4 atau arsitektur H3 yang lebih besar. fal memulai dari bobot terbuka MiniMax H3 dan mengoptimalkan model serta stack penyajian secara bersamaan.
  • Kecepatan adalah pembedaan paling jelas H3 Max. fal melaporkan sekitar tiga detik atau kurang untuk pembuatan 5 detik 768p pada infrastrukturnya yang dioptimalkan.
  • H3 Max saat ini memimpin H3 dalam dua uji preferensi independen yang langsung dapat dibandingkan yang digunakan di sini. Cuplikan terbaru menunjukkan +7 Elo pada teks-ke-video dengan audio dan +14 Elo pada gambar-ke-video dengan audio.
  • MiniMax H3 masih merupakan alur kerja model fondasi yang lebih luas. Ini mendukung referensi multimodal yang lebih kaya, penyuntingan, bobot H3-Base terbuka, dan regenerasi 2K.
  • Resolusi adalah pembedaan penting. H3 Max mengekspos pembuatan 480p/768p plus penyempurnaan laten 1080p, sedangkan H3 dapat mencapai 2K melalui H3-Regenerate-2K.

What Is MiniMax H3 Max?

MiniMax H3 Max adalah model pembuatan video AI yang dikembangkan oleh fal Research melalui pascapelatihan atas bobot terbuka MiniMax H3. Alih-alih mengganti arsitektur H3 yang mendasarinya dengan model fondasi yang sepenuhnya baru, fal berfokus pada kepatuhan prompt, estetika, dan throughput inferensi.

Kata โ€œMaxโ€ karenanya bisa menyesatkan jika ditafsirkan sebagai tingkatan parameter yang lazim lebih besar. Materi publik tidak menetapkan Transformer yang lebih besar atau skala parameter baru untuk H3 Max. Pembedaan utamanya berasal dari pascapelatihan dan stack penyajian yang dirancang mengitari model yang dimodifikasi.

fal juga menggambarkan data pascapelatihan baru dan loop evaluasi substansial yang berpusat pada kualitas yang terlihat pengguna. Dalam praktiknya, H3 Max paling tepat dipahami sebagai varian H3 yang dioptimalkan untuk produksi alih-alih penerus yang sepenuhnya baru.

MiniMax H3 Max specifications at glance

SpesifikasiMiniMax H3 Max
Model dasarMiniMax H3
Pengembang pascapelatihanfal Research
Kategori modelGenerasi audio-video
Teks ke videoYa
Gambar ke videoYa
Kontrol frame pertama/terakhirYa
Referensi ke videoYa
Durasi output5-15 detik
Resolusi generasi native480p / 768p
Opsi 1080pPenyempurnaan laten dari 768p native
Frame rate24 FPS
AudioAudio stereo tersinkron
Rasio aspek21:9, 16:9, 4:3, 1:1, 3:4, 9:16
Optimisasi utamaKepatuhan prompt, estetika, throughput
ID model CometAPIminimax-h3-max

Skema API fal saat ini menggambarkan opsi 1080p sebagai penyempurnaan laten dari sumber 768p native, yang penting saat membandingkan H3 Max dengan sistem yang meregenerasi pada resolusi yang benar-benar lebih tinggi.

How Does MiniMax H3 Max Work?

Memahami H3 Max dimulai dari fondasi H3 di bawahnya. MiniMax menggambarkan H3 sebagai sistem generatif omni-modal alih-alih kumpulan model teks-ke-video, gambar-ke-video, audio, dan penyuntingan yang terpisah.

Alur lengkap H3 diorganisasi di sekitar H3-Context-IR, H3-Base, dan H3-Regenerate-2K. H3-Context-IR menafsirkan instruksi multimodal bebas bentuk, H3-Base melakukan pembuatan audiovisual inti di 768p, dan H3-Regenerate-2K menggunakan kembali konteks asli plus hasil resolusi lebih rendah untuk meregenerasi output beresolusi lebih tinggi.

The H3 foundation beneath H3 Max

MiniMax mendokumentasikan H3-Omni-Transformer sebagai Transformer tunggal berdensitas 33 miliar parameter, dengan sekitar 13B parameter di cabang terkait AdaLN. H3-Encoder menggunakan bobot pra-latih Qwen3-VL-32B, sementara VAE visual dan audio terpisah mengenkode modalitas masing-masing sebelum pembuatan bersama.

H3-Omni-Transformer secara bersama-sama memprediksi laten video dan audio alih-alih memperlakukan suara sebagai tahap pascaproses terpisah. Arsitektur itu merupakan alasan mengapa H3 dan H3 Max dapat menghasilkan output audiovisual yang tersinkron.

Arsitektur model resmi MiniMax H3

What fal changed for H3 Max

fal mem-pascalatih H3 dengan data tambahan yang menargetkan kesetiaan instruksi dan kualitas visual, kemudian mengembangkan sistem inferensi berdampingan dengan model alih-alih hanya mengoptimalkan penyajian setelah pelatihan selesai. Artikel peluncuran menggambarkan co-design model-dan-inferensi ini sebagai alasan inti mengapa H3 Max dapat menggeser pertukaran kualitas-kecepatan.

Itu penting karena sekadar mengurangi langkah sampling atau presisi dapat menurunkan latensi sekaligus menurunkan kualitas output. fal mengatakan kandidat optimisasi hanya dipertahankan ketika checkpoint yang dihasilkan tetap unggul dalam evaluasi preferensinya.

MiniMax H3 menyediakan fondasi generasi multimodal; H3 Max mengubah posisi fondasi itu pada kurva kualitas-kecepatan-biaya.

What Are the Main Features of MiniMax H3 Max?

Kepatuhan prompt yang lebih kuat

Kepatuhan prompt adalah target pascapelatihan langsung. Ini penting untuk prompt terstruktur yang menggabungkan banyak aksi, transisi adegan, arahan kamera, batasan temporal, dan instruksi gaya.

Generasi lebih cepat daripada durasi video

H3 Max dirancang untuk latensi pembuatan yang sangat rendah. fal melaporkan klip 5 detik 768p sekitar tiga detik atau kurang pada infrastrukturnya yang dioptimalkan, memungkinkan loop kreatif iteratif yang jauh lebih rapat.

Audio tersinkron bawaan

H3 Max mempertahankan pendekatan pembuatan audio-video bersama milik H3, sehingga dialog, ambience, efek suara, dan gerak dapat diproduksi dalam alur kerja audiovisual yang terkoordinasi.

Banyak alur kerja generasi

Keluarga H3 Max mendukung teks-ke-video, gambar-ke-video, pembuatan frame pertama-ke-terakhir, dan alur kerja referensi-ke-video.

Perluasan prompt bawaan

Endpoint teks-ke-video mengekspos mode perluasan prompt seperti dinonaktifkan, seimbang, dan berkualitas, memungkinkan pengembang menukar waktu pra-pemrosesan dengan interpretasi prompt yang lebih kaya.

How Does MiniMax H3 Max Perform ?

Benchmarks of MiniMax H3 Max

Benchmark yang dijalankan penyedia berguna untuk menunjukkan apa yang ditargetkan pascapelatihan, tetapi uji preferensi pihak ketiga yang diperbarui secara berkelanjutan lebih berguna untuk membandingkan H3 Max dengan H3 asli di bawah metodologi arena yang sama.

Cuplikan benchmark โ€” 18 Sep 2026MiniMax H3 MaxMiniMax H3Perbedaan
Teks ke Video dengan Audio (Elo)1227 ยฑ91220 ยฑ8+7
Sampel Teks ke Video5,6898,602โ€”
Gambar ke Video dengan Audio (Elo)1195 ยฑ101181 ยฑ8+14
Sampel Gambar ke Video5,5696,949โ€”
Penyuntingan Video dengan Audio (Elo)Tidak diperingkat dalam perbandingan ini1132 ยฑ6โ€”

Catatan metodologi benchmark. Angka Artificial Analysis adalah cuplikan Elo preferensi manusia buta yang diberi tanggal; artikel ini melaporkan skor, interval kepercayaan 95%, jumlah sampel, kategori, dan tanggal cuplikan. Prompt, pengaturan pembuatan, dan prosedur evaluasi yang tepat harus diperiksa terhadap metodologi Artificial Analysis saat ini. Hasil peringkat #1 milik fal dijalankan oleh penyedia pada infrastruktur fal, dan bagan perbandingan publiknya tidak mengungkap setiap prompt, perangkat keras, atau parameter penyajian yang diperlukan untuk reproduksi independen.

Cuplikan saat ini mendukung kesimpulan sempit: H3 Max memiliki skor preferensi terukur yang lebih tinggi di kedua kategori pembuatan audio-video yang langsung dapat dibandingkan. Interval kepercayaan saling tumpang tindih, jadi kesenjangannya tidak boleh disajikan sebagai keunggulan kualitas dramatis untuk setiap prompt.

falโ€™s own H3 Max evaluation

fal melaporkan bahwa H3 Max menempati peringkat pertama pada preferensi keseluruhan, pemahaman prompt, dan estetika dalam evaluasi head-to-head terhadap dua belas model video. Itu adalah bukti yang dijalankan penyedia, jadi sebaiknya dibaca berdampingan dengan data arena independen, bukan sebagai penggantinya.

Apa itu MiniMax H3 Max

Bagan resmi fal H3 Max biaya vs kualitas

Penafsiran paling berguna bukan โ€œH3 Max menang secara universal.โ€ Melainkan bahwa H3 Max secara material meningkatkan titik operasi kecepatan-kualitas H3, sementara kesenjangan skor preferensi independen atas H3 tetap relatif moderat.

Kecepatan, Kualitas, dan Kompromi

fal melaporkan bahwa H3 Max menghasilkan video 5 detik 768p dalam waktu di bawah tiga detik pada infrastrukturnya yang dioptimalkanโ€”sekitar 35ร— throughput endpoint MiniMax H3 resmi dalam perbandingan fal. Perlakukan ini sebagai bukti inferensi spesifik penyedia: antrian, transfer jaringan, pemeriksaan keamanan, dan backend berbeda dapat meningkatkan latensi ujung-ke-ujung.

Keunggulan kualitas lebih moderat daripada kecepatan. Dalam cuplikan independen 18 September yang digunakan di sini, H3 Max memimpin H3 sebesar 7 Elo untuk teks-ke-video dengan audio dan 14 Elo untuk gambar-ke-video dengan audio, tetapi interval kepercayaan saling tumpang tindih. Kesimpulan yang dapat dipertahankan adalah bahwa H3 Max menggeser frontier kecepatan-kualitas; ini tidak menjamin hasil yang terlihat lebih baik untuk setiap prompt.

Pilihan praktis: gunakan H3 Max untuk iterasi cepat, produksi short-form throughput tinggi, dan prompt yang mementingkan kepatuhan. Lebih pilih H3 standar saat alur kerja bergantung pada sistem multimodal yang lebih luas, penyuntingan video, penerapan bobot terbuka, atau jalur H3-Regenerate-2K.

How Much Do MiniMax H3 Max Cost?

Harga perlu konteks karena tarif penyedia dan promosi dapat berubah secara independen. Cuplikan berikut mencerminkan tarif yang ditampilkan secara publik yang diperiksa pada 18 September 2026.

Sumber hargaH3 MaxH3
fal 480p$0.025/detik promosiโ€”
fal 768p$0.04/detik promosiโ€”
fal 1080p refinement$0.08/detik promosiโ€”
MiniMax resmi 768pโ€”$0.08/detik
MiniMax resmi 2Kโ€”$0.13/detik
MiniMax 768p โ†’ 2K regenerasiโ€”$0.05/detik
Harga awal CometAPI$0.064/detik$0.064/detik

fal saat ini melabeli tarif H3 Max sebagai harga peluncuran promosi dan menyatakan bahwa diskon berakhir pada 30 September 2026. API MiniMax H3 Max di CometAPI saat ini menampilkan $0.064 per detik, sementara API MiniMax H3 di CometAPI juga dimulai pada $0.064 per detik. Harga penyedia harus diperiksa ulang sebelum memperkirakan beban kerja produksi yang besar.

How to try MiniMax H3 Max

API MiniMax H3 Max di CometAPI saat ini tersedia dengan ID model minimax-h3-max, endpoint produksi di /v1/videos, penanganan tugas asinkron, dan harga awal yang ditampilkan $0.064 per detik.

  1. Buat kunci API. Masuk ke CometAPI, buat token, dan simpan dengan aman sebagai COMETAPI_KEY.
  2. Kirim tugas pembuatan. Kirim permintaan POST ke https://api.cometapi.com/v1/videos dengan model minimax-h3-max, sebuah prompt, durasi, dan ukuran output. Tambahkan URL gambar saat menggunakan gambar-ke-video.
  3. Polling tugas asinkron. Baca ID tugas yang dikembalikan dan minta GET /v1/videos/{task_id} hingga status menjadi completed atau failed. Gunakan interval polling alih-alih mengirim permintaan terus-menerus.
  4. Unduh dan tinjau. Ambil GET /v1/videos/{task_id}/content, simpan MP4, dan periksa kepatuhan prompt, gerakan, sinkronisasi audio, dan artefak visual sebelum menskalakan beban kerja.

Untuk perbandingan H3 Max versus H3 yang adil, pertahankan prompt, durasi, rasio aspek, resolusi, input referensi, pengaturan audio, dan kebijakan retry tetap sama. Konfirmasikan skema dan harga live di halaman model sebelum produksi karena routing dan parameter yang diekspos dapat berubah secara independen dari model yang mendasarinya.

Limitations of MiniMax H3 Max

Pertama, H3 Max tidak menggantikan alur kerja regenerasi 2K milik H3. Opsi 1080p yang didokumentasikan saat ini adalah penyempurnaan output 768p native alih-alih jalur regenerasi 2K dalam-konteks yang sama seperti H3.

Kedua, latensi utama H3 Max terkait erat dengan stack inferensi fal yang dioptimalkan, jadi kecepatan jam-dinding yang sama tidak boleh diasumsikan pada backend lain.

Ketiga, keunggulan kualitas independen atas H3 saat ini moderat. Cuplikan benchmark 18 September menunjukkan +7 Elo pada teks-ke-video dengan audio dan +14 Elo pada gambar-ke-video dengan audio, dengan interval kepercayaan yang tumpang tindih.

Terakhir, H3 tetap menjadi sistem yang lebih luas jika โ€œlebih baikโ€ berarti penyuntingan video, kedalaman referensi multimodal, penerapan bobot terbuka, atau resolusi output maksimum alih-alih throughput generasi mentah.

Conclusion

MiniMax H3 Max paling tepat dipahami sebagai varian H3 yang dioptimalkan untuk produksi, bukan penerus yang lebih besar. Pascapelatihan dan co-design inferensi fal menciptakan titik operasi yang menarik untuk pembuatan audiovisual short-form yang cepat, sementara keunggulan preferensi independen atas H3 standar tetap moderat alih-alih universal.

Pilih H3 Max saat kecepatan iterasi, throughput, dan kepatuhan prompt menjadi kendala utama. Pilih H3 standar saat Anda membutuhkan alur kerja multimodal yang lebih luas, penyuntingan video, bobot H3-Base terbuka, atau regenerasi 2K. Sebelum berkomitmen ke salah satu rute, jalankan benchmark terkontrol dengan prompt dan pengaturan identik dan hitung biaya per klip yang diterimaโ€”bukan hanya biaya per detik yang dibuat.

FAQ

Bagaimana tim sebaiknya menafsirkan keunggulan benchmark H3 Max saat interval kepercayaan saling tumpang tindih?

Anggap keunggulan itu sebagai bukti yang bersifat arah, bukan bukti bahwa H3 Max menang pada setiap prompt. Dalam cuplikan yang dikutip, H3 Max memimpin H3 sebesar 7 Elo pada teks-ke-video dengan audio dan 14 Elo pada gambar-ke-video dengan audio, tetapi interval kepercayaan saling tumpang tindih. Oleh karena itu tim sebaiknya menguji kumpulan prompt yang representatif, melaporkan tingkat kemenangan dan mode kegagalan, serta menghindari mengubah keunggulan agregat yang moderat menjadi klaim kualitas universal.

Bagaimana tim sebaiknya membandingkan biaya produksi nyata H3 Max dan H3 di luar harga per detik yang tertera?

Hitung biaya per klip yang diterima alih-alih biaya per detik yang dibuat. Sertakan retry, output yang ditolak, penyempurnaan 1080p atau regenerasi 2K, penyimpanan dan transfer, waktu tinjau, dan penyuntingan hilir apa pun. H3 Max dapat menurunkan biaya iterasi melalui pembuatan yang lebih cepat dan kepatuhan prompt yang lebih kuat, sementara H3 bisa lebih ekonomis ketika penyuntingan, kontrol multimodal, atau alur kerja 2K-nya menghindari alat tambahan dan pengerjaan ulang.

Kecepatan pembuatan apa yang realistis diharapkan tim, dan faktor apa yang memengaruhi latensi ujung-ke-ujung?

fal melaporkan inferensi di bawah tiga detik untuk klip 5 detik 768p pada infrastrukturnya yang dioptimalkan. Itu bukan jaminan ujung-ke-ujung yang universal: waktu antrian, unggahan input, perluasan prompt, pemrosesan keamanan, resolusi, durasi, dan routing penyedia semuanya memengaruhi latensi yang diamati. Benchmark endpoint dan konfigurasi tepat yang Anda rencanakan untuk diterapkan.

Alur kerja H3 Max mana yang harus digunakan untuk pekerjaan berbasis teks saja, ber-kondisi gambar, dikendalikan keyframe, atau berbasis referensi?

Gunakan teks-ke-video ketika adegan dapat didefinisikan sepenuhnya dalam bahasa; gunakan gambar-ke-video saat identitas, komposisi, atau gaya visual harus dimulai dari frame yang disuplai. Pilih kontrol frame pertama-ke-terakhir saat keadaan pembukaan dan akhir sama-sama penting, dan referensi-ke-video ketika konsistensi dengan banyak referensi visual penting. Alur kerja yang tepat mengurangi ambiguitas prompt dan harus dipastikan sebelum membandingkan H3 Max dengan H3.

Bagaimana tim sebaiknya memilih antara 480p, 768p, penyempurnaan 1080p H3 Max, dan regenerasi 2K H3?

Gunakan 480p untuk draf murah dan penyaringan konsep volume tinggi, lalu pindah ke 768p untuk evaluasi normal dan banyak pengiriman web. Pilih penyempurnaan 1080p H3 Max ketika produksi cepat tetap menjadi prioritas tetapi format pengiriman membutuhkan lebih banyak piksel. Pilih regenerasi 2K H3 ketika detail maksimum dan alur kerja H3 yang lebih luas membenarkan latensi dan biaya yang lebih tinggi; bandingkan artefak final pada ukuran tampilan aktual alih-alih memilih hanya dari label resolusi.

Bagaimana perbedaan regenerasi 2K MiniMax H3 dengan penyempurnaan 1080p H3 Max?

Ya. MiniMax H3 standar dapat mencapai 2K melalui H3-Regenerate-2K. Ini adalah tahap regenerasi dalam-konteks yang menggunakan kembali instruksi multimodal asli dan hasil 768p, memungkinkannya merekonstruksi detail alih-alih menerapkan pass super-resolusi konvensional. Alur kerja yang lebih luas itu adalah alasan untuk lebih memilih H3 daripada H3 Max untuk resolusi maksimum.

Bagian mana dari MiniMax H3 yang berbobot terbuka, dan bagian mana yang masih memerlukan API hosted?

Sebagian. MiniMax merilis checkpoint H3-Base FL2VA dan Ref2VA di bawah H3 Community License, memungkinkan validasi lokal untuk pembuatan 768p inti. Sistem produksi lengkap belum sepenuhnya terbuka: H3-Context-IR dan H3-Regenerate-2K tetap menjadi komponen hosted, sehingga mereproduksi keseluruhan alur kerja 2K resmi memerlukan API MiniMax.

Kapan produk API sebaiknya memilih H3 Max alih-alih H3 standar?

Sering kali, ketika aplikasi menilai latensi rendah, iterasi kreatif cepat, dan throughput produksi. Itu bukan otomatis pilihan API yang lebih baik: H3 standar lebih disukai untuk regenerasi 2K, pengkondisian multimodal yang lebih luas, penyuntingan video, atau penerapan bobot terbuka. Jalankan uji penerimaan dan bandingkan biaya per output yang dapat digunakan sebelum memilih.

Apa yang harus diukur oleh suite evaluasi produksi sebelum beralih dari H3 ke H3 Max?

Ukur kepatuhan prompt, koherensi gerak, artefak visual, kualitas dan sinkronisasi audio, konsistensi identitas, dan tingkat penerimaan peninjau. Tambahkan metrik operasional seperti tingkat kegagalan tugas, tingkat retry, latensi p50 dan p95 ujung-ke-ujung, dan biaya per klip yang diterima. Segmentasikan hasil berdasarkan teks-ke-video, gambar-ke-video, durasi, resolusi, rasio aspek, dan kompleksitas prompt sehingga rata-rata yang kuat tidak menyembunyikan skenario kritis produksi yang lemah.

Lanjut belajar

Hubungkan artikel ini ke keputusan berikutnya.

Lihat semua topik
Dipublikasikan pada Sep 21, 2026
Terakhir diperbarui Sep 21, 2026
0 tampilan
Ditinjau untuk kejelasan, atribusi sumber, dan terminologi API terkini.

Siap memangkas biaya pengembangan AI hingga 20%?

Mulai gratis dalam beberapa menit. Kredit uji coba gratis disertakan. Tidak perlu kartu kredit.

Baca Selengkapnya