MiniMax H 3:高度なマルチモーダルAIビデオ生成モデル

MiniMax H 3は、統一されたコンテキストでテキスト、画像、ビデオ、オーディオを理解する次世代のマルチモーダルAIビデオモデルであり、ネイティブステレオで最大15秒の2 Kビデオを生成し、映画コンテンツ、広告、eコマース、ゲーム、クリエイティブな制作に最適です。

よくある質問

MiniMax H 3とは何ですか?

MiniMax H 3は、テキスト、画像、ビデオ、オーディオを統一されたコンテキストで理解し、ネイティブステレオでビデオを生成する汎用マルチモーダルAIビデオ生成モデルです。

MiniMax H 3ビデオはどのくらいの時間と詳細にすることができますか?

MiniMax H 3は、最大2 Kの解像度で最大15秒のビデオを生成できます。

MiniMax H 3はビデオと一緒にオーディオを生成しますか?

はい、MiniMax H 3はビデオの横にネイティブステレオオーディオを生成し、会話、雰囲気、音楽、効果音などの要素をサポートします。

MiniMax H 3は複数の参照型を使用できますか?

はい、H 3は、テキスト、画像、ビデオ、およびオーディオの参照と組み合わせて、キャラクターのアイデンティティ、モーション、カメラ言語、音声、および全体的な視覚的方向などの要素を制御できます。