MiniMax H3 AIビデオジェネレーター

MiniMax H3 は MiniMax のマルチモーダル AI 動画モデルです。テキストプロンプトや最初の画像から、セリフ・環境音・効果音・音楽まで含むネイティブ音声付きの 5〜15 秒の動画を生成し、1 回の生成で複数のショットを切り替えることもできます。下のコンソールでは MiniMax H3 を使います。シーンを入力するか、最初のフレームを追加して生成しましょう。
深夜のラーメン屋での会話
夜明けのトレイルラン・4カット
尾根を歩くユキヒョウ
アニメ風・夏の自転車
MiniMax H3
プロンプト
開始画像(任意)
写真を追加すると動画にできます。追加しなくてもプロンプトだけで生成できます。
プロンプト例
ファイルをアップロードすると、GoEnhance の利用規約とプライバシーポリシーに同意したものとみなされます

MiniMax H3 で作れる動画

以下の動画はすべて GoEnhance 上で MiniMax H3 を使い、1 つのテキストプロンプトから 720p・10 秒で生成したものです。会話シーン、複数カットのスポーツ映像、野生動物、アニメ、3D アニメーション、商品 CM まで。

MiniMax H3のパラメータと主要機能

機能仕様機能
ビデオ生成5~15秒 / 24 FPS / 最大1440pテキスト、画像、動画、音声からシネマティックなAI動画を作成
マルチモーダル入力テキスト、画像、動画、音声キャラクター、アクション、シーン、スタイル、サウンド、ストーリーの意図を理解
リファレンスコントロール最大9枚の画像 + 3本の動画 + 3つの音声ファイルキャラクター、製品、モーション、カメラ、音声のリファレンスを統合
ネイティブオーディオステレオサウンドの組み込み生成セリフ、環境音、効果音、音楽、感情豊かな音声を生成
ビデオ編集局所的な精密編集キャラクター、オブジェクト、背景、服装、照明、エフェクト、セリフを変更
モーショントランスファー動画ベースのモーションおよびカメラリファレンスアクション、表情、演技のリズム、カメラワーク、編集スタイルを再現
ボイストランスファー音声クローンおよび移行一貫性のあるキャラクターボイスと多言語のセリフを作成
アスペクト比対応21:9 / 16:9 / 4:3 / 1:1 / 3:4 / 9:16映画、広告、ソーシャルメディア、Eコマースに最適
プロンプト理解最大7000文字複雑なスクリプト、絵コンテ、詳細な制作指示をサポート
商用コンテンツ制作広告、ブランド、ゲーム、Eコマースプロフェッショナルなコンテンツ制作ワークフロー向けに設計

H3の主な機能

商用グレードのマルチシナリオコンテンツ生成

H3は、テキスト、字幕、ブランド情報、UI/UX要素、ゲームビジュアル、Eコマースプレゼンテーションなど、多様なコンテンツ形式をサポートしています。クリエイターがビデオコンセプトを迅速に検討し、製品ショーケースを開発し、IPキャラクターのシナリオを拡張することを可能にします。また、映画、広告、ゲーム、ブランディング、コマース全体において、コンセプトの検証、ストーリーボードのプレビュー、コンテンツ提案をサポートするクリエイティブチームを支援します。
プロンプト参照画像生成されたクリップ

ネイティブマルチモーダル理解と生成

H3は、テキスト、画像、音声、ビデオなど、複数の入力タイプをサポートしています。すべての資産を統合されたコンテキストとして扱い、情報、音、感情、ビジュアル、クリエイティブな意図の間の関係を理解することで、統合されたコンテンツ理解と視聴覚生成を可能にします。主な機能には、マルチソース参照生成、キャラクターとカメラのガイダンス、音声転送とクローン作成、さらに視覚スタイル、物語のリズム、音の雰囲気、編集パターンの理解が含まれます。
プロンプト参照画像参照ビデオ生成されたクリップ

オールパーパス精密編集と修正

H3は、キャラクターの置き換え、モーション参照、背景の変更、視覚効果、対話の置き換え、雰囲気の調整など、複数の次元にわたる精密な編集を可能にします。強力な指示追従機能により、編集されていない要素を安定させながら、ビジュアル、オーディオ、ペースに関するクリエイターの要求を正確に実行します。主な機能には、オブジェクトとキャラクターの編集、シーンと視覚効果の調整、音声と対話の修正、および高精度のローカライズされた制御が含まれます。
プロンプト参照画像参照ビデオ生成されたクリップ

MiniMax H3の機能を探索する

MiniMax H3が、マルチモーダルな理解、インテリジェントな編集、同期された視聴覚生成を通じて、どのようにアイデアをプロフェッショナルなAI生成動画へと変えるのかをご覧ください。
テキスト・画像から動画生成

テキスト・画像から動画生成

テキストプロンプト、画像、またはそれらを組み合わせた参照元から、高品質な映画のような動画を生成します。H3はキャラクター、環境、視覚スタイル、ストーリーの意図を理解し、一貫性のあるシーンを作成します。

MiniMax H3を試す
よくある質問

MiniMax H3 よくある質問

MiniMax H3とは?

MiniMax H3は、テキスト、画像、動画、音声の参照元を使用して動画を生成および編集できるマルチモーダルAI動画モデルです。

H3は音付きの動画を生成できますか?

はい。H3は、セリフ、効果音、環境音、音楽を含むネイティブステレオ音声を動画と共に生成します。

H3は何個の参照ファイルを使用できますか?

H3は最大9枚の画像、3本の動画、3つの音声参照に対応しており、合計で最大12個のファイルを組み合わせて使用できます。

H3は既存の動画を編集できますか?

はい。キャラクターの置き換え、オブジェクトの修正、背景の変更、エフェクトの調整、セリフや音声の更新が可能です。

H3は縦型動画に対応していますか?

はい。ショート動画プラットフォーム向けの9:16を含む、複数のアスペクト比に対応しています。

H3はキャラクターの一貫性を維持できますか?

はい。キャラクター参照、モーション参照、音声参照を使用することで、生成されたコンテンツ全体で一貫したアイデンティティを維持できます。

H3はどのような業界で利用できますか?

H3は、広告、エンターテインメント、ゲーム、アニメーション、Eコマース、ソーシャルメディアのコンテンツ制作に適しています。

MiniMax H3でプロフェッショナルなAI動画を作成

1つの強力なマルチモーダルAIモデルで、映画のような動画の生成、既存映像の編集、モーション転送、同期された視聴覚体験の作成を実現します。

MiniMax H3を探索する