輸入與參考素材 · MiniMax H3
依用途整理圖片、影片與音訊,並在同一個請求中為每份素材指定清楚角色。
BestAIVideo
MiniMax H3,也稱為海洛03,支援多種開始拍攝的方式。 BestAIVideo 可協助您選擇路線、為每個視覺或音訊參考分配一個作業、估計信用成本並保留結果旁的完整設定。
MiniMax 將 H3 描述為通用多模態模型,可以解釋文字、圖像、音訊和目標視訊之間的關係。 BestAIVideo 在一台專用產生器中公開可用於生產的視訊模式。
解釋主題、動作、攝影機語言和音訊參考如何協同工作。 H3 使用自然語言來解釋這些關係,而不是將所有創意請求強加給個別專家的任務。
選擇 768P 進行更快的探索,或選擇 2K 以獲得更精細的紋理和製作細節。 MiniMax 使用上下文內再生,因此基礎模型可以重新存取原始上下文,同時恢復高解析度資訊。
產生音訊、氛圍、效果、音樂以及視覺效果。 立體聲放置和視聽定時確保動作、剪輯、對話和環境聲音屬於同一場景。
設定 4-15 秒之間的任意持續時間,並選擇影片、方形、橫向或垂直寬高比。 當僅使用文字不夠時,「第一幀」、「最後一幀」和「瀏覽」模式可添加更多控制。
確定哪種模式適合您的工作,為每個參考賦予不同的角色,並在生成之前將攝影機和聲音指令編寫為協調序列。
文字用於探索,單幀固定身分,首尾幀控制轉場,混合參考協調畫面與聲音。
最多五張圖和三段音訊,每份素材只負責主體、環境、風格、聲音或效果中的一項。
在 4–15 秒內依序寫明起始狀態、主體動作、運鏡、場景變化和結束影格。
把對白、環境聲、音效和音樂對應到畫面,並確認時長、解析度與畫幅。
MiniMax H3 官方樣本包括鳳頭守宮的眼睛、鱗片和舌頭移動的細節。 透過範例提示探索受控工作室照明、淺焦點和精確的自然運動。
垂直移動穿過機械塔的攝影機顯示了模型的原生立體呈現。 嘗試根據提示調整空間氛圍、機械、照明和連續的建築運動。
MiniMax 的範例電影標題結合了圖形面板、版面配置、輪廓、物件和有節奏的剪輯。 提示符將這些元素轉換為具有同步聲音方向的簡潔開場序列。
依用途整理圖片、影片與音訊,並在同一個請求中為每份素材指定清楚角色。
先用短片測試動作,再選擇目前模型支援的片長與解析度。
將提示詞、參數與參考素材儲存在製作記錄中,方便比較並重現結果。
使用客製化的蒙太奇、排版、轉場和聲音開發標題序列、情緒影片和準備好的視覺方向。
創建動畫產品時刻、功能演示、互動式場景,並啟動數位體驗的視覺效果。
將靜態的關鍵藝術和角色設計轉變為具有受控深度、運動、框架和氛圍的循環垂直海報。
根據參考影像和準確的創意簡報創建產品展示、生活方式攝影、品牌轉型和活動變體。
在投入完整的製作流程之前,預先視覺化角色、介面、環境、過場動畫和風格化動作。
將清晰的視覺步驟、敘述、效果和一致的主題結合起來,用於演示、課程和簡短的概念解釋。
MiniMax H3 是 MiniMax 的通用多模態生成模型,也可稱為 Hailuo 03。 它整合了視訊生成、引用、編輯關係以及共同生成的原生立體聲音訊。
BestAIVideo 支援文字轉視訊轉換、第一幀影像到視訊轉換、第一幀和最後一幀生成以及包括影像和可選音訊的多模態參考生成。
BestAIVideo的MiniMax H3產生器支援768P和2K。 如果您想在輸出中獲得強烈的紋理和細節保真度,請使用 768P 進行更快的探索,並使用 2K。
在 BestAIVideo,MiniMax H3 支援從 4 秒到 15 秒的任何 1 秒長度,讓您可以將鏡頭長度與快速動作、產品瞬間、過渡或完整的短場景相匹配。
是的。 MiniMax H3 共同產生原生立體聲音頻,包括語音、氣氛、音效和音樂,因此聲音可以跟隨螢幕上的移動和場景變化。
是的。 透過上傳第一幀來製作合成動畫,或者如果影片需要在兩個定義的視覺狀態之間移動,則添加第一幀和最後一幀。
BestAIVideo 的 MiniMax H3 參考模式接受 1 到 5 個影像,並且可選擇最多 3 個 WAV 或 MP3 音訊檔案。 此模式需要參考影像。
文本和參考生成支援 21:9、16:9、4:3、1:1、3:4 和 9:16。 參考模式還提供自適應框架,而圖像模式則遵循上傳的框架。
創建一個紧凑的制作簡介。 確定主題和背景,演練動作和攝影機運動,指定視覺處理,然後添加對話、氛圍、效果和音樂提示。
是的。 本頁的功能和範例影片取自MiniMax官方H3發布文件。 範例提示是一個 BestAIVideo 相容摘要,旨在探索鎖定的 MiniMax H3 產生器的可見功能。
從乾淨的來源文件開始,每個文件都有明顯的工作。 當身分或產品形狀很重要時,請使用無障礙、明亮的圖像,並保持與預期場景在視覺上一致的風格參考。 對於音頻,修剪靜音或無關材料以輕鬆識別聲音、音樂提示、氛圍或效果。 在提示中命名所有檔案角色,而不是期望模型猜測。 如果這兩個引用發生衝突,請說明哪一個控制主體的身分,哪一個控制顏色、構圖、運動或聲音。 一個小的、有意的參考集通常比五個不相關的圖像和三個競爭的音軌更容易指導。
檢查層中的輸出。 首先,檢查主體的身分、構成以及主要動作是否在選定的時間段內結束。 然後我們檢查攝影機方向、運動的連續性、手和細節,然後是對話時間、立體聲位置、氣氛和音樂平衡。 您可以一次更改一類說明,看看如何改善您的結果。 如果一個鏡頭感覺很倉促,請簡化動作或在添加細節之前留出更多時間。 如果影像發生變化,請加強第一幀或參考的作用。 保留適當的措詞、解析度、寬高比和參考作業,作為下一個變體的可重複使用的摘要。