News
Loading market feed...
News 快訊

MiniMax H3 在舊金山 Magnific 活動引發超額效應,開源影片生成模型進入實戰驗證期

MiniMax 於 2026 年 7 月 31 日正式發布 MiniMax H3,這是一款支援 15 秒 2K 解析度與原生立體聲的通用多模態影片生成模型,並宣佈將依法規開放模型權重。

DeltaMedia 編輯部 8 min 2026年8月15日
MiniMax H3 在舊金山 Magnific 活動引發超額效應,開源影片生成模型進入實戰驗證期

MiniMax H3 在舊金山 Magnific 活動引發超額效應,開源影片生成模型進入實戰驗證期

重點摘要

  • MiniMax 於 2026 年 7 月 31 日正式發布 MiniMax H3,這是一款支援 15 秒 2K 解析度與原生立體聲的通用多模態影片生成模型,並宣佈將依法規開放模型權重。
  • 該模型採用自研 H3-VAE 編碼器,使有效序列長度提升 4 倍,2K 生成成本不到主流模型的三分之一,768p 成本低於主流 720p 方案的半價。
  • MiniMax 在 Magnific 舊金山場館舉辦展示活動時出現超額現象,現場涵蓋商業廣告與音樂錄影帶應用,並提供至 9 月 1 日為止的 2K 生成五折優惠以推動市場採用。

2026 年 7 月 31 日,MiniMax 正式發布 MiniMax H3,這是一款定位為通用多模態生成模型的產品,能夠接受統一的文字、影像、影片與音訊輸入,並輸出長達 15 秒、解析度達 2K 且具備原生立體聲的影片片段。這款模型發布,標誌著 AI 影片生成技術從實驗室的指標競賽,轉向實際介入成本結構與創作工作流。MiniMax 在官方部落格中明確指出,H3 的 2K 輸出定價不到主流影片生成模型每秒成本的三分之一,而 768p 解析度的定價則低於主流 720p 方案的半價。這種激進的定價策略,直接挑戰了現有影片生成市場的經濟模型,迫使開發者與內容創作者重新評估工具選擇。

MiniMax H3 的發布,標誌著 AI 影片生成技術正式告別單純的技術指標競賽,轉而以極具破壞力的定價策略與開源承諾,直接介入全球創作者的實戰工作流與成本結構。

技術架構上,MiniMax H3 主要贏在自研的 H3-VAE 影片編碼器。根據 MiniMax 官方部落格資料,H3-VAE 帶來了 4 倍的有效序列長度增益,這項技術突破使得多鏡頭建模成為可能,進而提升了影片生成的連貫性與時序控制能力。相較於以往依賴外部工具進行音訊對齊或後期製作的流程,H3 原生支援立體聲輸出,並支援 11 種語言的螢幕對話渲染,包括英語、中文、法語、阿拉伯語、韓語、日語、西班牙語、葡萄牙語、德語、俄語與義大利語。這種端到端的生成能力,縮短了從腳本到成品的製作流程,特別適合需要快速修改的商業廣告與音樂錄影帶。

MiniMax H3 要過市場這關,緊緊綁定了合作夥伴 Magnific 的平台。Magnific 原為 Freepik,於 2026 年 4 月 28 日重新品牌為 Magnific,目前擁有超過一百萬名付費訂閱者,提供涵蓋影像、影片、音訊與 3D 生成的工具套件。MiniMax 選擇在 Magnific 舊金山場館舉辦 H3 的展示活動,並非偶然的場地選擇,而是意在將底層模型能力直接嵌入到創作者日常使用的介面中。活動現場,MiniMax AI 解決方案架構師 Ethan Wei 進行了 H3 的技術實機導覽。同時,Enrique Lopez 在 Magnific 平台介面內進行了 H3 的現場實機操作,展示了從文字提示詞到 2K 影片輸出的完整流程。這種將模型研發與平台應用緊密綁定的策略,縮短了技術從發布到採用的時間差。

然而,技術先進、成本便宜,不代表市場就會自動買單。MiniMax AI 在 X 平台上的回顧貼文中提到,舊金山的活動吸引了超過場館容量的參與者,MiniMax 形容這為「稍微超過容量」(a little over capacity)。這種超額現象,一方面反映了創作者社群對高品質、低成本影片生成工具的強烈需求,另一方面也暴露了基礎設施與服務供給之間的張力。當大量使用者同時湧入平台生成 2K 影片,伺服器負載、排隊時間與畫面穩定度,都考驗著 MiniMax 與 Magnific 的合作默契。MiniMax 為緩解這一壓力,推出了限時促銷活動,提供至 2026 年 9 月 1 日為止的 2K 影片生成五折優惠。這種以價格換取市場份額與使用者反饋的策略,在 AI 模型競爭白熱化的階段顯得尤為常見,但也引發了關於長期盈利模式與服務品質維持的討論。

從生成模式來看,MiniMax H3 支援三種主要的生成入口:文字轉影片、首尾幀影像轉影片,以及基於參考的生成。這些多樣的輸入方式,讓創作者有更大的控制權。例如,在商業廣告製作中,創作者可以提供關鍵幀影像作為參考,確保品牌視覺元素的一致性,同時利用文字提示詞調整場景氛圍與動態效果。在音樂錄影帶製作中,創作者可以結合音訊輸入,生成與節奏同步的視覺內容,並利用原生立體聲輸出減少後期音訊對齊的工作量。MarkTechPost 的報導指出,H3 生成的影片影格率為 24 FPS,片段長度可從 4 秒調整至 15 秒,並支援 21:9、16:9、4:3、1:1、3:4 與 9:16 等多種長寬比。這種靈活性,使得 H3 能夠適應從寬螢幕電影感畫面到社群媒體短影片的多種發布需求。

MiniMax H3 的發布,也處於更廣泛的 AI 模型開源趨勢之中。MiniMax 在 2026 年 7 月 17 日的世界人工智慧大會(WAIC2026)上,首次公開宣佈了 H3 及其旗艦語言模型 M3。MiniMax 在 H3 的部落格中同樣表示,計劃在發布後的幾天內,依據適用的法律與法規,公開 H3 的模型權重。這種開源策略意在吸引開發者社群,透過社群回饋與二次開發,加速模型迭代與優化。然而,開源也意味著技術細節的透明化,競爭對手可以基於公開的權重進行分析與改進,這要求 MiniMax 必須保持持續的技術創新與迭代速度,以維持市場領先地位。

在活動現場,Claire Xue 參與了一場關於 AI 影片生成與創意工作流未來走向的爐邊對談。雖然具體發言內容沒有完全公開,但這場對談主要在探討技術如何改變創意產業的工作模式。隨著 AI 生成工具變得更加強大且易用,傳統創意流程中的許多環節可能被自動化取代,例如初步的故事板繪製、動態預覽與音訊對齊。這不僅提升了效率,也引發關於創意主體性與人類角色定位的爭議。創作者需要適應新的工具鏈,將精力從重複性技術操作中解放出來,專注於更高層級的創意決策與敘事構建。MiniMax H3 正是這波轉型的催化劑,它不只提供技術,也推動業界重新定義未來的工作流標準。

從競爭格局來看,MiniMax H3 的定價策略對現有市場參與者構成了直接壓力。當 2K 生成成本降至主流模型的三分之一以下時,依賴高單價服務維持利潤的企業面臨兩難選擇:是跟進降價以保留市場份額,還是轉向高階客製化服務以區隔市場。對獨立創作者與小型工作室來說,H3 的低成本優勢解放了預算限制,讓他們能嘗試更多創意,不用過度擔心累積驚人的生成成本。這種平民化效應,可能加速內容創作的爆發式增長,但也可能導致市場內容的同質化與過載。如何在海量 AI 生成內容中脫穎而出,成為創作者面臨的新挑戰。

此外,MiniMax H3 的多模態能力,特別是對音訊與對話的支援,為跨語言內容創作提供了新的可能性。支援 11 種語言的螢幕對話渲染,使得創作者能夠輕鬆製作多語言版本的影片,擴大內容的受眾範圍。這對想打入國際市場的創作者與企業很有商業價值。然而,語言生成的準確性與文化適配性,仍是需要持續最佳化的領域。AI 模型在處理特定語言的語境、俚語與文化隱喻時,仍可能出現偏差,這需要創作者進行人工審核與調整。

MiniMax H3 的發布與推廣,展現了 AI 影片生成技術從技術指標競爭轉向商業應用驗證的趨勢。透過與 Magnific 平台的深度整合,MiniMax 將模型能力直接嵌入創作者的工作流,降低了使用門檻。激進的定價策略與開源計劃,旨在快速擴大市場佔有率與開發者社群規模。然而,基礎設施的承載能力、長期獲利模式的建立,以及內容品質的持續最佳化,仍是 MiniMax 需要面對的挑戰。對於技術背景的創業者與工程師而言,H3 的技術架構與商業策略提供了重要的參考案例,顯示了在 AI 應用層面,技術創新與商業模式的緊密結合,是贏得市場競爭的關鍵。未來,隨著更多開源模型的湧現與技術的迭代, AI 影片生成市場將進入更加激烈且多元的競爭階段,創作者與開發者需要保持敏銳的技術洞察力與靈活的策略調整能力,以適應快速變化的產業環境。

繼續閱讀