MiniMax H3開源:視頻模型迎來"DeepSeek時刻",16家芯片平臺首日適配
![]()
8月3日,大模型公司MiniMax(稀宇科技,00100.HK)正式開源新一代通用視頻模型MiniMax H3,在Artificial Analysis有聲視頻編輯榜單中位列全球第一,以1130分Elo成績領先Gemini Omni Flash、HappyHorse-1.0、Wan 2.7等國內外頭部視頻模型。開源當日,華為昇騰、摩爾線程、沐曦、海光信息、昆侖芯、天數智芯、壁仞科技、AMD、Intel等國內外芯片廠商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub、fal等開發社區和云推理平臺,共16家生態伙伴同步完成適配支持,引發業界對視頻模型行業"DeepSeek時刻"到來的熱議。
多模態通用視頻生成能力解析
MiniMax H3是一個通用型全模態生成系統,能夠統一理解由文本、圖像、視頻和音頻構成的多模態上下文,生成最高2K分辨率、最長15秒、帶有原生立體聲音頻的視頻。H3系統由三個核心模塊組成:H3-Context-IR負責深入理解和提煉輸入的多模態指令,將其轉換為模型可直接理解的上下文中間表示;H3-Base負責生成768p分辨率的音視頻輸出;H3-Regenerate-2K則將768p結果與原始上下文結合,重新生成2K分辨率輸出,實現更高視覺保真度和更精準細節還原。輸入模式支持文生視頻、首幀生視頻、尾幀生視頻、首尾幀生視頻以及全模態參考模式(最多9張圖像、3段視頻、3段音頻混合輸入)。系統穩定支持11種語言生成,包括中文、英語、日語、韓語等,為全球化內容生產奠定基礎。
開源生態與硬件適配規模
MiniMax H3的開源標志著視頻模型賽道從"封閉旗艦"走向"開放生態"的關鍵轉折。在首批適配方中,國內外芯片廠商覆蓋了國產GPU(華為昇騰、摩爾線程、沐曦、海光信息、昆侖芯、天數智芯、壁仞科技)和主流國際芯片(AMD、Intel),推理框架包括SGLang、vLLM-Omni、diffusers和ComfyUI等主流工作流,云推理平臺包括Hugging Face、魔搭ModelScope、RunningHub和fal。開發者可直接從Hugging Face下載模型權重,或調用官方API接入生產環境。這一適配規模在視頻模型領域尚屬首次,意味著企業用戶可根據自身硬件基礎設施選擇最優部署方案,大幅降低使用門檻。業內分析認為,MiniMax H3的開源策略與DeepSeek開源DeepSeek-R1的模式高度相似,有望推動視頻模型從閉源高價服務向開源免費部署的普惠化趨勢演進。
商業應用場景與行業競爭格局
從實際測試效果來看,MiniMax H3在電影預告、游戲菜單、動態海報、時尚廣告、復雜文字排版、UI動效等商業內容生產場景中表現突出。與字節跳動Seedance 2.5等同級別閉源模型在相同素材對比測試中,H3在電影預告、復雜文字和UI動效等場景中優勢明顯。硅谷知名風投機構a16z合伙人Justine Moore測試了行業公認難題"人物在黑板上寫出Hi的畫面",此前所有模型均未成功,H3首次完成該任務。從行業格局來看,過去一年視頻模型能力快速提升,但真正能同時理解多種素材并在同一模型中完成生成內容并同步完成后期包裝的頭部產品極少。這類能力此前主要存在于Seedance 2.5等閉源模型中,用戶只能通過網頁或接口付費使用,無法獲得模型權重進行微調和改造。MiniMax選擇開源旗艦模型,希望借此推動更多硬件適配,方便企業和開發者圍繞自身需求定制模型。OpenAI也于同日公布下一代模型Astra的內部突破,以2000美元算力成本破解十項數學難題,全球AI模型競爭進入新一輪加速期。
![]()
【信源】36氪 | 又一國產模型重磅開源,有聲視頻編輯全球第一,16家芯片及平臺首日適配 | 2026-08-04
【信源】中國新聞周刊 | MiniMax開源H3,視頻模型等來DeepSeek時刻了嗎 | 2026-08-03
【信源】中國經營報 | MiniMax H3正式開源,視頻編輯能力全球第一 | 2026-08-04
特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.