MiniMax H3开源热度超DeepSeek

时间:2026年8月8日 地点:上海(MiniMax 公司总部)/ 全球开源社区 人物:MiniMax 团队;Hugging Face 社区;Design Arena 评测机构 事件详情: 8月8日中文媒体综合报道显示,MiniMax 8月3日正式开源的通用视频模型 MiniMax H3 在 Hugging Face 热度榜上正式超越 DeepSeek V4 Flash 登顶第一名。H3 是一个通用型全模态生成系统,能统一理解文本、图像、视频、音频多模态上下文,生成最高 2K 分辨率、最长 15 秒、带原生立体声音频的视频。8月6日 Design Arena 公布的榜单中,H3 在多图生视频、图生视频、视频编辑三个类别全面登顶,Artificial Analysis 视频编辑评测榜与 Arena 图生视频榜均位列全球第一。 背景: H3 由 H3-Context-IR、H3-Base、H3-Regenerate-2K 三个模块组成,开发者可直接从 Hugging Face 下载模型。H3-Base 已支持通过 SGLang、vLLM、diffusers、ComfyUI 等推理框架与工作流部署。在开源视频生成赛道,海外 Runway Gen-4、Pika 2.0、Luma Ray 长期占据主导地位,H3 的开源登顶标志着中国 AI 在视频生成这一最难的生成式 AI 赛道上首次实现全球开源第一。Stable Diffusion 创始人 Emad Mostaque 与 a16z 合伙人 Justine Moore 等业内知名人士公开点赞。 影响: - 影响1:开源视频生成赛道格局重塑,H3 凭借"多模态理解+原生立体声+2K分辨率+15秒时长"组合成为新一代开源视频模型事实标准,国内外多家厂商在开源当日即完成适配。 - 影响2:Hugging Face 热度超越 DeepSeek V4 Flash 登顶开源社区第一,证明中国 AI 在视频生成这一长期被海外厂商主导的赛道完成首次"开源反超",资本市场对此反应积极。 - 影响3:ComfyUI、SGLang、vLLM、diffusers 推理框架 Day-0 适配大幅降低开发者接入门槛,开源生态可立即围绕 H3 构建视频生成工作流与垂直应用。 - 影响4:H3 内置的原生立体声音频生成能力打破了"视频生成只生成画面"的传统范式,为影视解说、播客可视化、广告 MV 等场景打开新可能。 总结: MiniMax H3 是中国 AI 在视频生成赛道首次实现"开源反超"海外厂商的标志事件。从8月3日开源到8月6日 Design Arena 三榜登顶,再到8月8日 HF 热度超越 DeepSeek V4 Flash,H3 用 5 天时间完成"开源发布→权威评测第一→社区热度第一"三级跳。2K 视频 + 15秒时长 + 原生立体声 + 多模态理解的产品组合,让 H3 同时具备研究价值与商业落地能力,是中国 AI 走出文本、图像优势区,在视频生成这一最高难度赛道上拿到全球第一阵营位置的里程碑。 参考来源: - https://so.html5.qq.com/page/real/search_news?docid=70000021_8446a731afb01152 - https://so.html5.qq.com/page/real/search_news?docid=70000021_1076a771a3b90165 - https://so.html5.qq.com/page/real/search_news?docid=70000021_1796a7177f083865 - https://so.html5.qq.com/page/real/search_news?docid=70000021_7166a7003df73652 - https://so.html5.qq.com/page/real/search_news?docid=70000021_8146a70602637752 - https://github.com/ai-models-lab/minimax-h3 - https://huggingface.co/MiniMaxAI