MiniMax发布H3 Max实时视频模型,3秒出片开启AI直播新玩法
MiniMax联合fal推出视频生成模型H3 Max,生成5秒768p视频仅需不到3秒,吞吐量约为原版H3的35倍,并在Artificial Analysis和Design Arena榜单上获得图生视频第一。基于该模型,开发者们创建了实时AI直播和AI版短视频应用,实现了视频的实时生成与无缝衔接。H3 Max的开源生态已形成,衍生模型超300个,全球下载量达
公司与模型 · MiniMax 的模型与产品动态:M 系列大模型、语音与多模态能力、开源与商业化
关联由结构化实体与正文位置共同判定 · 最近刷新 2026-09-24 14:40
MiniMax联合fal推出视频生成模型H3 Max,生成5秒768p视频仅需不到3秒,吞吐量约为原版H3的35倍,并在Artificial Analysis和Design Arena榜单上获得图生视频第一。基于该模型,开发者们创建了实时AI直播和AI版短视频应用,实现了视频的实时生成与无缝衔接。H3 Max的开源生态已形成,衍生模型超300个,全球下载量达
Hugging Face 上发布了 MiniMax-H3 的 GGUF 量化版本,用于 ComfyUI。MiniMax-H3 是一个多模态生成系统,支持文本、图像、视频和音频的统一理解与生成,可生成带原生立体声的 2K 分辨率、最长 15 秒的视频。该模型提供多种变体,并支持通过 API 和在线应用使用。
MiniMax核心工程负责人阿岛(缪宇航)已离职,其飞书状态显示离职,下一站未公开。阿岛曾负责M3.x、Agent、Audio及海螺AI等关键业务,并多次代表团队对外解释技术路线。他的离职发生在MiniMax重押Coding和Agent的关键时期,其职责交接情况尚不明确。
Hugging Face 上出现了一个社区整理的 MiniMax H3 量化与剪枝权重集合,支持 INT4、INT8、混合精度及 NVFP4 格式,旨在让消费级 GPU(16-24GB 显存)用户通过 ComfyUI 本地运行 MiniMax H3 的多模态视频生成模型。该集合提供了针对不同显卡的下载指南,并包含文本编码器和 VAE 文件。MiniMax H
MiniMax 发布了通用全模态生成系统 MiniMax H3,支持文本、图像、视频和音频的统一理解,并能生成带原生立体声的 2K 分辨率、最长 15 秒的视频。该系统包含 H3-Context-IR、H3-Base 和 H3-Regenerate-2K 三个模块,支持多种输入模式,并提供 API 和在线应用。
Hugging Face 上发布了 MiniMax H3 模型的 GGUF 量化版本(Abiray/MiniMax-H3-GGUF),该模型是 MiniMax 推出的全模态生成系统,支持文本、图像、视频和音频的统一理解与生成,可生成带原生立体声的 2K 分辨率、最长 15 秒的视频。该仓库提供了多种量化精度的 UNet 模型(FL2VA 和 Ref2VA 模
MiniMax 发布了通用全模态生成系统 MiniMax-H3,支持文本、图像、音频和视频输入,可生成最长 15 秒的带音频视频。PipeNetwork 提供了将其移植到 MLX 的 Python 包,使模型能在 Apple Silicon 上运行。作者在 M5 Max MacBook Pro 上成功运行,下载约 115GB 模型文件,生成视频耗时近 45
中国公司MiniMax发布了H3视频模型权重,成为首个在AI视频排名中登顶的开源模型。该模型拥有330亿参数,能处理文本、图像、视频和音频,生成4至15秒带立体声的片段。尽管2K分辨率模块和H3-Context-IR未开源,但开放权重允许微调,商业使用仅限年收入低于2000万美元的公司。同日,字节跳动发布了闭源的Seedance 2.5模型。
Together AI 宣布成为 MiniMax M3 的首选云合作伙伴,将在其公开发布后托管该开放权重模型。Together AI 的推理和内核团队通过多项优化,如 KV-Block-Major 稀疏注意力内核、MSA 的分页注意力集成等,实现了 81-125% 的吞吐量提升。MiniMax M3 支持 1M 上下文窗口和原生多模态,其稀疏注意力机制显著加
MiniMax 发布视频旗舰模型 H3,价格仅为 Seedance 2.0 的三分之一,并宣布即将开源,成为首个旗舰级开源视频模型。H3 支持文本、图片、音频、视频等多模态统一处理,具备全模态编辑、复杂文本保持和一站式成片能力,在 Artificial Analysis 视频编辑榜单中排名第一。开源旨在推动企业私有化部署和生态扩展,可能改变视频生成行业的竞争