首页
看点啥
插画图片
首页 看点啥 摩尔线程完成MiniMax H3模型适配 基于智算卡MTT S5000

摩尔线程完成MiniMax H3模型适配 基于智算卡MTT S5000

2026-08-06 0

据CNMO科技了解,MiniMax近日正式开源多模态生成模型MiniMax H3。与此同时,摩尔线程宣布,已基于AI训推一体智算卡MTT S5000及MUSA软件栈,完成对MiniMax H3的适配与运行。

MiniMax

MiniMax H3是一套通用型全模态生成系统,可统一理解文本、图像、视频和音频构成的多模态上下文,并生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。此次开源内容包括模型权重,同时提供本地部署和完整工作流验证方案。

MiniMax H3

从架构来看,H3系统由三个核心模块组成。其中,H3-Context-IR负责理解并提炼用户输入的多模态指令,将其转换为结构化的上下文中间表示,目前通过API提供;H3-Base根据中间表示生成768p分辨率音视频内容,是此次开源主体;H3-Regenerate-2K则将768p结果与原始上下文一同送回模型,以2K分辨率重新生成更高画质视频,该模块暂未开源,也通过API提供。

在模型设计上,H3-Base采用330亿参数的H3-Omni-Transformer架构,通过不同模态编码器将文本、图像、视频和音频统一编码为多模态序列后进行联合预测。其下包含H3-VisualVAE和H3-AudioVAE,分别用于视觉和音频信息压缩。官方同时提供两个主要版本,分别面向文生视频、首尾帧生视频,以及多图像、多视频、多音频混合输入等任务,适用于人物与场景保留、动作和嘴型编辑等场景,并支持包括中文、英语、日语、韩语在内的11种语言对话。

为方便开发者部署,官方给出“H3-Base本地部署”和“完整2K工作流”两条验证路径,支持通过SGLang、vLLM、diffusers、ComfyUI等框架进行推理。模型目前基于MiniMax H3 Community License发布,开发者可通过开源平台下载使用。

喜欢(0)

上一篇

北京_AGI_Bar_创新玩法:消费即送_DeepSeek_V4_Flash_无限量_API,AI_算力变身线下基础设施

北京_AGI_Bar_创新玩法:消费即送_DeepSeek_V4_Flash_无限量_API,AI_算力变身线下基础设施

下一篇

韩国AI美女天气主播视频走红网络 真人主播饭碗不保?

韩国AI美女天气主播视频走红网络 真人主播饭碗不保?
猜你喜欢