LibTV 与 MiniMax 联合首发新一代开放通用多模态视频模型 MiniMax H3,目前该模型已在 LibTV 平台上线。H3 可统一理解文字、图片、视频与声音,支持从多素材参考、视听内容生成到局部编辑的一体化视频创作流程。

在生成规格方面,MiniMax H3 支持生成 5—15 秒视频,输出帧率为 24 FPS,并可同步生成原生双声道声音。模型覆盖 21:9、16:9、4:3、1:1、3:4、9:16 等常见横竖屏画幅,支持 768p 至 1440p(2K)等不同分辨率。
H3 进一步提升了多模态参考素材的输入能力。单次任务最多可上传 9 张图片、3 段视频和3段音频,混合参考素材总量最高为12个文件,提示词长度最高支持7000字符。创作者可以分别提供人物、商品、场景、动作、运镜、台词、音色和音乐素材,由模型统一分析并生成完整的音视频内容。
生成完成后,用户还可以继续调整人物形象、商品外观、背景环境、光影效果、动作表演、台词内容和声音效果,使视频创作从单次生成扩展为可持续编辑的工作流程。
在应用场景方面,MiniMax H3 主要面向AI短剧、品牌广告、电商营销、影视预告片、MV、游戏角色、动态包装、UI交互和产品演示等商业内容生产。模型支持将人物一致性、动作表演、对白、情绪和镜头节奏结合起来,也可以根据商品图片和品牌素材批量测试不同广告创意。
LibTV 还将 H3 与爆款复刻、一抽四、一抽八等视频 Skill 结合,允许用户一次生成多个候选版本,用于对比不同人物表演、广告创意、镜头运动和剪辑节奏,减少逐条生成和反复筛选所需的时间。
MiniMax H3 上线期间,LibTV 推出了限时活动价格:768p 视频最低为 0.1 元/秒,2K 视频最低为 0.2 元/秒。按照平台公布的参考成本,制作一支广告视频约需10元,完成一集短剧约需20元;实际费用会受到视频时长、分辨率、生成次数及所使用 Skill 的影响。
MiniMax H3 通过统一多模态理解、原生音视频生成和多素材精准控制,进一步降低了高质量商业视频的制作门槛,也为短剧、广告和电商内容的规模化生产提供了新的模型选择。
©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。
