【太平洋科技快讯】8 月 3 日,据稀宇科技官方消息,新一代通用视频模型 MiniMax H3 正式开源。
据介绍,MiniMax H3 是一个通用全模态生成系统,可统一解析文本、图片、视频、音频组合而成的多模态上下文信息,最高可生成 2K 分辨率、最长 15 秒并搭载原生立体音轨的完整视频。
完整的 MiniMax H3 系统由三大模块构成,具体为 H3-Context-IR、H3-Base、H3-Regenerate-2K。模型整体围绕任务泛化完成架构设计,预训练阶段就积累了丰富的跨模态理解与生成能力,可精准执行结构复杂、多素材融合的创作指令。
MiniMax H3 支持 11 类语言,覆盖中文、英语、日语、韩语、俄语、阿拉伯语、法语、德语、意大利语、葡萄牙语、西班牙语,其余语种也可获得不同程度的识别与生成支持。
开源同步完成多生态适配,国内华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技,海外 、 等多家芯片厂商,以及 Hugging Face 开源社区、各类云推理平台均同步完成模型适配工作。