MiniMax 发布全模态模型 H3,将开源权重
7 月 31 日,MiniMax 正式发布通用全模态生成模型 H3,支持对文本、图像、视频、声音的多模态上下文统一理解与生成,可输出原生双声道音视频,最高支持 15 秒 2K 分辨率。该模型在指令遵循、文字呈现及视频动作迁移方面表现突出,适用于广告、电商、游戏等商业场景。
H3 默认提供 2K 分辨率,同分辨率下每秒价格不到主流模型的三分之一。公司计划在未来几天内开放模型权重,以推动开源社区发展并加速国产芯片适配。H3 是继 Hailuo 01、02 后的第三代模型,在预训练阶段即融合多模态数据与任务,追求任务的统一与泛化。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END













暂无评论内容