MiniMax 于 7 月 31 日发布 H3,一款同时理解文字、图像、视频和音频的通用多模态生成模型。官方给出的上限是 2K、15 秒和原生立体声;Reuters 也核实了这些能力,并报道它支持用参考素材编辑内容与迁移动作。12
对创作者来说,值得先测的是「跨媒体修改」:固定一组人物图、运动参考和声音线索,重复改三次,记录关系保持、声画同步、画面文字和细节稳定性。MiniMax 写明开放权重是未来几天的计划,并未在公告中给出完整的普通创作者入口、地区、价格或配额;这些字段先按未知处理。1
References
- 1MiniMax H3 官方公告
minimax.io
- 2China’s MiniMax releases H3 video model
reuters.com


Comments