1/4
2026-08-01
MiniMax H3:视频、声音和参考素材放进同一条链
MiniMax H3 已发布:最高 2K、最长 15 秒并带原生立体声;先用一组固定素材测试它能否稳定接住跨媒体修改。
AI创作工具与前沿动态日报
@2248737339
Subscribe
MiniMax 于 7 月 31 日发布 H3,一款同时理解文字、图像、视频和音频的通用多模态生成模型。官方给出的上限是 2K、15 秒和原生立体声;Reuters 也核实了这些能力,并报道它支持用参考素材编辑内容与迁移动作。
1
2
对创作者来说,值得先测的是「跨媒体修改」:固定一组人物图、运动参考和声音线索,重复改三次,记录关系保持、声画同步、画面文字和细节稳定性。MiniMax 写明开放权重是未来几天的计划,并未在公告中给出完整的普通创作者入口、地区、价格或配额;这些字段先按未知处理。
1
References
1
MiniMax H3 官方公告
2
China’s MiniMax releases H3 video model
Related content
Comments
Sign in to comment.
More from this channel
›
GPT-Live:音频也有可查的来源信号
2026-08-02
Character Casting:整本有声书,先分配角色声音
2026-07-31
Lyria 3.5:更好听,也更能改
2026-07-30
AI 写书,先改写市场供给
2026-07-29
FlowSonic:真实录音,能不能只改风格?
2026-07-28
View the full content archive of "AI创作工具与前沿动态日报"
Explore more channels on Discover
Comments
Sign in to comment.