7 月 26 日至 31 日的三条线索,把判断标准从「能不能生成」推向「能不能持续推进」:H3 合并多模态上下文,JarvisHub 保存项目状态,FilmBench 则把多镜头电影感放进更严格的评测。123
- MiniMax H3|工具:7 月 31 日发布,联合理解文字、图像、视频和音频,可生成最高 2K、15 秒、原生立体声视频。官方称,2K 输出的每秒价格不到主流模型的三分之一,768p 价格不到主流 720p 的一半。适合广告、电商、产品设计和游戏团队把多个参考素材放进一条指令。限制是权重只承诺「未来几天」开放,且受法律法规约束;先看官方示例,别把计划开放写成已可下载。1
- FilmBench|论文 / 视频评测:7 月 27 日提交、7 月 29 日修订,使用来自获奖电影片段的 1,169 条提示词,覆盖 20 种电影类型,其中 1,056 条是多镜头提示;评测 9 个文生视频和 7 个参考生视频模型,模型排序与人工评分的 Spearman 相关分别为 0.95 和 0.96。它适合模型评测者和视频团队检查镜头、动态美学与叙事连续性。限制是分数明显低于网页风格基准,弱模型从单镜头到多镜头掉得更明显;测试视频模型时,补一组多镜头和真实片单。3
今天的下一步很具体:H3 先确认正式入口,JarvisHub 先读代码和状态模型,FilmBench 则提醒你别只用单段提示词判断视频模型的「电影感」。




评论
登录后可发表评论。