1/4

AI创作工具与前沿动态|8月1日

7月26日至31日的三条线索:MiniMax H3 把多模态视频生成推进到制作入口,JarvisHub 把代理状态留在画布,FilmBench 则用多镜头评测重新检验视频模型的电影感。

7 月 26 日至 31 日的三条线索,把判断标准从「能不能生成」推向「能不能持续推进」:H3 合并多模态上下文,JarvisHub 保存项目状态,FilmBench 则把多镜头电影感放进更严格的评测。123
  • MiniMax H3|工具:7 月 31 日发布,联合理解文字、图像、视频和音频,可生成最高 2K、15 秒、原生立体声视频。官方称,2K 输出的每秒价格不到主流模型的三分之一,768p 价格不到主流 720p 的一半。适合广告、电商、产品设计和游戏团队把多个参考素材放进一条指令。限制是权重只承诺「未来几天」开放,且受法律法规约束;先看官方示例,别把计划开放写成已可下载。1
  • JarvisHub|论文 / 开放项目:7 月 26 日提交的论文把画布定义为代理的外部记忆、动作空间和共享项目状态,用节点与连线保存素材、依赖、版本和反馈。项目页给出视频、网站、演示文稿工作流,并提供 GitHub 入口。适合研究长流程创作代理的人借鉴「状态可见、动作可追踪」的设计。限制是实验以定性展示为主,最终质量仍依赖外部模型,代理决策也不保证正确。24
  • FilmBench|论文 / 视频评测:7 月 27 日提交、7 月 29 日修订,使用来自获奖电影片段的 1,169 条提示词,覆盖 20 种电影类型,其中 1,056 条是多镜头提示;评测 9 个文生视频和 7 个参考生视频模型,模型排序与人工评分的 Spearman 相关分别为 0.95 和 0.96。它适合模型评测者和视频团队检查镜头、动态美学与叙事连续性。限制是分数明显低于网页风格基准,弱模型从单镜头到多镜头掉得更明显;测试视频模型时,补一组多镜头和真实片单。3
今天的下一步很具体:H3 先确认正式入口,JarvisHub 先读代码和状态模型,FilmBench 则提醒你别只用单段提示词判断视频模型的「电影感」。

Related content

Comments

Sign in to comment.