AIGC视频赛道周报|从「生成片段」到「可操作的视频」

AIGC视频赛道周报|从「生成片段」到「可操作的视频」

7月13日至19日,Xmax、Google Vids、万兴科技与 Reelful 把竞争焦点推向实时交互、对话式编辑和一站式工作流,创作者选工具时要先看交付链路,而不只是单次画质。

7 月 13 日至 19 日,AIGC 视频赛道新增的可核实信息,集中在一个变化上:视频工具开始接管生成之后的操作。Xmax X2.0 把实时画面变成可交互界面,Google Vids 用自然语言完成生成和修改,万兴科技把剧本、素材、分镜和后期放进同一套工作台,Reelful 则直接把手机相册整理成可发布的短视频。画质仍然重要,但创作者真正要比较的,已经是从素材到交付还剩多少手工活。
日期事件具体变化更适合谁
7 月 15 日Xmax AI 发布 X2.0实时换人、换装、换风格、触控交互和自定义指令,商用 API 同步开放 1直播、电商试穿、虚拟陪伴和 AR 互动团队
7 月 16 日Google Vids 更新 Gemini Omni 与个人头像可用文字和图片参考生成、分步修改视频;上传自拍和短语音即可生成个人数字头像 2需要快速制作口播、演示和个性化通知的团队
7 月 17 日万兴科技产品矩阵亮相 WAIC 2026万兴剧厂开放「无限画布+专属 Agent」体验,Filmora.AI 与 Virbo AI 首秀;Filmora.AI 预计 8 月上线 3短剧、广告和影视项目团队
7 月 15 日Reelful 推出 AI 短视频工作流从相册素材规划故事、写脚本、配音、加字幕和音乐,并可把静态照片变成动态片段 4创始人、商家和需要持续发社交内容的个人

Xmax X2.0:视频开始接受实时操作

7 月 15 日,极客公园报道 Xmax AI 在当天凌晨发布 X2.0,并同步开放商用 API。X2.0 的输入不再只是文字或图片,它能同时理解触屏拖拽、手势、摄像头画面和文字指令。产品目前开放实时换人 CharX、实时换装 ClothX、实时换风格 VibeX、触控交互 MoX、次元互动 DimX,以及可自定义提示词的 Free 模式。1
按照团队在报道中给出的信息,X2.0 的云端输出为 960p、24fps,响应做到毫秒级;同一模型也已在 iPhone 上跑通实时流式推理,但端侧当前分辨率是 384p。API 价格则按团队口径为海外每小时 6 美元、国内每小时 20 元人民币。端侧清晰度和真实部署成本,仍需要接入方自己压测。1
这条路线和传统文生视频的验收标准不一样。直播平台、电商详情页或互动屏首先要看延迟、连续操作是否稳定、人物和背景会不会在多次指令后漂移;单帧画质反而排在后面。想做试穿、直播互动或虚拟角色产品的团队,可以把 X2.0 当成实时视频基础设施来测试,而不是把它当成又一个短片生成器。

Google Vids:自然语言接管生成后的修改

7 月 16 日,Google 在官方博客宣布 Google Vids 增加 Gemini Omni 和个人头像。Gemini Omni 支持用自然语言和图片参考生成视频,也支持继续对话式修改已有片段,例如更换背景、修正光线和加入效果,不必每次从头生成。2
个人头像功能需要上传自拍和一段语音,用户输入台词后,头像可以代替本人出镜。Google 说明,这些功能面向 Google AI Pro、Ultra 订阅者和 Workspace 企业客户开放,个人头像目前只在部分地区提供,并限制为 18 岁以上用户使用本人形象;生成片段会带有不可见的 SynthID 水印。2
对创作者来说,变化在于「生成一次,再进剪辑软件收拾残局」这条路径被缩短了。它更适合产品演示、内部培训、销售更新和个性化通知,不等于已经替代专业剪辑:地区资格、订阅门槛和数字头像的合规边界都要先确认。

WAIC 现场:影视工作流开始以 Agent 为入口

7 月 17 日,2026 世界人工智能大会在上海开幕。万兴科技在现场开放万兴剧厂「无限画布+专属 Agent」功能,前者把灵感、素材和分镜放进节点式创作空间,支持 20 余项精细化编辑;后者把编剧、美术、导演知识嵌入剧本、资产和分镜工作流。3
同场首秀的 Filmora.AI 被定位为从创意构思到成片交付的一站式 AI 视频创作工作台,预计 8 月正式上线并先开启公测。万兴科技产品负责人称,AI 原生商业视频工作流可让制作时间最高缩短 90%、创作成本最高降低 80%;这两个数字属于公司口径,不能当作独立测试结果。Filmora.AI 已打通与万兴喵影桌面端的协同,项目进入精细剪辑阶段后可以继续在桌面端处理。3
这个方向对短剧和广告团队更有现实意义。团队不必先决定「用哪个模型」,而是先把剧本、角色资产、镜头关系和后期修改放进一个可持续返工的项目空间。Filmora.AI 尚未正式公测,现阶段适合列入候选,不适合直接当作已经稳定可用的生产工具。

Reelful:相册素材被直接编排成短视频

7 月 15 日,TechCrunch 报道 iOS 应用 Reelful 上线。用户输入想讲的故事,录一段 30 秒语音样本,再从相册选择照片和视频,Reelful 会规划视频、写脚本、生成 AI 配音,并组装字幕、音乐和音效;它还可以把静态照片转成短片,生成内容会带水印。完成初稿后,用户可以继续用聊天方式修改配乐、脚本和其它内容。4
Reelful 目前只支持 iOS,TechCrunch 报道的 Creator 订阅为每月 25 美元、包含 10 条视频;一次性购买则有 5 条 15 美元、15 条 43 美元和 33 条 90 美元等档位。它瞄准的是创始人、小商家和个人品牌,而不是需要逐帧控制的影视后期团队。4
它提供的不是更强的单次生成,而是把「挑素材、想结构、写旁白、配乐、加字幕」这串零碎动作合并了。对日更社媒内容的人来说,省下来的可能不是渲染时间,而是决定今天发什么的时间。

本周判断:先按交付链路选工具

本周四个案例覆盖了四个不同入口:Xmax 从实时画面进入,Google Vids 从对话式修改进入,万兴剧厂和 Filmora.AI 从项目工作流进入,Reelful 从手机相册进入。它们共同指向的变化,是 AI 视频产品正在从「输出一个片段」延伸到「管理一连串创作动作」。
选型时可以先问四个问题:
  1. 需要观众或消费者实时改变画面吗?优先测试 Xmax X2.0,重点压测端侧清晰度、延迟和连续交互。
  2. 需要快速做口播、演示或个性化通知吗?Google Vids 的对话式生成和个人头像更匹配,但要先核对地区、账号资格和水印规则。
  3. 需要多人协作、反复改剧本和分镜吗?把万兴剧厂、Filmora.AI 放进候选,等公测后再用真实项目验证,而不是只看展会演示。
  4. 需要把一堆手机素材稳定变成社媒内容吗?Reelful 的方向更直接,但目前的平台限制和订阅成本要算进工作流。
可灵 AI、Seedance、小云雀、小影、Runway、Pika、Sora、Veo 仍在跟踪范围内。本周暂未把它们写入新增更新栏,是因为没有拿到同时满足「事件发生在 7 月 13 日至 19 日」和「能打开详情页核实」这两个条件的材料;搜索摘要和旧消息不作为本周结论。

Contenido relacionado

  • Inicia sesión para comentar.
More from this channel