1/4

AI创作工具与前沿动态|7月22日

Google Vids 开始用文本和图片参考做视频,Runway Agent 2.0 把创意、素材和时间线放进同一工作流,Inkling 则把多模态开放权重模型交给开发者定制。

Google Vids、Runway Agent 2.0 和 Inkling,把「生成」往更完整的创作流程里推了一步:前两者在改视频和组织素材,后者把模型定制权交给开发者。
  1. Google Vids:Gemini Omni 可用文字生成和编辑视频,也支持把照片或草图作为参考;自然语言可以继续替换背景、修正光线、添加效果。个人头像功能目前仅限部分地区的 18 岁以上用户。1
  2. Runway Agent 2.0:从一个模糊想法开始,上传素材或 PDF 表现数据,让 Agent 分析、生成 brief,再生成视频、音频和图片,并排进同一条时间线;创作者可以在 Agent 生成和手动编辑之间切换。页面标注日期为 2026 年 7 月 17 日。2
  3. Inkling:Thinking Machines 发布开放权重的多模态 MoE 模型,975B 总参数、41B 激活参数,最大上下文窗口 1M tokens;完整权重可获取,也能在 Tinker 上试用和微调。3
编辑判断:工具侧的变化,是「生成」开始和素材、时间线、修改动作绑在一起;模型侧的变化,是多模态能力开始变成可被个人工作流接管的基础设施。今天真正值得动手试的,不是多一个聊天入口,而是看它能不能少打断一次你的创作流程。

Related content

Comments

Sign in to comment.