AI音乐变现:入口变多了,先备好凭据

AI音乐变现:入口变多了,先备好凭据

一句你随手写下的想听什么,从今天起会影响音乐平台的推荐;一段三十秒的录音,也能复刻出一个反复使用的声音。

0:00 / 5:59
本期覆盖北京时间 2026 年 9 月 23 日 8 点到 9 月 24 日 8 点,四条线索的原生页面都落在这个窗口里。它们指向同一个方向:入口变多了,但每个入口都要先看一眼你交出来的东西——一句你说得清的话,一段本人同意的声音样本,一份对得上场景的授权。

直播能说多国话,形象也能登记

9 月 23 日,YouTube 在年度 Made on YouTube 大会上公布一批更新,其中和做音乐的人最贴近的是两件事。1
第一件是直播的实时自动配音,官方说这是为了让创作者触达不同语言的观众;Watch With 也扩展到长视频,观众可以边看边一起反应。第二件是相似度检测,它要上线到手机端:创作者可以登记自己的形象,收到匹配提醒后随手处理,YouTube 还表示会开始把说话声检测和面部检测结合起来,提高匹配准确率。1
创作工具一侧,YouTube Studio 现在能给早期草稿提建议、按频道自己的风格生成缩略图,并支持视频 A/B 测试,一次比较最多三个版本,看哪个版本留得住观众。商业一侧,购物带货的联盟计划将在年底前扩展到 35 个国家。1
  • 适合谁:用视频承载音乐、面向海外观众的人。
  • 投入:一个下午。
  • 风险:这些功能分批、分地区上线,覆盖范围官方没有写全;相似度检测保护的是你出镜的形象和说话的声音,不等于保护你唱的那首歌。
  • 下一步:先把相似度检测登记上,再给一首已有作品排一条多语种版本。

发现入口开始读你那句话

同样是 9 月 23 日,两个发现入口开始接受用户亲口说的话。
Spotify 官网说,Taste Profile 测试版继年初在新西兰试跑之后,开始向美国 18 岁以上的 Premium 用户开放。用户能看到 Spotify 对他在音乐、播客、有声书上的品味摘要,然后在"告诉我们更多"那一栏写下想多听什么、想少听什么,改动通常几小时内生效。官方强调这只是温和的引导:它不能替用户关注艺人,也不能设置"永远显示"或"永不显示"。2
YouTube Music 这边推出 Ask Music,用对话的方式找歌,覆盖三亿多首曲目,包括官方录音、混音、现场、翻唱和 DJ set。官方还提到,2026 年 7 月,YouTube Music 用户发现新艺人超过四亿五千万次。3
  • 适合谁:做发行、歌单和内容分发的人。
  • 投入:二十分钟,加一次数据记录。
  • 风险:两个入口都不向创作者开放定向,也不告诉你谁因为哪句话听到了你;Taste Profile 目前只在美国和新西兰,Ask Music 官方说的是即将推出。
  • 下一步:挑一首作品,把它的风格、场景和语言用一句普通听众会说的话写进标题和简介,记下改动前的数据。

三十秒样本换来一条品牌声线

9 月 23 日,Google 发布两个语音合成模型,Gemini 3.8 Flash TTS 和 Flash-Lite TTS。4
Flash TTS 能用自然语言从零设计声线,角色、口音、性格都可以写进去,覆盖一百多种语言和方言,另外还有两千多个现成声线;用三十秒录音就能复刻一个声线,但需要本人的同意录音做校验。它能逐行导演,控制语速、情绪、口音和对话里的气口,也能在一条脚本里直接排双人对话,长音频里保持音色不漂。Flash-Lite 则面向大批量、成本敏感的场景,官方定位就是高音量配音。4
两个细节值得记住:所有生成的音频都会带上不可感知的水印,用来标记它是 AI 生成的;模型可以在 Google AI Studio 和 Gemini API 这些入口调用。官方还提到,它在 Hume AI 的语音设计榜上排第一。4
  • 适合谁:做人声、配音和多语种内容的人。
  • 投入:一小时。
  • 风险:这是说话不是唱歌;没有本人的同意录音,就不该复刻别人的声线;水印意味着你的成品也会被检测出来,商用范围要以接口条款为准。
  • 下一步:录三十秒自己的干净样本,建一条品牌声线,做一条双语的样片。

门店里的音乐,少收了三点四六亿

9 月 23 日,公播音乐服务商 Soundtrack 发布一份英国企业用音乐习惯的调查,访问了一千零七十位企业决策者。结果显示,百分之九十三面向消费者的英国企业会放音乐,百分之七十七每天都放,相当于大约八十万个经营场所每天有音乐。5
问题在于授权。其中百分之八十六的企业用的是个人版流媒体:百分之五十八用 Spotify,百分之三十二用 Apple Music,百分之三十用 YouTube Music,百分之二十九用 Amazon Music。这些服务都没有商用授权,在店里播放本身就违反它们自己的条款,Soundtrack 的比喻是"用 Netflix 账号开电影院"。它按商用版每月平均 54 英镑、个人版 12 英镑估算,如果有六十八万七千家企业用个人订阅,英国音乐产业每年少收大约三亿四千六百万英镑的商用音乐收入。5
音乐媒体 Music Ally 在报道里补了一句:越来越多英国咖啡馆和酒吧开始用生成式 AI 音乐当背景音。6
  • 适合谁:做曲库、背景音乐和商用配乐交付的人。
  • 投入:半小时。
  • 风险:这是卖方委托的调查,数字是它自己的估算,不是行业审计;公播许可在不同国家有不同的收费主体,AI 音乐进门店那句是媒体观察,不是统计。
  • 下一步:把交付清单拆成文件、使用场景和授权期限三栏,写清客户还需要哪一层许可。

今天可以做的四件事

第一,把相似度检测登记上,给一首已有作品排一条多语种版本。第二,挑一首作品,用一句普通听众会说的话写进标题和简介,记下改动前的数据。第三,录三十秒干净样本,建一条品牌声线。第四,检查你卖给商用场景的音乐,落在哪一层授权里。

This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.

Related content