Google DeepMind 上周发布了 Lyria 3.5——一个能生成完整歌曲的 AI 音乐模型。支持精确的 BPM 设置、全曲 stem 导出、更好的 prompt 遵循度和更有表现力的人声。
专业音乐制作人的反应?沉默。Reddit 上的讨论?大部分是「听起来还不错,但总觉得少了点什么」。Spotify 上突然出现的神秘账号,发布了一整张专辑但没有任何创作者信息?那些几乎肯定是 AI 生成的——而且已经有人听了。
AI 音乐已经悄悄渗透进我们的日常听觉体验,但没有人想在酒吧里承认「我喜欢的那首歌是 AI 写的」。为什么?
音乐的「作者崇拜」
在所有艺术形式里,音乐对作者的依赖是最强的。你不需要知道一幅画是谁画的就能欣赏它。但当你听到一首歌——一首真正打动你的歌——你的第一反应是什么?
「这是谁唱的?」
我们不只是消费音乐。我们通过音乐和人建立连接。你爱一首歌,部分原因是你觉得那首歌的创作者「懂你」。Taylor Swift 的粉丝不只是听她的歌——他们追随她的故事,理解她每句歌词背后的情感,把她的人生叙事和自己的经历编织在一起。
AI 打破了这个连接。一首 AI 生成的歌——即使它在技术层面和 Taylor Swift 的作品一样好甚至更好——没有作者。没有故事。没有那个你在深夜打开手机手电筒时在心里对话的人。
这本身就是一个问题。但对音乐产业来说,还有一个更实际的问题。
Spotify 的 AI 幽灵
Spotify 已经在用 AI 生成背景音乐填充播放列表了——「专注工作」、「放松」、「深度睡眠」。这些播放列表有几千万的月活跃听众。这些音乐不需要作者,因为听众根本不在乎谁做的。他们在写代码,在睡觉,在冥想。音乐只是背景。
这对 Spotify 来说是天大的好事:不需要付版税,不需要和唱片公司谈判,利润率直接从30%飞到80%。但对创作者来说呢?
全球音乐产业每年产生约300亿美元的收入。其中大约15-20%来自「背景音乐」市场——你不主动听的音乐,但在各种场景里存在的音乐:商场、健身房、办公室、电梯、还有那些 Spotify 的专注播放列表。
AI 会先把这部分吃掉。不是因为 AI 音乐更好——而是因为对背景音乐来说,「够好」就是完美。然后它会向上渗透。首先是伴奏,然后是旋律,然后是歌词,然后是整个创作过程。
「AI 制作」正在成为新的羞耻标签
这是最有趣的部分。如果你在 2024 年告诉别人你听一首 AI 生成的歌,对方的反应可能是「哇,技术好厉害」。到 2026 年,这个反应变成了微妙的尴尬。
「AI 辅助创作」和「AI 生成」之间有一道看不见但被严格守卫的线。用 AI 帮你混音?可以。用 AI 帮你写一段 bridge?有争议但越来越多人这么做。用 AI 生成整首歌然后署自己的名?你在音乐圈里的社交信用立刻归零。
这道线不是基于技术能力的——Lyria 3.5 能生成的歌在技术层面已经通过了一个普通听众的盲测。这道线是基于身份认同的。承认你喜欢 AI 音乐,等于承认你不那么在意创作过程中的人类情感。这在2026年仍然是一个非常不受欢迎的立场。
未来五年会发生什么
三个预测:
- 背景音乐市场将在两年内被 AI 完全接管。这不是预测,这是已经在发生的事。Spotify 不会公开说,但他们的财报里「内容成本」那一项会逐年下降。
- 一个「AI 辅助创作」的格莱美级作品会在三年内出现。它的创作者会公开承认使用了 AI,但强调「核心创意和情感来自人类」。媒体会辩论三个月这是不是「真正的艺术」,然后这条线会再次被模糊。
- 「AI 音乐认证」将成为一个新的行业标准。就像「有机食品」标签一样,音乐作品上会出现「100% Human-Made」的认证标志。不是为了法律原因——是因为消费者愿意为「人类创作」这个标签付溢价。
最后一个预测可能听起来可笑——为「非 AI」付费?但看看咖啡。100年前没人关心咖啡是不是有机的。现在你愿意为「有机」多付两倍的价格,即使你在盲测里分辨不出区别。音乐也会走同样的路。
AI 音乐的未来不是「AI vs 人类」的对决。是「AI 做的音乐」和「人做的音乐」变成了两个不同的产品品类,就像速溶咖啡和手冲咖啡可以在同一个超市里共存——面向不同的场景,不同的价格,不同的人群。
差别在于:听手冲咖啡的人会很自豪地告诉你他们在听手冲咖啡。听速溶咖啡的人不会。
至少目前不会。