中国政策档案 Governance Archive HOLDINGS 234,771 · FONDS 122
Record · qbitai ACC. 900074565

OpenAI Reportedly Targets AI Music Commercialization, Suno First to Bear Brunt

OpenAI被曝瞄准AI音乐赛道商业化,Suno首当其冲

Issuer
Date
2025-10-26
Instrument
other
Cited by
0
OpenAI is reportedly preparing to enter the AI music generation market, collaborating with Juilliard School to label musical scores for training data, potentially disrupting startups like Suno and Udio.
Full text · 原文 2,621 字
Jay 发自 凹非寺量子位 | 公众号 QbitAI<br> 坏了坏了,AI音乐生成器初创公司Suno AI的蛋糕,也被OpenAI盯上了。<br> 据悉,OpenAI已经跟艺术学院合作了很长时间,不久会正式进军AI音乐。<br> 网友纷纷为估值20亿美元的Suno叫苦:<br> 这世界上哪儿还有什么AI赛道的初创公司啊……大家做的只不过是个还没被OpenAI公布的,一公布就会被取代的ChatGPT子功能罢了!<br> 对OpenAI几亿用户中的大多数来说,待发的新功能显然令人兴奋。<br> AI并不是在让音乐自动化,而是在让人人都具有艺术表达的能力。<br> 不过,鉴于Sora 2的前车之鉴,OpenAI这次的音乐产品还没出炉,就已经有不少人担心起了音乐人版权的问题。<br> AI或许能让卧室制作人也能有大制作,但问题是代价是什么?Suno与Udio的崛起可侵害了不少音乐人的版权。<br> OpenAI艺术人格上线<br> The Information爆料,OpenAI团队最近悄悄在筹备一项AI音乐计划。<br> 目前,OpenAI已经在和茱莉亚学院的一些学生合作标注海量乐谱,用作模型训练数据。<br> 要知道,茱莉亚学院是世界顶级的艺术院校之一,被誉为「艺术家的哈佛」——电影《哈利·波特》的配乐大师John Williams、知名大提琴家马友友,都曾在这里深造。<br> 双方合作的目标,是探索利用OpenAI的先进模型创作高质量音乐内容,旨在拓展AI在创意领域的应用边界。此举意在推动音乐创作的自动化与个性化,为内容创作者提供新工具。<br> 不少外界评论猜测,这个音乐模型未来很可能会整合进Sora 2中,届时用户可以直接让AI为视频自动生成BGM,直接已有的人声轨道上加上吉他伴奏、鼓点或弦乐。<br> The Information还透露道,OpenAI或许正在积极探索AI音乐的To B市场。<br> 最清晰的赛道是广告行业。<br> 广告公司可以使用OpenAI的工具来完成与广告活动制作相关的任务,例如集思广益构思歌词、根据音乐样本或录音创作朗朗上口的广告歌曲,或者上传视频进行风格模仿。<br> 但这个音乐模型会在何时发布,目前还没人知道。<br> 其实现在市面上已经有不少公司在做AI音乐模型了,有一点可以确定——<br> 如果OpenAI真的官宣进军AI音乐,这个原本风平浪静的赛道,恐怕又要掀起滔天巨浪。<br> 毕竟,相比早已卷成春卷的AI Coding之类的赛道,AI音乐生成的世界还算「清净」。<br> 数据统计显示,目前AI音乐生成的竞争主要集中在初创公司之间,前十大平台加起来也只占大约24%左右的市场份额,头部效应并不明显。<br> 放眼全球,最受关注的两家是:<br> 1、Suno:早期领导者之一,2023年末入局,主打“人人可创作音乐”理念。<br> 2、Udio:2024年发布,创始团队为前DeepMind研究人员,更偏向专业或半专业用户。<br> 可以看出,二者的市场定位其实很不一样,不会有太多激烈冲突。<br> 然而,这种清净日子其实从今年起,就已经被巨头盯上了(中译中一下:朋友们,你们的好日子可能持续不了多久了)。<br> 国内这边,有字节跳动的Seed Music、阿里的InspireMuisc、腾讯的SongGeneration、昆仑万维的天工SkyMusic等在慢慢布局。<br> 今年5月,谷歌推出了第二代音乐制作模型Lyria,并通过谷歌云为客户提供服务,并向营销人员宣传其创作商业配乐的能力。<br> OpenAI一旦加入,这场竞赛将会被彻底引爆。<br> 但对于消费者来说嘛,当然是打得越厉害越好。<br> 当一家科技巨头进入一个新兴市场,竞争就会随之升温——创新步伐加快,消费者也会因此在更快的进步中受益,同时得到更多的选择。<br> 重拾「音乐梦」<br> 其实,OpenAI 的「歌手梦」好几年前就埋下了。<br> 2019 年,OpenAI基于早期的GPT扩展出来了MuseNet。<br> 在吃下了数百万份MIDI文件后,能生成长达四分钟的多乐器音乐,最多可用10种乐器,还能模仿贝多芬、肖邦等大师的风格,颇有「小莫扎特」的气势。<br> 仅仅一年后,OpenAI又推出Jukebox。<br> 这次,AI不光会“演奏”,还开始“唱歌”了。<br> 通过120万首歌曲数据集训练,Jukebox能生成带人声的完整原始音频,覆盖摇滚、嘻哈、流行等多种风格,甚至能模仿披头士、Bob Dylan、Beyoncé的声线,效果惊艳到让人分不清真假。<br> 可惜的是,当年的OpenAI资金不够充足,这两个模型都没能走多远。<br> 这一次,时隔多年,OpenAI为何又突然想明白要再次「一展歌喉」了?<br> 一个比较明确的大趋势是:自Scaling Law所承诺一条路走到底的AGI之路撞墙后,OpenAI今年下半年开始频繁尝试新方向——在基座模型之外,推出更多能落地、能赚钱的产品,用来抵消庞大的算力开支。<br> 短短半年,OpenAI已经搞出了Atlas 浏览器、Sora 2等新产品。而现在看来,产品矩阵的下一个维度,似乎是音乐。<br> 原因也很简单:这条路已经被别人跑通了。<br> 比如Suno,这家公司前几天还在高调宣布:凭借订阅模式,Suno今年的ARR已达到1.5亿美元,同比增长近四倍。<br> 更夸张的是,即便算上免费用户,它的毛利率仍超过60%。<br> 要知道,这种程度的「暴利」在AI领域是相当罕见的,做自研模型还能赚到SaaS级别毛利的AI公司,绝对是凤毛麟角。<br> 这或许是因为,音频模型天生更「轻」,也更省钱。<br> 相比动辄几千亿参数的大语言模型,生成一首歌要轻松得多。而与此同时,这个市场的潜在规模和用户付费意愿可一点也不比语言模型差。<br> 所以啊,OpenAI重拾音乐梦,看似浪漫,实则是一次再现实不过的商业决定。<br> 不过,可怜的Suno这下真要遭殃了。<br> 本来正沉浸在「终于跑通商业模式」的喜悦中,谁能想到,OpenAI原来一直趴在暗处对着这块肥肉流口水……<br> 这也再次印证了AI应用公司的「命运之问」——<br> 通用模型公司如果做了这个方向,你的壁垒还在吗?<br> 参考链接:<br> [1]https://www.theinformation.com/articles/openai-plots-generating-ai-music-potential-rivalry-startup-suno<br> [2]https://archive.li/ZiUE5#selection-1517.19-1517.109<br> [3]https://x.com/VraserX/status/1981928959597027586