近日,据TheInformation报道,OpenAI正在开发一款新的音乐生成工具,能够根据文本和音频提示自动创作音乐。
用户未来或可用其为视频添加配乐,或为已有的声乐曲目添加吉他伴奏等器乐伴奏。
这标志着OpenAI在ChatGPT之后,正将其AI能力扩展到文本、图像和视频之外的音乐创作领域。目前尚不清楚该工具将作为独立产品发布,还是整合进ChatGPT或视频生成模型Sora中。
获取高质量训练数据
为提升模型对音乐的理解与生成质量,OpenAI正在与音乐教育领域顶尖机构合作。
OpenAI已经与茱莉亚学院的学生展开合作,这些学生正在为音乐乐谱进行标注,以作为AI模型的训练数据。
茱莉亚学院是全球最著名的表演艺术教育机构之一,其学生的专业知识和艺术素养将为OpenAI的模型提供高质量的学习素材。
这一合作模式反映了OpenAI将人类艺术与机器学习相结合的更广泛目标。
该公司强调,此类创新旨在增强人类创造力,而非取代它。
多种创意应用场景
根据报道,OpenAI内部已经讨论了这款音乐模型的具体应用场景。
该工具将支持文本和音频双提示输入,用户可通过输入一段描述,要求AI为现有的声乐曲目添加吉他伴奏。
这一功能可帮助用户为短视频添加配乐,使视频完全由AI生成。
内容创作者可以先用Sora生成一段视频,然后通过音乐AI即时配上背景音乐,大幅降低内容创作的门槛。
广告公司也可使用OpenAI的音乐模型来为广告创作歌词和旋律,开拓商业应用场景。
从MuseNet到Jukebox
OpenAI对音乐生成领域的探索并非首次。
2019年,OpenAI便推出了音乐生成模型MuseNet。它可以结合最多10种不同乐器的音色,生成古典、摇滚、乡村等多种不同风格、长达4分钟的乐曲,但不能进行歌唱。
随后,OpenAI又在2020年发布了会“唱歌”的Jukebox模型。
由于技术和计算成本的限制,它们生成的音乐与人类创作的仍有较大差距,且均未被整合进ChatGPT和Sora中。
在ChatGPT发布前,OpenAI曾探索过生成音乐模型,但近年来公司主要专注于文本转语音和语音转文本技术。
全球科技公司逐鹿AI音乐
随着算力和模型架构进步,音乐生成技术正迎来实用化可能,成为继文本与视频之后的新一轮AI技术竞赛焦点。
谷歌今年5月推出了第二代音乐制作模型Lyria。谷歌特别强调,Lyria可为广告制作配乐,这与OpenAI音乐模型的潜在商业化方向高度重合。
初创公司Suno和Udio的AI音乐生成产品已成功实现商业化。Suno作为成立仅三年的企业,其年经常性收入已达1.5亿美元,比一年前增长近四倍。
中国AI音乐模型也在迅速崛起,字节跳动的Seed-Music、阿里巴巴的InspireMusic、昆仑万维的MurekaO1、腾讯的SongGeneration以及MiniMax的Music1.5等模型纷纷亮相。
目前,OpenAI已拥有超过8亿活跃用户,音乐模型将帮助其构建更完整的AI生态系统,进一步提升用户黏性。
从OpenAI的技术迭代到全球厂商的争相投入,AI音乐正从实验走向应用,预计将掀起新一輪技术与商业的深度竞逐。
免责声明:本文仅代表作者个人观点,与东方科技网无关。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,请读者仅作参考,并请自行核实相关内容。
本网站有部分内容均转载自其它媒体,转载目的在于传递更多信息,并不代表本网赞同其观点和对其真实性负责,若因作品内容、知识产权、版权和其他问题,请及时提供相关证明等材料并与我们联系,本网站将在规定时间内给予删除等相关处理.

