全民制作人的时代来了?AI音乐模型Mureka v7帮你三分钟制作一首歌曲。

 

全民制作人的时代来了?AI音乐模型Mureka v7帮你三分钟制作一首歌曲。

这段时间,Mureka 发布了“最强”的 AI 音乐模型:Mureka O1 和 V7(其中 O1 是深度思考版本,有点像 DeepSeek 中 R1 和 V3 的区别),他可以帮你生成一首完整的歌曲,包含作词和作曲,也可以模仿你喜欢歌手的声音帮你演唱,甚至还可以复制你的声音,帮你出一整张属于你的专辑。
简单来说,这个模型可以让你打字即可获得高质量的歌曲。
官网在这:https://www.mureka.ai/hub/
官网首页就包含了很多其他用户小伙伴制作的歌曲,我们可以试听一下,然后,我就可以进入属于自己的歌曲创作之旅了。由于我自己比较喜欢说唱,同时作为一个前段时间一直在苦苦找工作的大学生,我决定制作一个激励自己继续努力的说唱歌曲。
那么首先,我先用之前在豆包中制作的AI智能体来生成歌词,智能体的名字叫做rapper作词人。可以扫描下方二维码使用:

接着,我让AI写一段rapper歌词:

写好歌词之后,我们复制到Mureka的网页中:
接着我们可以点击下图红色框中的段落标记,Mureka会自动地把歌曲按照:Intro(Introduction)/ 前奏、Verse / 主歌、Pre Chorus (Middle)/ 副歌前段(导歌)、Chorus / 副歌、Bridge / 桥段、Inter / 间奏、Instrumental solo / 乐器独奏、Outro / 尾奏等顺序帮你重新规划歌曲的布局结构,让制作变得更专业。

在完成歌词创作之后,就是曲子的创作,曲子的制作可以按照你自己的想法,如果你是小白,可以像我一样,直接询问豆包智能体,问一下我的这段rap歌词适合什么样的旋律(包括曲风、情绪、人声性别、BPM和节拍数等等)。完成之后可以直接复制到歌曲描述中。

除了直接描述来制作曲风之外,我们还可以通过上传参考歌曲来生成相似的曲子,例如《跳楼机》,《九万字》和坤坤的《Deadman》等。

在完成曲子的风格选择之后,我们就可以直接点击“创作”,等待几分钟之后,属于你的AI歌曲就出炉啦!
但是,下载完整的歌曲和版权证明需要氪金,现在只能试听一下,大家可以作为一个娱乐,如果有专业的制作需求可以充值,总体的花费也不会特别高。
针对专业的歌曲制作人,Mureka还提供了一个o1的推理模型,性能更强大,可以实现专业级别的人声和混音效果。那么除了简单的测评Mureka,我还稍微深入研究了Mureka模型的结构。
Mureka的核心创新围绕“思维链(Chain-of-Thought,CoT)”方法展开,其原理可从技术路径与实际效果两方面梳理:  
1.在技术实现上,Mureka团队推出了MusiCoT模型。与传统自回归模型“逐段生成音频token”的模式不同,MusiCoT首次引入“先规划整体结构、再生成细粒度内容”的逻辑,在预测具体音频token之前,模型会预先生成完整的音乐结构(如段落划分、乐器编排框架等),从根源上解决了传统生成方式中容易出现的“结构断裂”问题。同时,MusiCoT基于CLAP模型构建(关于CLAP模型的原理可以浏览:https://zhuanlan.zhihu.com/p/702487342),无需依赖人工标注数据,既保证了模型的高扩展性,又让生成过程的可解释性大幅提升——用户能清晰追溯音乐结构、乐器选择的决策逻辑。 
2.在实际效果上,这种基于思维链的“逐步反馈与优化机制”带来了多维度提升。一方面,通过对音乐结构、歌词与旋律的匹配关系、演唱细节进行层层优化,显著提升了歌词与旋律的契合度、演唱的准确性,以及整体艺术表现力;另一方面,在保证高质量生成的同时,Mureka仍能维持低延时的音乐生成效率。 
总的来说,Mureka的核心原理是通过思维链方法重构音乐生成流程,在提升音乐结构连贯性、编排精准度、艺术质量的同时,兼顾了生成效率与扩展性,为高保真AI音乐生成开辟了结构化的新路径。下图为MusicCoT的具体实现流程:



Comments

Popular posts from this blog

Alibaba's Z-Image-Turbo: How a 6.15B Parameter AI Model Crushed 20B Giants in Image Generation (0.8s & Perfect Chinese Text)

The Group Chat Was Already Dead by Message 12

Why AI Agents Need More Than Reusable Skills