← 所有文章

用于在线音乐生成的神经网络:如何基于文本创建曲目
简单说一下主要的事情(BLUF)
基于文本描述的曲目已经成为现实:你写下流派、情绪以及是否需要文字,神经网络会在几分钟内返回完成的音乐。我们展示了可以获得什么、它是如何工作的以及如何将生成与其他工具连接起来。
一周前,我需要一首播客歌曲。以前,我会去一家自由职业交易所,解释职权范围,等三天,要求更正。在这里我描述了情绪和流派,一分钟后我听了四个带有人声和编曲的版本。用于生成音乐的神经网络很疯狂,但它确实有效。在 模块“音乐”NeuralSpace 你现在就可以尝试一下。
你能得到什么
- 完整歌曲 - 包括人声、歌词、合唱
- 视频的乐器和背景音乐
- 适用于播客和 YouTube 的广告歌曲
- 演示版本:你用歌词哼出旋律,然后你就得到了编曲。嗯,不完全是“哼唱”,而是描述节奏和情绪

这是如何运作的
描述曲目:流派、节奏、情绪、参考。 “低保真、平静、85 BPM,就像学习的播放列表一样”——模型能够理解。另外,您可以用俄语或英语提供歌曲的歌词。输出有 2-4 个选项,长达几分钟。
与其他工具链接
该曲目可以立即作为配乐扔给 视频。封面-拉入 图像生成器。网站描述 - 写信至 GPT 聊天。一切都在一次订阅中, 为真实结果付费.
实践中的提示
- 指定 BPM 和情绪 - 如果没有这个,结果是不可预测的
- 最多 1-2 篇参考文献。 “就像 Radiohead + 90 年代的俄罗斯摇滚 + lo-fi”——模型会感到困惑
- 歌词短句更好——模特更准确地进入节奏
- 生成 3-4 个选项并选择最好的一个。第一个选择几乎从来都不理想
诚实的缺点是:神经网络在复杂的排列和非标准尺寸方面仍然相当薄弱。但对于背景音乐、歌曲和演示来说——已经足够了。
登记 — 欢迎令牌上的第一首曲目。
常见问题 (FAQ)
问题:如何从神经网络中获得最佳结果?
答:使用详细的英文提示(描述),设置场景的风格和细节。
问:这些材料可以用于商业用途吗?
答:是的,生成的内容完全属于您。