@rcrkpi 在 用llm做音乐现在现实吗? 中发帖
核心链路:
主旋律 → 音乐理解 → 和声/贝斯/对位/配器 → 歌词与人声 → 神经歌声 → 技术审计 → 音乐验收 → 混音母带
目前通过 MCP 让网页端 LLM 调用本地 StudioNext 的音乐操作。体验上 5.6 Sol 不如 6 Astra,但 6 Astra 额度有限。
我不是科班出身,但想把乐理知识结构化进系统——用 Canonical Song Model、Score Language、Creative Locks 和数学约束,让 AI 在可控范围内生成,而不是完全靠提示词。
当前最大的问题是:旋律生成无法跳出均值回归,创意不足。 条件弱时,模型会回到训练数据里最安全、最普遍的模式。
人声方面,DiffSinger whole-phrase 已跑通,技术音准明显改善,但人声与旋律的配合仍需精修——从音符级对齐上升到乐句级呼吸与情感弧线。
为什么不用 Su...