ACE-Step Songwriting 先写清音乐,再交给生成模型
在 PromptHub 的 Skill 目录里,ACE-Step Songwriting 是一个给 ACE-Step 使用的专业音乐创作指南。它会产出三类输入:Caption、Lyrics 和参数,包括 duration、bpm、key、time-signature、language。
ACE-Step Songwriting 先写清音乐,再交给生成模型
ACE-Step Songwriting 是什么
在 PromptHub 的 Skill 目录里,ACE-Step Songwriting 是一个给 ACE-Step 使用的专业音乐创作指南。它会产出三类输入:Caption、Lyrics 和参数,包括 duration、bpm、key、time-signature、language。
它不是直接渲染 MV,而是帮助用户在生成歌曲之前,把音乐方向、歌词结构和参数写清楚。
Caption 是音乐的方向盘
源文件把 Caption 说成影响生成音乐的重要输入。Caption 可以是风格词、逗号标签,也可以是自然语言描述。它建议把风格、情绪、乐器、音色、年代、制作方式、声线、速度和结构线索组合起来。
比如“sad piano ballad with female breathy vocal”就比“悲伤的歌”更可执行。它也提醒不要把 BPM 和 key 塞进 Caption,因为这些有独立参数。
Lyrics 是时间脚本
歌词部分不只是文字押韵,还包括 [Verse]、[Chorus]、[Bridge]、[Drop]、[Guitar Solo] 等结构标签。它还支持 [whispered]、[raspy vocal]、[building energy] 这类声音和能量提示。
我觉得它对“AI 味歌词”的诊断很实用:堆形容词、押韵混乱、段落边界模糊、没有呼吸空间、混合隐喻,都会让歌听起来像模型自动填词。
一个具体示例
假设要为一个手绘怪兽短片写歌。ACE-Step Songwriting 不会只写“治愈、梦幻”。它可能给 Caption:lo-fi indie pop, warm acoustic guitar, soft toy piano, intimate male vocal, nostalgic and hopeful, bedroom production。
歌词则围绕一个核心隐喻“小怪兽在城市灯里找家”,用 Verse 描述孤独,用 Chorus 给出可记住的句子,用 Bridge 降低能量,再在 Outro 回到手绘感。这样音乐能服务视频,而不是和画面各唱各的。
适合什么场景
它适合 AI 作曲前的歌曲策划、歌词写作、MV 配乐、角色主题歌、广告 jingles 和需要控制结构的音乐生成。
如果已经有音频和 LRC,要做成视频,应接 ACE-Step Simple MV;如果要真实编曲制作,它只是生成前的文字控制层。
使用边界与失败排查
如果生成结果风格摇摆,先检查 Caption 是否有冲突,比如古典弦乐和硬核金属同时出现却没有“从 A 演变到 B”的结构说明。
如果歌词唱不顺,缩短每行音节,保持同段落行长接近,并给段落之间留空行。
更多说明可以看 ACE-Step Songwriting 的 PromptHub 页面 和 GitHub 原始 Skill 文件。
结论
ACE-Step Songwriting 的价值,是把音乐生成前的模糊愿望变成 caption、歌词结构和可控参数。
它适合任何需要让 AI 歌曲服务视频情绪的人。