跳到主要内容
一个 AI 音乐生成 skill:给视频配乐、做翻唱、分离音轨
景行景行

一个 AI 音乐生成 skill:给视频配乐、做翻唱、分离音轨

来源:GitHub 仓库 calesthio/OpenMontage 文件 1 个,SKILL.md 语言:英语

一个 AI 音乐生成 skill。

它基于 ACE-Step 1.5(MIT 协议),通过 tools/music_gen.py 运行,跑在 RunPod serverless 上。

它的能力:

  • text2music(默认):从文本 prompt + 可选歌词生成音乐
  • cover:从参考音频做风格迁移
  • extract:分轨——从混合音频分离出人声、鼓、贝斯、吉他、钢琴等
  • repaint(未来):重新生成特定时间段
  • lego(未来):在现有音频上下文中生成单个乐器轨
  • complete(未来):扩展不完整作曲

有 8 个场景预设:corporate-bg、upbeat-tech、ambient、dramatic、tension、hopeful、cta、lofi

提示词工程要点:

  • Caption 分层描述:风格、情绪、乐器、音色、年代、制作、人声
  • 歌词格式:结构标签 [Verse]、[Chorus],人声控制 [raspy vocal],能量指示(大写 = 高音强,括号 = 背景人声)
  • 每行 6-10 个音节,节奏更自然
  • BPM 和 key 用 metadata 参数,不要写进 caption

视频制作集成:

  • 不同场景类型有对应的音乐预设
  • 背景音乐和旁白混合时,音乐音量 10-20%
  • 用 --brand <name> 加载品牌提示
  • 用 --seed 42 固定种子,保证项目内声音一致

技术细节:

  • 输出 48kHz MP3/WAV/FLAC
  • 时长 10-600 秒
  • BPM 30-300
  • GPU 推理约 2-3 秒

适合谁:

  • 做科普视频、教学视频的科研小组成员
  • 需要背景音乐、人声、翻唱、分轨的人
  • 想把音乐和视频制作流程结合起来的人

用法: 把 SKILL.md 内容复制到你的 AI 工具里,描述你想要的音乐风格就行。

评论 0

更多

登录后可点赞、收藏、评论和举报。

还没有评论,先发起一个具体问题。

0/2000
一个 AI 音乐生成 skill:给视频配乐、做翻唱、分离音轨 - 火花工坊