Ai First Song Zero Theory,零乐理也能做出第一版能听的歌

文章导读
零乐理能不能做出第一版能听的歌,判断标准其实很朴素:你有没有一段能反复听、不别扭的哼唱,以及你有没有能力判断初稿哪一段断了。Ai First Song Zero Theory 这类工具负责把输入变成旋律和编曲,能不能听,取决于你交给它的素材和你在初稿上做的删改。所以顺序是固定的:先录哼唱,再写描述,然后按段听,逐句改词,最后整曲连听。跳过任何一步,产出的多半就是拼不起来的片段。
📋 目录
  1. Ⅰ 拿手机录两段自己最顺口的哼唱
  2. Ⅱ 把哼唱描述成文字交给 Ai First Song Zero Theory
  3. Ⅲ 按段落听初稿,标出听不懂的位置
  4. Ⅳ 删掉唱不出来的句子,只留能顺下来的词
  5. Ⅴ 整曲连着听三遍,判断这版能不能当第一版
A A

零乐理能不能做出第一版能听的歌,判断标准其实很朴素:你有没有一段能反复听、不别扭的哼唱,以及你有没有能力判断初稿哪一段断了。Ai First Song Zero Theory 这类工具负责把输入变成旋律和编曲,能不能听,取决于你交给它的素材和你在初稿上做的删改。所以顺序是固定的:先录哼唱,再写描述,然后按段听,逐句改词,最后整曲连听。跳过任何一步,产出的多半就是拼不起来的片段。

零乐理做第一版歌,卡点通常不在工具,而在你手里有没有一段能反复听的哼唱、一份说得清结构的文字描述。做法是先录两段哼唱,再翻译成速度、情绪、段落三行输入,然后按主歌、预副歌、副歌逐段核对秒数,最后删掉唱不顺的句子。三遍听感一致、段落完整、没有突兀切换,这版就可以停下当第一版。

拿手机录两段自己最顺口的哼唱

这一步的目的是确认手里已经有了可用的原始素材,而不是空手让工具替你无中生有。建议录两段,每段 20 到 40 秒,用手机自带录音即可,环境安静一点,不要开着伴奏哼。哼的内容可以是同一段旋律的两个版本,也可以是一段主歌加一段副歌,第二段负责补上第一段没有的音区。

录完先自己听三遍,用三个维度判断:

  • 长度:一段能不能哼满 20 秒以上,中途有没有断掉、忘词、走神停下。不满 20 秒通常说明这段旋律撑不起一个段落。
  • 音高跨度:最高音和最低音之间大概跨了多少。如果一整句都在一个八度以内,说明它适合当主歌;如果副歌明显往上顶,记下来,后面写描述时要用。
  • 节奏是否稳定:一边听一边用手打拍,能不能从头跟到尾不脱节。中途越打越快、或者停手等自己,说明节奏不稳。

不合格时的重录原则是局部重录,不要整段推翻。中段塌下去,就只重录中段;节奏散掉,就把哼唱速度放慢到自己能稳住的程度再录一遍;音高卡在某一句上不去,就把那句降下来唱,不要硬顶。第二段哼唱至少要有一次成功的,不要两段都是将就的版本。

把哼唱描述成文字交给 Ai First Song Zero Theory

工具拿到文字之后才会知道旋律往哪走、情绪是什么、段落怎么排。描述不需要乐理术语,用日常词就够。下面这段结构可以直接复制改写,方括号里的内容必须换成你自己的实际情况,不要照抄:

Ai First Song Zero Theory,零乐理也能做出第一版能听的歌
速度感觉:[慢 / 中速 / 偏快],大概像走路还是像小跑
情绪:[安静 / 有点闷 / 想冲出去],整体不要[太吵 / 太甜]
主歌:[低一点,叙事,句子短]
预副歌:[往上抬一点,准备进副歌]
副歌:[最高,情绪打开,重复一句]
整体长度:[控制在 2 分钟左右,先做短版]
人声:[只要一条主唱,先不要和声]

要替换的是速度感觉、情绪、每段的走向和你想要的长度,这四项直接来自你刚才的哼唱听感。段落安排如果拿不准,就先保留主歌、预副歌、副歌三段,别一开始就要前奏间奏尾奏全齐,短版更容易听完。描述写完再回头看一遍哼唱,确认文字里说的音高走向和你实际哼的差不多,差太多就先改文字再生成。

按段落听初稿,标出听不懂的位置

初稿生成后不要从头到尾连着听一遍就下结论,那样只能得到“好听”或“不好听”这种没法行动的判断。更有效的做法是分三次听,每次只盯一个段落。

  1. 只听主歌:进人声的第一句到进入下一段之前。注意有没有一直循环同一句、绕不出去。
  2. 只听预副歌:从主歌结束到副歌开始的那一小段。注意它是往上抬了,还是原地重复主歌。
  3. 只听副歌:注意它和主歌有没有区别,是不是同样的旋律换了词。

听的时候记时间点,比如“0:48 到 1:02 一直卡在同一个动机上”“1:20 突然跳到一个完全不同的地方,接不上”。这些秒数位置就是你后面要改的地方,比记“听起来怪”有用得多。判断标准可以设得简单一点:一个段落里同一句循环超过两次而没有任何变化,或者段落之间切换得让人找不到接点,都属于要处理的问题。如果只是音色不喜欢但结构清楚,可以先放着,先解决断层。

Ai First Song Zero Theory,零乐理也能做出第一版能听的歌

删掉唱不出来的句子,只留能顺下来的词

生成出来的歌词经常是能读不能唱。这一步的方法是逐句念读,不是唱,就是出声把整句念一遍,一次一句,把有问题的句子挑出来。通常有三类:

  • 字多的:一句话塞了太多字,念完要换气,位置放不进一拍里。
  • 拗口的:连着几个同样的声母或者绕口的组合,念两遍会打结。
  • 重音错位的:句子读起来重音落在虚词上,或者和旋律的重拍对不上。

替换时不给现成的新词,给的是原则:字多的句子先删修饰词,保留主语和动作;拗口的句子换成更常见的同义说法,不要追求文采;重音错位的句子调整语序,让重音落到第一个字或最后一个字,或者干脆换掉这句的核心词。改完再念一遍,能一口气念顺、不需要停下来想,就算通过。整段念完如果只剩个别句子不顺,说明已经接近可唱状态。

整曲连着听三遍,判断这版能不能当第一版

改到一定程度就要收手,否则会一直改下去。收尾的判断方式是整曲连着听三遍,中间不暂停、不回放,听完注意三件事:

  • 三遍听感一致:每一遍听到同一个位置,感觉都是差不多的,不会第一遍觉得怪、第三遍才发现不对。
  • 段落完整:主歌、预副歌、副歌都能听出来,没有哪一段明显短一截或者像被切掉了。
  • 没有突兀切换:段落之间过渡过去是自然的,不会突然跳走或者突然安静得没道理。

三条同时满足,这版就可以停下,当作第一版保留,后面要改也是基于它改,不要再重新生成。任意一条不满足,就按问题回退:听感不一致,回退到按段落听的那一步,重新标秒数;段落不完整,回退到写描述那一步,检查段落安排有没有说清楚;有突兀切换,回退到删词那一步,看看是不是某一句的字数撑不住这个位置。回退只改对应的一段,不要整首重做。