--- name: mc-texture-layering description: Texture and spectral layering (织体与频谱分层) - arranging as a space budget rather than an instrument list. Foreground/middle-ground/background depth planning, the perceptual cues that decide what a listener hears as lead, rate-of-change discipline per depth layer, the frequency budget and the three ways to resolve a collision (yield / separate registers / alternate), and the maximal-density method for building dense sections. Use when a mix or arrangement sounds muddy, flat, or two-dimensional, when two parts fight, when the wrong element is grabbing attention, when something is written but inaudible, or when filling the spectrum_budget field of an ARR-SPEC. Grounded in critical bands, masking asymmetry (low masks high), temporal masking and auditory grouping. 织体、频段预算、临界频带、掩蔽、前中后景、深度、密度、声部打架。 --- # 织体与频谱分层(Texture & Spectral Layering) **核心观念:编曲是一份空间预算,不是一张乐器清单。** > **音乐空间有边界,像画布一样,添加超过限度就会覆盖已有内容。** > **每添加一个部分,其他部分就需要更费力地争夺听众注意力。** (p0286) 所以"加一层"从来不是免费的。这个 skill 管的就是**怎么分配这份有限的空间**。 ## 按任务读哪几节 | 症状/任务 | 读 | |---|---| | 糊、浑、听不清 | §4 频谱预算 | | 平、二维、没有纵深 | §2 深度三层 | | 主角不突出/抢戏的是别人 | §3 深度线索 + §3.2 陷阱 | | 写了但听不见 | §3、§4 一起看 | | 段落越到后面越乱 | §5 变化率纪律 | | 要做一个很密但不乱的段落 | §6 最大密度法 | | 填 ARR-SPEC 的 spectrum_budget | §7 + §8 | ## 边界:什么不归这个 skill 管 | 不归这里 | 归哪 | |---|---| | 用哪件乐器、混合音色怎么混 | `mc-orchestration` | | 什么时候进场退场、能量曲线 | `mc-arrangement-arch` | | 具体的 EQ 频点、压缩比、母带 | 出库 → 声音设计与混音库 | | 段落让路的**意图**(哪段谁让谁) | `mc-mix-intent`(本 skill 管**结构性**的分层,它管**段落性**的让路) | | 鼓组内部的层次 | `mc-rhythm-section` | > `mc-texture-layering` 与 `mc-mix-intent` 的分界容易含糊,记住这条: > **本 skill 的解法是"改写"(换音区、减音符、换乐器、错开时间); > mix-intent 的解法是"改混"(让频、侧链、动态)。** > 能在作曲层解决的,不要留给混音——那是把问题往下游推。 --- ## 1. 动笔前必填 | 必填 | 问法 | |---|---| | **① 深度图** | 每个元素在前景/中景/背景的哪一层?(§2) | | **② 频段归属** | 每个元素主要占哪个频段?说不出来就还没想清楚 | | **③ 冲突清单** | 哪两件在抢同一块空间?(§4) | | **④ 每处冲突的解法** | 让频/错开音区/交替出现——**三选一,写明是哪一种** | --- ## 2. 深度三层:前景、中景、背景 **问题**:音乐感觉"扁平(flatness)"或二维化,缺乏深度感 (p0111)。 **做法**:借用视觉艺术(电影、摄影、绘画)的概念,**在作曲阶段就规划深度层级**, 而不是把它全留给混音 (p0111)。 | 层 | 视觉类比 (p0112) | |---|---| | **前景** | 离观察者最近,通常是主体,焦点清晰,细节丰富 | | **中景** | 介于两者之间,非主要焦点,但比背景更近更突出 | | **背景** | 距离最远,可识别但模糊,细节较少 | **制作层面怎么推拉** (p0112–0113): | | 拉近(推向前景) | 推远(推向背景) | |---|---|---| | 音量 | 更响 | 更轻 | | 音色 | 更亮(增加高频) | 更暗 | | 空间 | 更干(原始信号比例高、混响少) | 混响更多 | **★ 但本 skill 关心的是作曲层面的深度**,见 §3——那部分是混音救不回来的。 --- ## 3. 深度线索:听众凭什么决定谁是主角 ### 3.1 四条感知线索 > **人耳倾向于把「高」「响」「快」「变化率快」的声音听作前景。** (p0113) 注意这四条里只有"响"是混音能调的,其余三条**在作曲阶段就定死了**。 其中三条 Howard & Angus 给了听觉上的解释:**响**——听觉在 3–4 kHz 附近最灵敏,同样声压级下这一带比低频响得多(p0091、p0093); **高**——5–7 次以上谐波显著的音色被形容为明亮、刺耳、极具穿透力(p0223、p0228); **变化率**——听觉对变化的声音非常敏感,不变的东西会被"适应"掉(p0352、p0342)。 **一个精确的例子** (p0113): > 鼓组通常很响,但因为其**一致性(consistent and unvarying)**,通常被置于中景或背景; > 当发生**鼓填充(drum fill)**时,**纹理密度与复杂度的突然变化**使鼓暂时跳到前景。 这条把"变化率"讲透了:同一件乐器,不改音量不改音色,**只靠变化率就能在深度上位移**。 ——所以 fill 不是装饰,是**深度调度**。 ### 3.2 ★ 最常见的陷阱 > 如果合成器旋律线**比人声高八度**,或者**节奏更复杂、音符跳跃更剧烈**, > 听众可能会潜意识地把合成器而非人声听作**主导声部**。 (p0113) 这就是"人声被盖住"的真正原因——**很多时候不是音量问题,是感知线索给错了**。 把人声推大 3 dB 解决不了,因为合成器在"高"和"快"两条上都赢了。 人声还有一条自己的线索:歌剧歌手靠 2.5–4 kHz 的"歌唱者共振峰"在整个乐队之上被听见 (Howard & Angus p0209;男高音实测 2.4–3.5 kHz,p0221)。流行人声没有这么强的共振峰,但道理一样—— **这一带是人声出头的窗口**,合成器、失真吉他、镲的谐波峰堆在这里,人声就退到后面。 自检:副歌里 2.5–4 kHz 是谁在占。失效条件:主角不是人声时不适用。 **自检动作**:对每个段落,列出当下最高的、最响的、最快的、变化最剧烈的分别是谁。 **如果这四个答案里主角占不到两个,主角就不是主角。** ### 3.3 解法 不是把主角调大,而是**把竞争者在四条线索上压下去**: | 竞争者赢在哪 | 怎么压 | |---|---| | 高 | 移低八度,或让它只在主角的句间空档出现 | | 响 | (这条交给混音) | | 快 | 减音符密度、拉长时值 | | 变化率 | 让它变成重复的 pattern——**一致性会把它推向背景** | --- ### 3.4 ★ 让层与层分开的六个手段(杨立青) §3.1 讲的是听众凭什么把一层听成主角,这一节讲**你手上有哪几个旋钮能把两层拉开**(杨立青 p0244–0250): | 手段 | 做什么 | 要点 | |---|---|---| | **音色** | 换一族乐器 | 层次剥离里起主导作用的因素(p0244) | | **音区** | 拉开音程距离,或把主线放到它最有特性的音区 | 距离越大覆盖越少;**主线在自己最富特性的中高音区,即使和伴奏搅在同一音区也能浮出来**(p0246) | | **演奏法** | 换奏法 | 不同时间过渡特性的音色只能产生异质音响,这对剥离层次是有利条件(p0247) | | **密度/浓度** | solo、soli、tutti 的件数对比 | ★ 两层用完全相同的乐器,只靠件数差也能分开(p0248) | | **幅度** | 单音组对多音组(同度对八度、多层八度) | 辅助作用(p0250) | | **力度** | 标高一级或低一级 | ★ **永远只是辅助手段**。音区、音色、密度、幅度本已失调,力度救不回来(p0250) | **用法**:两层打架,按表从上往下试,**力度放最后**。混音层能动的只有最后一行,前五行全在编曲层, 这就是"能在写法上解决的让路不要留到混音"的依据(reference §7.4)。 ## 4. 频谱预算 ### 4.1 每件乐器都要说得出占哪个频段 这是 ARR-SPEC 里 `roster[].band` 和 `spectrum_budget` 两个字段的用处。 **说不出频段的乐器,你也不知道它在和谁打架。** ### 4.2 冲突的三种解法 两件乐器占同一块频段时,**只有三条路**,必须选一条并写明: | 解法 | 做什么 | 什么时候用 | |---|---|---| | **① 让频** | 一方在另一方发声时退让(改写:减音符、缩短延音、换和弦排列) | 两者都必须在场,但重要性有别 | | **② 错开音区** | 把其中一方整体移到别的音区 | 两者都重要、都要全程在场 | | **③ 交替出现** | 两者不同时发声,按段落或按句轮流 | 两者性格相近,同时出现只会互相抵消 | **第 ③ 条常被忽略,但往往是最好的解**——它同时解决了频段冲突和 `mc-orchestration` §3.4 的中和问题。 三条解法各有一条 Howard & Angus 划出的边界: - **错开音区**:掩蔽向上延展,低频掩蔽高频远强于反向(p0239)——把次要声部移到主角**下方**比移到上方更危险; 临界带宽随频率增大(p0083–0084),低音区同样的音程更容易浑浊——四声部写作要求低音与次中音之间 不小于四度,除非它们已在低音谱表之上(p0146)。 - **让频**:同一临界频带内,掩蔽阈只比掩蔽声低约 20 dB(p0240)——次要声部在主角的频段里轻不到 20 dB 就是"写了但听不见",不如删掉或改音区。 - **交替出现**:响声停止后 100–200 ms 内轻的起音仍被掩蔽(p0241)——句尾空档短于 200 ms 的"交替"不算交替。 > 一个实测样本的写法(City Pop): > `1–3 kHz` 段:干净吉他与合成器主音冲突 → **解法:交替出现**, > 吉他只在主歌/抬升段,合成器只在前奏/副歌/尾奏的句尾空档。 ### 4.3 "变薄":整体移除之外的中间手段 不必非要删掉一整件乐器,可以只削薄它 (p0287): 1. **减少某件乐器演奏的音符数量** 2. **缩短持续音的衰减时间**,让它迅速让位给混音中的其他部分 **这两条是作曲层的解法,不是混音层的**:改的是谱面上写了多少音、音符占用多长的时值,不是靠 EQ 或压缩去抠掉某段泛音,所以归本 skill,不归 mix-intent。 削薄和整体移除怎么选:一件乐器如果承担着 §2 里的中景或前景角色,删掉整件会让那一层空掉,这时先试削薄;如果它只是在某个片段填充密度、抽掉也不影响谁在说话,直接整体移除更干净。 用 §6 最大密度法把段落堆到很密之后,回头做 §4.2/4.3 这两轮删减时容易删得不够:过度分层的段落需要**大量**擦除才能恢复音乐性,稍一心软就会留下一堆互相抢注意力的音符 (p0288)。判断"够不够"的办法不是数删了几件乐器,是删完之后再听一遍:还有哪个部分说不出自己占的频段和拍点,就还没删够。 ### 4.4 一条要先明确的前提 > **减法策略只在你现有的部分已经尽可能好的情况下才有效。** (p0286) 一堆平庸素材里删掉几个,剩下的还是平庸。**分层救不了不好的素材。** 什么时候该往这条路上想:段落听感是"小"、"弱"或"没力量",第一反应往往是加东西,但原理反过来:每多加一个部件,其他部件就要更费力地去抢听众的注意力,音乐空间是有边界的画布,加过头只会盖掉已经写好的东西 (p0286)。这时候该问的是能不能拿掉些什么,而不是还能塞进什么。 这不是极简主义的专利,也不是某个流派才用得上的技巧:变化率慢的音乐即使元素数量不少,听感也可能是极简的(见 §5 变化率纪律);反过来,高密度的商业 EDM 只要有意限制同时发声的部件数,照样能听着清晰开放 (p0287)。核心原则是只在必要时添加,但也仅仅是必要时,同时对没有对音乐做出贡献的东西不留情面地删 (p0287)。 ### 4.5 叠层不等于更响 两件同样响的乐器叠在一起只 +3 dB,十件才 +10 dB,而 +10 dB 才是响度加倍(Howard & Angus p0040、p0094–0095)。 想让段落"更大",靠把能量铺到更多临界频带——总声强不变,响度也会增大(p0096)—— 也就是往**空着的频段**加东西,而不是往已占的频段叠 unison。 失效条件:同一信号复制出来的相干叠加另算(同相可到 +6 dB,p0035、p0037)。 自检:新加的一层占了哪个之前空着的频段?答不出来就是白加。 ★ **频率轴之外还有时间轴**(竹内 p0028–0031):音压的印象取决于**有没有寂静的空隙**。 每隔三秒戳破一个气球音压不高,不间断地戳就高,最大音量完全一样(p0029)。 底鼓打四分音符时拍与拍之间是空的,所以只靠底鼓推不高音压,得用贝斯把空隙填上; 但低频再怎么填,按等响曲线也带不来大音压的感觉,**真正推高音压的是把 1–5 kHz 用持续音包住**(p0029–0030)。 那正是吉他、人声、钢琴落的频段,所以自弹自唱反而比连续底鼓更容易做大(p0030)。 **编曲含义**:副歌要"大",先看两件事,一是有没有持续音把拍与拍之间的空隙填掉,二是 1–5 kHz 有没有一层持续的东西(pad、破音吉他墙、和声人声)。 两件都没做,加低频只会闷。 --- ### 4.6 ★ 踏板音:什么时候加长音层,什么时候不该加 乐队踏板音就是延续发音的长音或长和弦,流行编曲里的 pad、持续弦乐都是它(杨立青 p0309)。四个功能(p0309): 1. **中介**:沟通不同音色,让各层融成一个整体 2. **稳定**:在流动的音型化织体里给出清晰的和声轮廓 3. **丰满**:发音更圆润厚实 4. **对比**:与没有踏板音的段落形成疏密浓淡对比 ★ **什么时候不该加**(p0313):织体里的旋律、低音或内声部**本身已经含有长时值音符**时,它们已经在起踏板作用,再加一层持续音是画蛇添足。 追求生硬干涩音响的风格也少加,踏板音出现的频度本身就是风格标记。 **怎么选音**(p0313):和声换得频繁的段落,选各和弦之间的**共同音**做踏板,让它成为贯穿因素;找不到共同音就筛几个音高不同的长音,尽量让它们连成一条好听的线。 踏板层不一定是长音,震音或结构单纯的音型也可以。 **粘合**(p0311):密集音型之上加一层长音和弦,让它的音区、排列、密度在每拍第一个音上与音型层吻合,两层就被黏在一起。 反过来,**固定音型与打击乐节奏型也是粘合剂**(杨立青中册 p0514–0515):一个轮廓鲜明、反复出现的节奏型能把错综复杂的结构整合起来, 既做纵向整合,也做段落之间的横向连接。 ## 5. 变化率纪律 > **中景和背景元素的变化率应保持在最低限度,而前景元素允许更多的运动自由度。** (p0114) 这条极其实用,而且是"越到后面越乱"的解药: - 背景在变 → 听众的注意力被不断拉扯,主角站不住 - 背景不变 → 主角的每一次变化都被听见 **自检动作**:把每个元素的"每几小节变一次"写出来。 **如果背景元素的变化频率和前景一样高,那就没有背景,只有一堆前景。** **失效条件**:某些风格(IDM、breakcore)的美学就是全员高变化率—— 但那种情况下"前景"是靠别的线索建立的(通常是音色的极端性),而不是靠变化率。 --- ## 6. 最大密度法:怎么做一个很密但不乱的段落 **问题**:写完第一部分后,加第二部分像从零开始;线性从左往右推进让人望而生畏 (p0265)。 **做法**(注意它是**作曲阶段**的方法,和 `mc-arrangement-arch` §3 的减法编曲是**编曲阶段**的, 两者相似但作用点不同)(p0266): 1. 从歌曲中间任意一个**最大密度**的点开始——所有可能同时发生的元素**实际上都在同时发生** (p0265) 2. 这一步会堆出**不和谐的混乱(unmusical mess)**,这是预期内的 3. **逐个减去元素**,直到达到既高密度又符合音乐逻辑的水平 → 这就是歌曲的**高潮点** (p0265) 4. **复制**这个峰值段落,通过静音/删除来测试更低密度的版本 5. 找到喜欢的组合就复制粘贴成新段落 6. 于是编曲变成"组织这些不同密度的段落,以符合歌曲的起伏(ebb and flow)" (p0266) **这个方法的价值**:它让**所有段落天然同源**——低密度段是高密度段的子集, 所以不会出现"各段像不同的歌"。 **代价**:容易过度分层。DeSantis 自己提醒,用了最大密度或减法编曲之后, **可能意外产生过度分层(over-layering)**,需要大量擦除才能恢复音乐性, 且要格外小心判断**是否移除得足够多** (p0288)。 --- ## 7. 与 ARR-SPEC 的字段对应 | 字段 | 本 skill 的哪一节 | |---|---| | `arrangement.spectrum_budget` | §4(每条含 band / owner / competitors / **resolution**) | | `arrangement.roster[].band` | §4.1 | | `arrangement.depth_map` | §2 深度三层 | | `arrangement.roster[].band` 的四段划分 | §4.1(见 reference §1) | **不归本 skill 填**:`roster[].entry/exit`(→ `mc-arrangement-arch`)、 `roster[].instrument`(→ `mc-orchestration`)、`mix_intent.ducking_map`(→ `mc-mix-intent`)。 --- ## 8. 写完后必过 - [ ] 每个元素都标了**前景/中景/背景** - [ ] 每个元素都说得出**占哪个频段** - [ ] 每段的"最高、最响、最快、变化最剧烈"分别是谁,列得出来;**主角至少占两条** - [ ] 每处频段冲突都写明了解法是**让频/错开音区/交替出现**中的哪一种 - [ ] 主角是人声时,副歌的 2.5–4 kHz 归人声;低音区两声部间距不小于四度(§3.2、§4.2) - [ ] 背景元素的变化率**明显低于**前景 - [ ] 用了最大密度法的话,检查过**是否移除得够多**(§6 的代价) - [ ] 凡是能在作曲层解决的冲突,**没有推给混音** --- ## 附:来源 - **Dennis DeSantis《Making Music》**(Ableton)——§2、§3、§4.3、§4.4、§5、§6 的主干 (Foreground/Middle Ground/Background、Maximal Density、The Power of Erasing)。页码为该书页。 - 频段预算的听觉基础见 **Izhaki《混音指南》**的掩蔽章节,整理在 [reference.md](reference.md)。 - **Howard & Angus《音乐声学与心理声学》**(Acoustics and Psychoacoustics)—— §3 的响度/谐波/歌唱者共振峰、§4.2 的掩蔽不对称与时间掩蔽、§4.5 的响度叠加;临界频带的尺子在 reference §1.1。页码为中译本页。 - 混音侧的对应手法见 **Izhaki《混音指南》**——**只取频段预算与意图的部分**, EQ/压缩实操出库到声音设计与混音库。