# 全片 P4 专题五：声音/音乐边界线

本文为研究档案公开版，保留来源版本的论述与限制。公开时间：2026-09-08；不表示已完成同行评审。

来源版本日期：2026-06-25

证据边界：本页是 P4 第五个专题加厚页，综合 P3 全片慢扫、P4 八束再扫描和既有声音/音乐概念页，负责追踪 `低能非静音 -> 声体事件 -> 强声团未裁决 -> 参数声场 -> 安眠曲污染 -> 厚声床公开等待 -> 无 T0 有声 -> 白布强声 -> 片尾近静封盘` 的声音/音乐边界线。所有可听事实、声学指标、声源、静音、音乐、配乐和声道空间判断必须回到 T1/P3；本页不把低声写成静音，不把无 T0 台词写成无事件，不把高频/低频/厚声场直接写成配乐，不用 MiMo 候选覆盖本地 4K/T1。

# 全片 P4 专题五：声音/音乐边界线

## 一句话结论

《人类投降派》的声音不是配乐有没有的问题，而是一套持续组织事件的现场机器：

```text
低能不是静音，
无台词不是无事，
厚声场不是自动配乐，
近静只在最后封盘段才真正成立。
```

全片更稳的声音公式是：

```text
低能门槛
-> 评价刺点
-> 爱情声体
-> 强声团未裁决
-> 参数声场
-> 安眠曲命名但不成完整音乐事件
-> 睡吧/去死同声场污染
-> 公开等待厚声床
-> 梦像由声音生成、画面扣留
-> 纠正式关怀高声化
-> 空白/虚无在现场声中被观看
-> 游戏和表演法庭增压
-> 无 T0 有声身体付账
-> 白布帮说强声化
-> 不可见确认高压
-> 片尾名单继续发声
-> 标志后近静封盘
```

这条线的价值，是把声音分析从“我听起来像音乐/像沉默”改成可复核的四分法：

```text
技术静音
低能非静音
音乐性组织
音乐/配乐确证
```

四者不能互相代替。

## 和既有概念页的关系

声音-音乐场（馆内参考，未随本文公开） 已经提供大前提：本片声音由现场录音、房间底噪、机械/设备声、台词、呼吸、笑声、沉默间隔和全片声音/音乐设计共同构成。它要求我们不要只问“有没有音乐”，而要问声音如何组织现场。

[低能量缝隙](/research/hs-b71424b9f0c71345) 提醒：声音落下去时，现场不一定停止；低能段常常在换挡、暴露、蓄压。

[安眠曲](/research/hs-2010361822a1d1f2) 已经把第三部分尾段的边界收紧：`我给你唱一首安眠曲吧` 是安眠曲机制的命名入口，但不能自动写成一首歌完成、照顾完成或音乐事件完成。

[后台声场](/research/hs-b58bddc5bb6405d2) 和 [档案静默](/research/hs-a82f5f8cf8b3ca74) 分别处理后段两种状态：后台继续发声，档案最终降噪停手。P4 专题五要做的，是把这两种状态和前面的低能、厚声场、无 T0 有声、白布强声接成全片听觉链。

## 声音/音乐判据

| 判据 | 可以写 | 不能直接写 |
|---|---|---|
| 技术静音 | silencedetect 或本地指标支持的短静音/长静音。 | 仅凭听感把低声、暗场、无句写成静音。 |
| 低能非静音 | RMS/mean 很低，但仍有底噪、房间声、材料声、人声尾音或短峰。 | 写成“什么都没有”。 |
| 无 T0 有声 | 没有新台词行，但画面、身体、观众、空间和声床仍在运行。 | 写成“空白”“跳过”“无事件”。 |
| 厚声场 | 声压、声床、瞬态、多语、房间纹理或现场噪音明显组织事件。 | 直接写成配乐、音乐高潮或声源事实。 |
| 音乐性组织 | 声音以节奏、重复、声压差、低频、清单、重叠和等待组织情绪/流程。 | 把音乐性等同于配乐。 |
| 音乐/配乐确证 | 有稳定旋律、节拍、和声、明确乐器/合成器、声源、声道空间或上下文证据。 | 只因“好像有氛围”就确认音乐。 |

本专题采用最保守的写法：

```text
没有音乐确证时，写“声场”“声音组织”“音乐性”，不写“配乐”。
没有技术静音证据时，写“低能”“近静”“无 T0 有声”，不写“沉默”。
```

## 证据总表

| 阶段 | 锚点 | 声音功能 | 边界 |
|---|---|---|---|
| 开场低能门 | `04:13-04:20` mean=`-45.2dB`，有短静音事件；`04:22-04:47` mean=`-42.6dB`，低能等待 `16.988s`。 | 片名和复演把关系句送进低能门槛。 | 不把开场写成黑场静音或配乐接管。 |
| 评价刺点 | #15 `演的太差了` mean=`-35.1dB`，max=`-11.8dB`。 | 平均不高，局部刺入改变规则。 | 声音权力不总靠长时间高声。 |
| 爱情声体 | `10:20-10:50` mean=`-34.7dB`；`10:50-11:14` mean=`-22.1dB`；局部 `-17.8dB`。 | 爱情作为声体被推出，再被表演词汇回收。 | 不写成爱情完成或音乐托举。 |
| 问烟低声 | `15:48-16:20` mean=`-40.6dB`，低能 `16.177s`，max=`-3.0dB`。 | 低声打开摄影机背面和后台地址。 | 低声不等于无事，也不锁定声源。 |
| 夜景强声团 | `18:00-18:28` mean=`-16.9dB`，max=`-0.2dB`。 | 城市夜景先以强声团接管声场，再接石头/硬地。 | 不直接确认配乐、乐器或传统音乐高潮。 |
| 参数声场 | `60:00-65:00` 眼镜、光、呼吸、拥抱、笑声和身体参数。 | 没有确认传统旋律配乐，声音仍用问句/笑声/声压差组织观看。 | 不把拥抱写成抒情音乐段。 |
| 梦公共播放 | `65:00-70:00` 多语/歌词性声场、公共厅堂、风扇、恐惧清单。 | 梦不是私人内心，而被声场公共化。 | 多语/歌词性不自动等于可裁决配乐事实。 |
| 安眠曲入口 | `75:00-80:00` full mean=`-21.6dB`；#905 mean=`-22.8dB`；`睡吧` mean=`-19.1dB`。 | 安眠曲被命名，睡吧把它压成状态指令。 | 不是完整歌曲确证，不是照顾完成。 |
| 安眠曲污染 | `80:00-85:00` full mean=`-19.4dB`；`80:12-80:16` 睡吧/去死重叠 mean=`-20.5dB`。 | 安抚、母亲、喜欢、死亡和游戏进入同一听觉皮肤。 | 不写成先安抚后反转；它们同场污染。 |
| 公开等待 | `81:26-83:34` mean=`-17.0dB`。 | 数字 `3` 后，公开等待成为厚声床。 | 不是静默，也不是救援。 |
| 梦像声场 | `87:10-87:19` 森林/风/飞 mean=`-19.0dB`；`89:03-89:43` 等待 mean=`-37.4dB`。 | 声音生成森林、风、飞、眼睛等对象，画面扣留对象。 | 不把声音对象写成画面事实。 |
| 纠正式关怀 | `94:48-94:51` 更开心一点 mean=`-12.6dB`。 | 关怀被高声化，变成情绪目标。 | 不写成轻声治愈。 |
| 真假法庭 | `96:24-96:47` 拍电影/假的链 mean=`-16.0dB`；`96:58-97:07` 反假组 mean=`-21.3dB`。 | 假的裁决声压强于反假请求。 | 不把反假写成声压胜诉。 |
| 虚无/发呆 | `100:00-105:00` full mean=`-23.4dB`；本地无长静音。 | 虚无和发呆在现场声中被观看化。 | 不能写成沉默结案。 |
| 说出口/坏帮助 | `110:00-115:00` full mean=`-24.7dB`；`115:00-120:00` full mean=`-21.8dB`；坏帮助段 mean=`-30.1dB`。 | 低声也能执行要求，游戏接手后现场回升。 | 低声程序不是弱化要求。 |
| 表演法庭 | `120:00-125:00` full mean=`-21.9dB`；声音放出 mean=`-16.2dB`；`130:00-135:05` full mean=`-12.0dB`。 | 声音被可见化，公开法庭增压。 | 高压不等于所有流程都高声；跳过可低声完成。 |
| 身体过桥 | `140:00-145:06` full mean=`-22.8dB`；`142:21` 有声无 T0 句。 | 被跳过的段落由身体和材料声继续付账。 | 无 T0 不等于无事件。 |
| 白布帮说 | `145:00-150:07` full mean=`-13.4dB`；help_speak mean=`-11.6dB`；say_proxy mean=`-8.9dB`；release_fun mean=`-5.7dB`。 | 白布不是安静消失，而是强声发声壳。 | 不把不可见写成声场撤退。 |
| 不可见确认 | `150:05-155:00` full mean=`-11.5dB`；不可见确认 mean=`-2.9dB`；T0 空窗 mean=`-8.7dB`。 | 不可见被高压确认，无台词处仍有身体/观众/空间。 | 不写成隐退成功。 |
| 片尾封盘 | `155:00-156:32.49` full mean=`-19.5dB`；标志/黑场 mean=`-43.6dB`；最终尾段 mean=`-91.0dB`。 | 名单、场地、鸣谢、观众、标志继续工作后，近静才成立。 | 不把 `155:00` 后全部写成黑场静音。 |

## 第一段：开场不是静音，而是低能门槛

开场最容易误读成“黑场加沉默”。P3 第一窗已经修正：`0` 下不是纯黑，仍有人脸、身体、衣物和暗部空间；声音也不是全无，而是在很低的能量里给出第一组关系句。

真正接近静音的，是片名附近 `04:13-04:20`：mean=`-45.2dB`，有 `4` 个 `-45dB/0.25s` 短静音事件，总长约 `3.916s`。但这只是短门槛，不是整段开场的性质。

随后 `04:22-04:47` 的 `1` 复演视觉更亮，声音却只有 mean=`-42.6dB`，并带有 `16.988s` 的低能等待。这是全片第一个声音原则：

```text
看得更清楚，不等于声音更拥有情感；
视觉明亮可以和声场降能同时发生。
```

所以，开场的声音不是“缺席”。它把关系句压进低能门，再交给 #15 `演的太差了` 这个局部刺点。#15 平均 mean=`-35.1dB`，但 max=`-11.8dB`，说明评价权不是靠长时间高声，而是靠短促刺入改变规则。

## 第二段：爱情不是配乐托举，而是声体事件

`10:00-15:00` 里，爱情第一次以很强的声音形态出现。但这仍不能写成爱情完成或配乐托举。

`10:20-10:50` 的爱情前地面 mean=`-34.7dB`，没有技术静音。它是低位现场在运转：地面、纸张、垫面和办法空白先摆好，爱情才被推出。

`10:50-11:14` 的 `爱情` 段 mean=`-22.1dB`，局部 `11:10-11:14` mean=`-17.8dB`，是前段明显的声体峰值之一。可它马上被这些词接走：

```text
真不知道该怎么演
没什么信心
崩溃的欣喜
绝望的坚定
摄影机开着
等一下看素材
```

也就是说，爱情确实变响了，但没有因此变真、变稳、变可拥有。它只是被推出成声体，再被表演和素材压力回收。

## 第三段：夜景强声团不是配乐确证

`15:00-20:00` 进一步训练声音边界。

问烟段 `15:48-16:20` 很低，mean=`-40.6dB`，还有 `16.177s` 低能口袋；但全窗没有 `-45dB/0.25s` 技术静音。它是低声地址扩张，不是停机。正是在这个低声里，摄影机背面、暗部、烟体、手和后台生产空间被打开。

随后 `18:00-18:28` 夜景强声团 mean=`-16.9dB`，max=`-0.2dB`。这团声音很强，但发生在夜景念白完全展开之前。因此稳写法不是“配乐高潮来了”，而是：

```text
夜景先以强声团接管声场，
随后石头、枯城和坚硬的地被放进这个已增厚的声场。
```

它具有音乐性组织，但音乐确证仍要保守。没有声源、乐器、节拍、和声、声道空间或画面证据时，只写强声团和声场抬升。

## 第四段：声音制造对象，画面扣留对象

`20:00-60:00` 反复出现一种声画关系：

```text
声音提出对象，
画面不完整兑现对象，
对象变成缺席压力。
```

月亮、所有颜色、鱼缸、船难、火、漂亮、纯感觉、聊天记录、动态影像层、被子、水、鱼缸、眼镜，都不是简单由画面展示出来。很多时候，它们先作为声音对象出现，画面只给床面、水面、白光、身体、低处材料或剧场接口。

这条规则对音乐分析很关键。声音可以很强，可以很有节奏，可以很像在“铺气氛”，但它的首要功能常常不是抒情，而是制造一个画面没有交出的对象。

所以，中段更适合写：

```text
声音生成缺席对象，
画面用低处材料、身体或白光扣留对象。
```

而不是写：

```text
配乐把梦境托出来。
```

## 第五段：参数声场不是恋爱配乐

`60:00-75:00` 是参数声场的集中区。

眼镜、散光、模糊、光、呼吸、拥抱、手位、笑声、下巴、脖子、热、梦、温度、恐惧，都被拆成可问、可调、可重复的参数。这里即使没有确认传统旋律性配乐，声音仍然在用声压差、笑声、重复问句、清单节奏和低频声床组织事件。

最重要的听法是：

```text
没有传统旋律配乐
不等于没有音乐性；
有音乐性
不等于可以确认配乐。
```

在这一段，音乐性常常来自流程本身：问句的重复、笑声的爆点、恐惧清单的列项、无台词等待后的重新入声。它把亲密关系改成一套持续调参的听觉程序。

## 第六段：安眠曲被命名，但不是完整歌曲事件

`75:00-85:00` 是全片声音/音乐边界最危险的地方，因为台词直接说出 `安眠曲`。

但是 P3/P1 已经把口径收紧：

```text
我给你唱一首安眠曲吧
```

是安眠曲机制的命名入口，不是完整歌曲确证。#905 mean=`-22.8dB`，低于 #904 `我爱你`，也低于后面两声 `睡吧`；频谱能说明低频、宽频能量和密集瞬态，但不能确认稳定旋律、节拍、和声、明确乐器、合成器序列或一首歌被完整唱完。

后面更残酷：`80:12-80:16`，`睡吧 / 妈妈喜欢你 / 去死` 同场重叠，mean=`-20.5dB`。这不是先温柔、再反转，而是同一个听觉皮肤里同时包住照顾、母亲、喜欢、死亡和执行。

因此安眠曲线应该写成：

```text
执行语
-> 审美化
-> 爱语化
-> 安眠曲命名
-> 睡吧状态指令
-> 去死/妈妈喜欢你同声场污染
-> 游戏偏好代签
```

它不是音乐救援，而是柔性执行。

## 第七段：公开等待不是静默，梦像不是画面事实

`80:00-90:00` 进一步说明声音怎样公开化。

`81:26-83:34` 公开等待 mean=`-17.0dB`，这是厚声床，不是静默。数字 `3` 的入口本身较低，但它改变空间规则；随后的公开等待才把游戏抛到公共场。

`85:00-90:00` 多人梦像接力里，森林、风、飞、硬币、花、卡车、海、鲸鱼、床单、眼睛、蝴蝶不断从声音里冒出来。但 4K 画面仍扣在公开机器里。`87:10-87:19` 森林/风/飞 mean=`-19.0dB`，梦像声场很强，可对象没有被插图兑现。

这里的稳写法是：

```text
声音让对象被听见，
画面拒绝让对象被拥有。
```

声音不是画面的说明书，而是画面不兑现时留下的压力系统。

## 第八段：关怀和真假法庭不是声压胜负

`90:00-100:00` 声音进入纠正式关怀和真假法庭。

`94:48-94:51` `你应该更开心一点` mean=`-12.6dB`。这不是轻声安慰，而是高声情绪目标。关怀在这里被改成了要求：你要更开心、更快乐、更自在、不要紧张。

`96:24-96:47` 拍电影/假的链 mean=`-16.0dB`，而 `96:58-97:07` 反假组 mean=`-21.3dB`。这很关键：`这不是假的` 可以成立为请求和抵抗，但不能写成声压胜诉。声音分析必须把两种东西分开：

```text
结构上有反驳，
不等于声压上压倒。
```

反假不是靠更大声赢，而是靠位置、锐度、身体回返和反复顶回来。

## 第九段：虚无、发呆和说不出口都不是沉默

`100:00-120:00` 反复出现空白词：

```text
虚无
什么也不想
发呆
不知道怎么办
说不出口
麦掉了
```

但声音并没有把这些词放进静音里。`100:00-105:00` full mean=`-23.4dB`，本地没有长静音；后部 `104:00-105:00` 升到 mean=`-19.7dB`。`110:00-115:00` full mean=`-24.7dB`，也不是内心安静；痛苦外判、空洞怎么办和说出口任务仍在现场声中推进。

`119:00-120:00` 坏帮助段 mean=`-30.1dB`，较低，但这不是要求变弱。它证明本片的声音权力并不总用高声运行：有些程序性话术正是在低声里更难摆脱。

## 第十段：公开法庭的声音把观看者拖进规则

`120:00-140:00` 声音明显增压。Ricky 表演法庭不是低声旁支，`120:00-125:00` full mean=`-21.9dB`，声音放出段 mean=`-16.2dB`。`130:00-135:05` full mean=`-12.0dB`，说明朋友裁决后并未降压，反而进入导演位增殖和高压流程。

但同一束里也有低声流程点：`136:37-137:05` 下一幕确认 mean=`-32.6dB`，`139:36-139:45` 跳过确认 mean=`-29.6dB`。

这给全片声音理论补上一条：

```text
强声负责公开裁决，
低声负责流程换挡。
```

两者同样有权力。

## 第十一段：白布不是安静消失，而是强声发声壳

`140:00-150:00` 最能纠正“无台词=空白”的误读。

`140:00-145:06` full mean=`-22.8dB`，全窗无长静音。`142:21` 没有 T0 台词行，但这是有声无句的身体过桥。被跳过的段落没有消失，它由身体、材料声、观众空间和低处平台继续付账。

到了 `145:00-150:07`，声音直接高压化：full mean=`-13.4dB`，help_speak mean=`-11.6dB`，say_proxy mean=`-8.9dB`，release_fun mean=`-5.7dB`。

白布不是“遮住以后安静了”。白布恰恰把脸和身体边界改造成一个强声接口：

```text
脸不可读
-> 身体成壳
-> 一个“说”打开代说
-> 不可见愿望被强声保存
```

这也是 [白布发声壳](/research/hs-69198c75a7986398) 和本专题最紧的连接点。

## 第十二段：结尾的近静很晚才成立

结尾不能写成“演出结束后就黑场静音”。

`150:05-155:00` full mean=`-11.5dB`，不可见确认 mean=`-2.9dB`。`谁也看不见你` 后的 `对 / 是` 是强声确认，不是低声隐退。

更反直觉的是 `151:10-151:55`：T0 空窗，但 mean=`-8.7dB`。这意味着无台词处仍有身体、观众、空间和归档声场。声音已经不需要一句一句台词，也能把现场继续保存。

`155:00-156:32.49` full mean=`-19.5dB`。制作团队、拍摄场地、特别鸣谢、观众感谢和 `p4 theater` 标志继续工作。真正近静集中在标志/黑场之后：`156:00-156:32.49` mean=`-43.6dB`，最终尾段 `156:12-156:32.49` mean=`-91.0dB`。

所以片尾声音链是：

```text
不可见强声确认
-> T0 空窗但高能持续
-> 低能口袋
-> 片尾名单/场地/鸣谢/观众继续发声
-> p4 theater 标志
-> 标志后近静
```

近静不是关系解决，而是归档机器工作到最后才开始停手。

## 可复用声音分析法

以后分析全片任何片段，都可以按这七步走：

1. 先看 T0：有没有新台词行，谁说，是否有重叠、抢入、空窗。
2. 再看 T1 声学：mean/RMS、peak、silencedetect、低能时长、短峰、频谱、声道。
3. 分清类型：技术静音、低能非静音、无 T0 有声、厚声场、音乐性组织、音乐确证。
4. 看声画关系：声音提出什么对象，画面兑现、扣留、延迟、替换还是归档。
5. 看流程功能：声音是在评价、安抚、追问、命令、换挡、代说、公开化还是封盘。
6. 看边界：不能从声音直接推出心理事实、同意事实、真实伤害、画内声源或配乐事实。
7. 写结论时优先用保守词：声场、声床、声体、低能、近静、音乐性、未确认配乐。

最短写作口径：

```text
《人类投降派》的声音不是“有无配乐”的二选一。
它是一套让事件继续发生的场。
音乐有时在其中，现场声有时在其中，低能和近静也在其中；
但每一次都必须先问证据，而不是先听成气氛。
```

## 对全片总论的增量

专题五把 P4 总论中的“声音不是配乐陪衬”改得更细：

```text
声音不是画面的附庸；
也不是所有无法命名的声场都叫音乐。
它在全片里主要承担五种工作：

1. 改变规则：评价刺点、跳过确认、结束宣告。
2. 制造对象：月亮、鱼缸、火、森林、风、飞、眼睛、蝴蝶。
3. 组织流程：找/照、安眠曲、游戏、说出口、帮说。
4. 保存不可见：白布、无 T0 空窗、片尾残余声轨。
5. 最后停手：标志后近静封盘。
```

因此，声音专题不是附属专题，而是全片机制的听觉骨架。