# 4K 无字幕 #1028 本地复核

本文为研究档案公开版，保留来源版本的论述与限制。公开时间：2026-09-08；不表示已完成同行评审。 本文属于公开研究资料（历史笔记、研究稿或来源记录）：已完成格式、来源限制与重复项筛查，尚未完成逐篇独立事实复核；原文中的解释、候选判断和未确认内容均按其原有限制阅读。

来源版本日期：2026-06-23

证据边界：T0 台词账锁定 #1028 ACT-AMENG/阿蒙 `你不要那么害怕`，时间 01:35:01.233-01:35:02.500；本页只复核 #1028 如何承接 #1027 `你不要那么紧张`，把身体反应禁令从紧张推进到害怕，并如何进入 #1029-#1030 的 `胆小鬼 / 一直这样` 人格化质问。不得把 #1028 写成真实恐惧表情、心理诊断、普通安慰、治疗事实、口型身份裁决、音乐进入、设备提示、无线电声像、报告 UI 或硬切换场。

# 4K 无字幕 #1028 本地复核

## 来源信息

- 母文件：`〔本地资料路径省略〕 无字幕 28g 4k.mov`
- 复核素材目录：`inspool-wiki-zh/raw/assets/4k-nosub-restart-20260623/1028-fear-body-ban-nooffset`
- T0 台词账：[角色逐时轴全台词幽灵机制账-2026-06-03.tsv（台词字段公开版）](/research/dialogue)
- T0 锁定：#1028，ACT-AMENG / 阿蒙，`你不要那么害怕`，`01:35:01.233-01:35:02.500`
- 前后句：#1027 阿蒙 `你不要那么紧张`；#1029 阿蒙 `不要一直做一个胆小鬼`
- MiMo T2：见 [MiMo-4K无字幕第1028不要害怕到1030一直这样标准API声画音频复核-2026-06-23](/research/hs-407282d26ef23de9)。可保留无音乐、画外/不可确认声源、膜面/低机位/旁观结构、声音主动施压与画面沉默的冲突；声线性别、身份、真实心理和过度象征化均降级。

## 核心摘要

#1028 是 #1027 之后的第二条身体反应禁令。#1027 说 `你不要那么紧张`，#1028 说 `你不要那么害怕`。这不是把人安抚下来，而是把不合格状态从 `紧张` 继续推到 `害怕`。

声音上，#1028 RMS=`-15.9486dBFS`，比 #1027 高 `1.2369dB`，比 #1026 高 `5.7573dB`，只比 #1030 低/高几乎同级，`1028_minus_1030=0.0632dB`。它是负向身体禁令链中最前景的单句之一。

画面上，#1028 没有给出清楚的恐惧表情、眼神反应或心理特写。联系图仍是低机位白衣前景身体、露肩白衣、黑衣旁观者、半透明膜面和逐渐被照亮的空间。稳定写法不是“人物真的害怕”，而是：`害怕` 这个词被声音推出，画面把它放进身体/膜面/旁观结构里，不给它心理事实签收。

## 声音指标

关键句声压位置：

```text
#1022 你应该更开心一点       RMS=-12.4001dBFS
#1026 你应该更自在一点       RMS=-21.7059dBFS
#1027 你不要那么紧张         RMS=-17.1855dBFS
#1028 你不要那么害怕         RMS=-15.9486dBFS
#1029 不要一直做一个胆小鬼   RMS=-16.8951dBFS
#1030 难道你要一直这样下去吗 RMS=-16.0118dBFS
```

#1028 比 #1027 高 `1.2369dB`，比 #1026 高 `5.7573dB`，比 #1022 强入口低 `3.5485dB`。这说明它不是回到 #1022 那种强前景入口，但已经比 #1027 更靠前。#1028 的位置更像身体禁令链的第二次抬高：先禁止 `紧张`，再禁止 `害怕`。

句内能量比较均衡，但四分位显示两个高点：

```text
1028_first_half RMS=-16.0083dBFS
1028_tail_half  RMS=-15.8896dBFS
1028_q1         RMS=-14.7733dBFS
1028_q2         RMS=-17.7407dBFS
1028_q3         RMS=-15.0198dBFS
1028_q4         RMS=-16.9745dBFS
```

前后半句几乎等强，`first_half_minus_tail_half=-0.1187dB`。#1027 是前半句明显强、尾部撤落；#1028 则不是简单短促压入，而是把整句压力维持到后半句。最强 50ms 和 100ms 窗集中在句内开头后约 `0.19-0.29s`：

```text
50ms top  0.22-0.27s RMS=-9.7407dBFS
100ms top 0.19-0.29s RMS=-10.4120dBFS
250ms top 0.18-0.43s RMS=-12.5923dBFS
```

50ms 微窗前列几乎全是人声频带：

```text
0.20-0.25s RMS=-10.2454 voice=0.971191 high=0.016289 air=0.000054
0.95-1.00s RMS=-11.4873 voice=0.995934 high=0.000277 air=0.000072
0.65-0.70s RMS=-11.8279 voice=0.991045 high=0.000961 air=0.000060
```

这说明 #1028 的强度不是由局部 high/air 尖刺撑起来，而是由清楚、稳定的人声主体推进。

## 声音-音乐边界

#1028 比 #1027 更适合写成人声禁令，而不是音乐化场面：

```text
1028_exact voice_250_4000_ratio=0.968482
1028_exact high_4000_12000_ratio=0.009575
1028_exact air_12000_20000_ratio=0.000114
1028_exact centroid=955.3908Hz
1028_exact stereo_corr=1.000000
1028_exact side_mid_ratio=0.000000
```

这一组指标很干净：人声频带占比极高，高频和 air 很低，左右声道完全一致，没有声道空间打开。#1027 的局部 high/air 瞬态在 #1028 这里没有继续扩大。#1028 的压力来自语句和声压，而不是配乐、设备提示、无线电声像或可见声源设备。

长链也支持这个边界：

```text
1027_to1028_tension_fear_pair voice=0.867173 high=0.033150 air=0.006981
1028_to1029_fear_to_coward_edge voice=0.946846 high=0.013348 air=0.002657
1028_to1030_fear_moral_chain voice=0.861879 high=0.069027 air=0.005978
1024_to1030_state_to_accusation_chain voice=0.868832 high=0.047909 air=0.020036
```

所有精确句、间隙和长链在 `silencedetect -45dB:d=0.3` 下均无 silence event。稳定写法是：低能材料/房间/录音声床持续存在，人声从这个声床里前景化；但“不静”不等于“有配乐”。

## 画面指标

联系图显示，#1028 从 #1027 尾部的低位身体场开始，画面逐渐向右/向上带出白衣男性前景、黑衣坐姿旁观者、后方白衣人物、半透明膜面和膜面上的线画。#1028 的开头仍偏暗，到尾部和 #1028-#1029 间隙逐渐变亮：

```text
1027_tail        luma=57.7271 dark=0.2300 warm=0.9671
1028_start       luma=57.4716 dark=0.2117 warm=0.8752
1028_q1          luma=64.3134 dark=0.1724 warm=0.8961
1028_mid         luma=70.1291 dark=0.1423 warm=0.8802
1028_q3          luma=77.3463 dark=0.1032 warm=0.8175
1028_tail        luma=83.6679 dark=0.0685 warm=0.8169
1028_to1029_gap  luma=88.5306 dark=0.0191 warm=0.8803
1029_start       luma=80.2066 dark=0.0097 warm=0.9780
```

这个亮度上升不能写成恐惧被治愈或放松完成。更稳妥的说法是：当声音把 `害怕` 推到更强前景时，画面反而从低位身体局部慢慢揭开空间结构。它让恐惧进入一个可见的场，但不是表情事实；观众看见的是膜面、坐姿、遮挡、旁观和临时空间，而不是“害怕的脸”。

场景检测：

```text
1027_to1028_tension_fear_pair_720p scene>0.04 hits=1
1028_to1029_fear_to_coward_edge_720p scene>0.04 hits=0
1028_to1030_fear_moral_chain_720p scene>0.04 hits=0
1026_to1028_free_tension_fear_chain_720p scene>0.04 hits=0
1024_to1030_state_to_accusation_chain_720p scene>0.04 hits=0
```

唯一命中出现在 #1027->#1028 对句片段开头附近，不能作为 #1028 后硬切证据。#1028 到 #1030 没有当前阈值硬切命中；只能写成无 `scene>0.04` 硬切证据，不能写成绝对不变镜头。

## 可抽取概念

- [纠正式关怀](/research/hs-010ed61eae225608)：#1028 把 #1027 的 `紧张` 继续推到 `害怕`，说明纠正式关怀不只要求更好状态，还会升级命名不合格反应。
- [程序化关怀](/research/hs-edbebfb6b1d838c0)：状态校正流程从 `开心 / 快乐 / 自在` 进入 `紧张 / 害怕` 的负向身体字段。
- [身体管理术](/research/hs-7f31a7c4535cad08)：`害怕` 不被当作内在经验来倾听，而被命名为应该停止的身体反应。
- 声音-音乐场（馆内参考，未随本文公开）：#1028 的声音比 #1027 更强，但频谱更清楚地回到人声，不能写成音乐或设备声。

## 稳定读法

```text
#1026 你应该更自在一点
-> #1027 你不要那么紧张
-> #1028 你不要那么害怕
-> #1029 不要一直做一个胆小鬼
-> #1030 难道你要一直这样下去吗
```

#1028 的关键不是证明人物真实害怕，而是把 `害怕` 变成第二个可被禁止的身体反应。它比 #1027 更响，也更稳定地保持整句压力；画面却没有给恐惧表情签收，只把这句话放在低机位身体、膜面、旁观者和逐渐揭开的临时空间里。

## 待确认问题

- #1029 需要单句复核：`不要一直做一个胆小鬼` 如何把 `害怕` 转成人格标签。
- #1030 需要单句复核：`一直这样下去吗` 如何把人格标签再推成时间/存在质问。
- #1028 到 #1029 的 `1.200s` 间隙 RMS=`-29.5727dBFS`，但无 silence event；后续应确认它是材料/房间/录音声床，还是包含动作边缘声。