本篇目录 / Contents
- 2026-06-25-4K无字幕母文件97分46秒第1081咱是不是复核
- 片源与资产
- T0 台词链
- 声音指标
- #1081 exact 100ms 曲线
- 画面帧链
- 1081 exact 三帧仍然扣在阿蒙闭眼近脸上,子丑位于侧后方或画面边缘,没有成为视觉中心。
- 1081 start 时子丑在左后侧虚焦/暗部中露出;#1081 preoverlap 与 overlap 中,子丑更清楚地贴在阿蒙背后或侧后方,但画面中心仍是阿蒙闭眼面部。
- 1081 后 200ms 与 #1082 重叠时,画面没有切给子丑,也没有给到舞台全景;空间仍被浅色膜面/布面压住。
- 1082 after 仍是阿蒙近脸,亮度继续下降到 mean_luma=56.690369,dark_lt40=0.187997。这说明 #1081 的问句没有马上打开空间。
- 1081 不能写成“画面已经给到子丑正式发问”。更准确的是:子丑的声音先从阿蒙近脸的边缘进入,视觉权力晚于声音进入。
- T2 旁证
- 句法与声画结论
- 1081 的字面只有 咱是不是,但它在结构上非常重。它做了四件事。
- 支持与降级
- 1081 必须作为独立半句读,不得直接并入 #1083 完整 咱是不是有点偏台。
- 1081 的核心功能是把 #1080 的 我 改写为现场共同体 咱,并启动 是不是 的判定格式。
- 1081 前 400ms RMS=-25.370dBFS,支持低位开口;后 200ms 与 #1082 重叠 RMS=-18.860dBFS,支持“问句未完即被阿蒙撤回句抢入”。
- 1081 exact 画面仍是阿蒙闭眼近脸,子丑位于侧后方/边缘,不支持写成子丑已经成为画面中心。
- 1082 到 #1083 有 0.666s 全静默式等待,支持 #1081 半句、#1082 撤回、#1083 偏台完整化之间有阶梯,而不是一个无缝现场调度句。
- 回填
- 文中引用的图像资料
2026-06-25-4K无字幕母文件97分46秒第1081咱是不是复核
片源与资产
片源:〔本地资料路径省略〕 无字幕 28g 4k.mov
资产目录:
inspool-wiki-zh/raw/assets/4k-nosub-restart-20260625/1081-zan-shi-bu-shi-nooffset/
音频:
audio/1081_exact_zan_shi_bu_shi_mono.wav
audio/1081_preoverlap_first_400ms_mono.wav
audio/1081_1082_overlap_200ms_mono.wav
audio/1081_to1082_question_dare_mono.wav
audio/1081_to1083_question_bias_mono.wav
audio/gap_1082_to1083_mono.wav
画面:
frames/01_1081_start_5866.000.jpg
frames/02_1081_preoverlap_5866.300.jpg
frames/03_1081_1082_overlap_5866.500.jpg
frames/04_1082_after_5866.900.jpg
frames/05_pre1083_gap_5867.800.jpg
frames/06_1083_bias_5868.600.jpg
frames/01_contact_1081_to1083_chain.jpg
指标:
metrics/audio_summary_metrics.tsv
metrics/1081_exact_100ms_rms.tsv
metrics/frame_color_metrics_by_timestamp.tsv
T0 台词链
#1080 01:37:43.266-01:37:45.166 阿蒙:我想从车上跳下去
#1081 01:37:46.000-01:37:46.600 子丑:咱是不是
#1082 01:37:46.400-01:37:47.400 阿蒙:可是我又不敢
#1083 01:37:48.066-01:37:49.233 子丑:咱是不是有点偏台
#1084 01:37:49.700-01:37:50.400 阿蒙:没有
本页只完成 #1081。#1083 的 咱是不是有点偏台 只能作为后接兑现进入本页,不能倒灌成 #1081 的完整内容。
声音指标
| segment | duration | RMS | peak | centroid | rolloff95 | silence ratio | body 80-300 | voice 300-1200 | high 4000-9000 | air 9000-16000 |
|---|---|---|---|---|---|---|---|---|---|---|
#1081 exact 咱是不是 |
0.600s | -22.027dBFS | -7.095dBFS | 3246.760Hz | 14708.333Hz | 0.000 | 0.431037 | 0.455504 | 0.006636 | 0.002186 |
| #1081 前 400ms 未与 #1082 重叠 | 0.400s | -25.370dBFS | -9.379dBFS | 3978.912Hz | 17395.000Hz | 0.000 | 0.559008 | 0.298723 | 0.007962 | 0.003532 |
| #1081/#1082 重叠 200ms | 0.200s | -18.860dBFS | -7.095dBFS | 4049.423Hz | 14705.000Hz | 0.000 | 0.349850 | 0.536160 | 0.017364 | 0.005982 |
| #1081-#1082 问句到不敢小链 | 1.400s | -24.089dBFS | -7.095dBFS | 6398.357Hz | 21682.857Hz | 0.071 | 0.289540 | 0.601509 | 0.008692 | 0.013184 |
| #1081-#1083 问句到偏台小链 | 3.233s | -25.598dBFS | -7.095dBFS | 6796.638Hz | 21928.549Hz | 0.250 | 0.311449 | 0.590912 | 0.006117 | 0.014806 |
| #1082 到 #1083 等待 | 0.666s | -48.827dBFS | -33.199dBFS | 9350.923Hz | 21564.565Hz | 1.000 | 0.362435 | 0.289331 | 0.062504 | 0.130296 |
#1081 exact 100ms 曲线
0.000-0.100 -28.092dBFS
0.100-0.200 -29.408dBFS
0.200-0.300 -28.107dBFS
0.300-0.400 -21.324dBFS
0.400-0.500 -21.547dBFS
0.500-0.600 -17.213dBFS
这条曲线不能被粗暴读成“子丑越来越大声”。#1081 的后 200ms 与 #1082 阿蒙 可是我又不敢 重叠,最后 0.2 秒的升高很可能包含两人声音叠加。更稳的读法是:#1081 前 400ms 是低位开口,后 200ms 迅速被阿蒙的撤回句压入重叠。也就是说,咱是不是 还没有把问题说完,就已经被 可是我又不敢 抢入。
这正是 #1081 的形式重点:它不是一个完成的回应,而是一个正在成形的问句框架。
画面帧链
联系图:

帧指标:
1081_start=5866.000 mean_luma=59.510048 dark_lt40=0.177591
1081_preoverlap=5866.300 mean_luma=58.441315 dark_lt40=0.177726
1081_1082_overlap=5866.500 mean_luma=58.127434 dark_lt40=0.181338
1082_after=5866.900 mean_luma=56.690369 dark_lt40=0.187997
pre1083_gap=5867.800 mean_luma=57.757610 dark_lt40=0.152032
1083_bias=5868.600 mean_luma=60.937191 dark_lt40=0.090587
可见事实:
-
1081 exact 三帧仍然扣在阿蒙闭眼近脸上,子丑位于侧后方或画面边缘,没有成为视觉中心。
-
1081 start 时子丑在左后侧虚焦/暗部中露出;#1081 preoverlap 与 overlap 中,子丑更清楚地贴在阿蒙背后或侧后方,但画面中心仍是阿蒙闭眼面部。
-
1081 后 200ms 与 #1082 重叠时,画面没有切给子丑,也没有给到舞台全景;空间仍被浅色膜面/布面压住。
-
1082 after 仍是阿蒙近脸,亮度继续下降到 mean_luma=
56.690369,dark_lt40=0.187997。这说明 #1081 的问句没有马上打开空间。 - 到 #1083 附近,画面才真正转向子丑的脸和手部。#1083_bias 帧中,子丑手指靠近嘴唇,目光转向画面右侧;此时才是
咱是不是有点偏台的视觉兑现。 -
1081 不能写成“画面已经给到子丑正式发问”。更准确的是:子丑的声音先从阿蒙近脸的边缘进入,视觉权力晚于声音进入。
T2 旁证
MiMo Wave5 形式安全微窗把 01:37:45 记录为维持女性面部特写、字幕 Are we,01:37:46 记录为维持特写并出现 But I don't dare to / Are we,01:37:47 才切至或平移至右侧男性。这个 T2 结论与本地 T1 帧链相符:#1081 的问句先于子丑成为画面中心。
MiMo Wave3 的时间粒度更粗,把 01:37:46-01:37:50 归纳为主体 B 插入 Are we... Are we a bit off-center on the stage?,可作结构旁证,但它把 #1081 与 #1083 合并得较强;本页采用 T0/T1,把 #1081 半句与 #1083 完整句拆开。
句法与声画结论
1081 的字面只有 咱是不是,但它在结构上非常重。它做了四件事。
第一,咱 把 #1080 的 我 改写成一个现场共同体。#1080 是阿蒙说 我想从车上跳下去,主语是一个被推到出口上的 我。#1081 不接 你怎么了,也不接 别这样,而是开口说 咱。这个 咱 一出来,问题的主语就从单个人的危险冲动,转成“我们这个现场是不是有什么问题”。它不是安慰,而是把个人痛感收编进共同位置。
第二,是不是 建立的是可检查、可回答、可纠正的判断格式。它不像 你还好吗 那样把焦点留在阿蒙的状态,也不像 为什么 那样追问跳车想象的原因。是不是 是现场判断句的开头,等待一个条件被填入。它把刚才不可承接的痛感,改造成可以被判定的事项。
第三,#1081 还没有说出判断对象。它只是 咱是不是,还没有 有点偏台。因此它处在一个非常冷的悬置点:现场已经开始把问题改写为“我们是不是……”,但还没暴露这个“是不是”到底要判定什么。观众在这 0.6 秒里听见的是回应的外壳,不是回应的内容。
第四,声音和画面都证明这个问句是边缘进入。声音上,#1081 前 400ms RMS=-25.370dBFS,是低位开口;后 200ms 因为 #1082 抢入升到 RMS=-18.860dBFS,不能当成子丑独自加强。画面上,#1081 仍是阿蒙闭眼近脸,子丑没有被画面正式交给观众。也就是说,子丑的声音先进入,子丑的画面位置还没有到位。
所以 #1081 的潜台词不是完整的“我们是不是偏台了”。那是 #1083 才说出的内容。#1081 的潜台词更早、更阴冷:
你刚才说的危险出口,我不先作为危险来接。
我先把它放进一个“我们是不是哪里不对”的现场判断框架。
这句话最残酷的地方,在于它用 咱 给出一种看似共同承担的语法,却没有真正承担 #1080 的痛感。咱 表面上比 你 温柔,因为它把说话人也包括进去;但在这里,它的效果是把阿蒙的 我 从危险中心移开。我想从车上跳下去 刚把主体推到出口边缘,咱是不是 就把主体改成一个可调度的现场复数。
支持与降级
支持:
-
1081 必须作为独立半句读,不得直接并入 #1083 完整
咱是不是有点偏台。 -
1081 的核心功能是把 #1080 的
我改写为现场共同体咱,并启动是不是的判定格式。 -
1081 前 400ms RMS=
-25.370dBFS,支持低位开口;后 200ms 与 #1082 重叠 RMS=-18.860dBFS,支持“问句未完即被阿蒙撤回句抢入”。 -
1081 exact 画面仍是阿蒙闭眼近脸,子丑位于侧后方/边缘,不支持写成子丑已经成为画面中心。
-
1082 到 #1083 有
0.666s全静默式等待,支持 #1081 半句、#1082 撤回、#1083 偏台完整化之间有阶梯,而不是一个无缝现场调度句。
降级:
- 不支持把 #1081 写成完整的“偏台”判断;完整判断属于 #1083。
- 不支持把 #1081 写成安慰、劝阻、心理解释、医疗判断或对 #1080 的正面接住。
- 不支持把 #1081 后 200ms 的响度升高归给子丑单人声,因为 T0 显示此处与 #1082 重叠。
- 不支持把 #1081 写成画面已经切到子丑或空间已经打开;#1083 附近才发生视觉中心转移。
- 不支持把 #1081/#1082 的片内危险语言升级成现实医学诊断或片外风险评估。
回填
- 逐句正文:人类投降派逐句对白声画解读-第1080-1129句-2026-06-24
- 上一 T1 复核:2026-06-25-4K无字幕母文件97分43秒第1080我想从车上跳下去复核
- 总账:4K无字幕全片重扫总账-从本地取证到连贯线索-2026-06-19(馆内参考,未随本文公开)
文中引用的图像资料
以下图像由本篇已有文件引用对应;保留历史引用范围,图像展示不增加新的事实判断。






