本篇目录 / Contents
- 2026-06-21|4K无字幕母文件开场85分05秒到85分18秒第929对那个更大的东西甲瑞强入声复核
- 复核资产
- 声学事实
- 929 前 6.866s 继承 #928 后等待尾段:全频 RMS 只有 -38.4492dBFS,但 4-12kHz 与 12-20kHz 合计很高,谱心约 7237.7Hz。这不是静音,而是非常薄、很亮、低频撤出的入声前边缘。
- 929 一进入,全频 RMS 抬到 -15.6765dBFS,Peak 触到 0.0000dBFS。用同一份 85:05.000-85:18.066 context 音频做样本级切片复核,clipped samples 只落在 #929 窗内:#929 精确窗 clipped samples=54,前段、#929 到 #930 间隙与 #930 参考均为 0。因此 #929 不是从薄声场里平滑浮出,而是以一个过载/削顶的人声块强行进入。
- 929 之后到 #930 前的 1.934s 间隙又迅速降回 RMS=-39.3464dBFS,Peak=-22.9731dBFS,4-12kHz 占比 0.3566,12-20kHz 占比 0.5095,谱心升到约 11207.9Hz。这说明 #929 不是连续平稳地进入 #930;它先把对象抛出,再留下一个极薄、极高频的间隙,下一句 #930 才进入。
- 滑窗摘要
- 画面事实
- T1 边界
- 929 甲瑞 对那个更大的东西 发生在 #928 后 45.233s,不是 #928 的即时解释。
- 929 前 85:05.000-85:11.866 不是静音,而是高频/超高频很高的薄尾。
- 929 全句 RMS=-15.6765dBFS、Peak=0.0000dBFS,context 样本级复核显示 clipped samples 只落在 #929 精确窗内。
- 929 低中频非常强,250-1000Hz 占比 0.7507,和 #928 的窄 1-4kHz 非词笑形不同。
- 929 后到 #930 前有 1.934s 极薄高频/超高频间隙;#930 你是怎么感觉的 才在之后进入。
- 929 解释了 #928 哈哈,或反向确认 #928 的声源、快乐、嘲笑、人物语言回归、关系缓和或场面结案。
- 929 本身已经构成完整问题;完整询问动作要到 #930 你是怎么感觉的 才补上。
- 929 可被写成感受报告、梦/现实层级、真实心理、真实关系、consent、真实伤害、安全确认或现实大物事实。
- 文中引用的图像资料
2026-06-21|4K无字幕母文件开场85分05秒到85分18秒第929对那个更大的东西甲瑞强入声复核
T0 已锁:#929 时间为 01:25:11.866-01:25:14.966,说话人为甲瑞,文本是:
对那个更大的东西
上一条 #928 OFFSCREEN_APPARATUS / 画外装置声 哈哈 结束于 01:24:26.633。#929 到 01:25:11.866 才进入,因此 #928 后到 #929 前有 45.233s 长无新 T0 等待。下一条 #930 甲瑞 你是怎么感觉的 在 01:25:16.900-01:25:18.066 才进入;#929 后到 #930 前有 1.934s 间隙。
本页只做 T1 事实复核。机制判断见 4K无字幕重启细读-85分05秒到85分18秒-对那个更大的东西把人物语言带回巨大空指而非解释结案-2026-06-21。
复核资产
本轮资产位于:
inspool-wiki-zh/raw/assets/4k-nosub-restart-20260621/929-greater-thing-entry/
重点文件:
clips/8505-8518-929-to-930-av.mp4audio/8505-000-8511-866-pre929-approach.wavaudio/8511-866-8514-966-929.wavaudio/8514-966-8516-900-929-to-930-gap.wavaudio/8516-900-8518-066-930-reference.wavaudio/8505-000-8518-066-context.wavaudio/waveform-8505-8511-pre929.pngaudio/waveform-8511-8514-929.pngaudio/spectrogram-8511-8514-929.pngmetrics/summary-8505-8518-929.jsonmetrics/rms-band-segments-8505-8518-929.tsvmetrics/sliding-windows-8505-8518-929.tsvmetrics/sample-boundary-check-8505-8518-929.tsvstills/contact-8505-8518-1fps.jpgstills/8511-866-929-start-fullres.jpgstills/8513-300-929-mid-fullres.jpgstills/8514-966-929-end-fullres.jpgstills/8516-900-930-start-reference-fullres.jpgstills/crops/8511-866-right-head-crop.jpgstills/crops/8513-300-right-head-crop.jpgstills/crops/8514-966-right-head-crop.jpgstills/crops/8516-900-right-head-crop.jpg
声学事实
| 窗口 | 时间 | 时长 | 全频 RMS | Peak | 20-250Hz 占比 | 250-1000Hz 占比 | 1-4kHz 占比 | 4-12kHz 占比 | 12-20kHz 占比 | 250-4000Hz 绝对 RMS | 谱心 |
|---|---|---|---|---|---|---|---|---|---|---|---|
| #929 入声前薄尾 | 85:05.000-85:11.866 |
6.866s |
-38.4492dBFS |
-17.0652dBFS |
0.0208 |
0.1663 |
0.1524 |
0.3795 |
0.2810 |
-43.4147dBFS |
7237.7Hz |
| #929 全句 | 85:11.866-85:14.966 |
3.100s |
-15.6765dBFS |
0.0000dBFS |
0.2070 |
0.7507 |
0.0332 |
0.0039 |
0.0052 |
-16.7340dBFS |
549.4Hz |
| #929 到 #930 间隙 | 85:14.966-85:16.900 |
1.934s |
-39.3464dBFS |
-22.9731dBFS |
0.0320 |
0.0194 |
0.0825 |
0.3566 |
0.5095 |
-49.2641dBFS |
11207.9Hz |
| #930 入声参考 | 85:16.900-85:18.066 |
1.166s |
-22.1353dBFS |
-8.1648dBFS |
0.8035 |
0.1713 |
0.0084 |
0.0072 |
0.0097 |
-29.5903dBFS |
448.7Hz |
929 前 6.866s 继承 #928 后等待尾段:全频 RMS 只有 -38.4492dBFS,但 4-12kHz 与 12-20kHz 合计很高,谱心约 7237.7Hz。这不是静音,而是非常薄、很亮、低频撤出的入声前边缘。
929 一进入,全频 RMS 抬到 -15.6765dBFS,Peak 触到 0.0000dBFS。用同一份 85:05.000-85:18.066 context 音频做样本级切片复核,clipped samples 只落在 #929 窗内:#929 精确窗 clipped samples=54,前段、#929 到 #930 间隙与 #930 参考均为 0。因此 #929 不是从薄声场里平滑浮出,而是以一个过载/削顶的人声块强行进入。
频带上,#929 全句的主体不是 1-4kHz 窄中频笑形,而是 250-1000Hz 占比 0.7507、20-250Hz 占比 0.2070 的低中频强声块。它与 #928 哈哈 的 1-4kHz 高集中结构完全不同。
句内不做逐词对齐,但能看出强弱分层:#929 第一秒 RMS=-14.3171dBFS,尾段 2.000-3.100s RMS=-13.7145dBFS,中间 1.000-2.000s 降到 -39.3592dBFS,且 4kHz 以上占比明显增高。这支持“两个强声块之间有薄洞”的声学事实,但不直接裁决每个词的精确落点。
929 之后到 #930 前的 1.934s 间隙又迅速降回 RMS=-39.3464dBFS,Peak=-22.9731dBFS,4-12kHz 占比 0.3566,12-20kHz 占比 0.5095,谱心升到约 11207.9Hz。这说明 #929 不是连续平稳地进入 #930;它先把对象抛出,再留下一个极薄、极高频的间隙,下一句 #930 才进入。
滑窗摘要
在 #929 精确窗内:
- 最高
0.50sRMS 窗约85:13.991-85:14.491,RMS=-10.4782dBFS,Peak=0.0000dBFS,250-1000Hz 占比0.8126。 - 最高
0.25sRMS 窗约85:14.091-85:14.341,RMS=-9.8092dBFS,Peak=0.0000dBFS,250-1000Hz 占比0.8531。 - 最高
0.10sRMS 窗约85:14.216-85:14.316,RMS=-7.9303dBFS,Peak=0.0000dBFS。 - 4-12kHz 占比最高的
0.10s窗约85:13.741-85:13.841,RMS=-37.8035dBFS,4-12kHz 占比0.4715,12-20kHz 占比0.4443,说明高频最亮处并不是声压最高处。
在 #929 到 #930 间隙内,最高 0.50s RMS 窗也只有 -37.8252dBFS,且高频/超高频占主导;到 #930 参考窗,RMS 抬到 -22.1353dBFS,但仍低于 #929 精确窗。
画面事实
85:05.000-85:18.066 的 1fps 接触表与关键帧显示,窗口保持同一个低机位公开空间:
- 左侧和中后方观众剪影仍在。
- 后方白色半透明屏障/布面持续横切空间。
- 中部背对身体候选仍在屏障前。
- 右侧近前景有白衣/白布/身体候选、侧脸/上身候选、红色前景物、水瓶/透明容器样物和白色布面。
- 反光地面继续复制身体、屏障、红色前景物和水瓶/透明物。
- 暖橙/黄光面在屏障右中区域持续存在。
对 8505-8518 720p 短 clip 做 scene>0.04 高阈值筛选,没有 filtered frame 输出;本页据此只记录本审阅 clip 内无高阈值 scene detect 命中。它不证明画面绝对静止,但支持:#929 与 #930 入声并未伴随明显反打、特写或硬切声源显影。
右侧局部裁图显示:#929 入声、句中、句尾与 #930 入声参考处都可见右侧近前景侧脸/上身候选,身体包裹白布或白衣,头部低垂或侧向,白色半透明屏障贴近面部区域。画面中存在侧脸和口部区域候选,但光线低、遮挡重、帧间变化不足,不能用本轮裁图完成口型/唇形同步裁决。T0 负责锁 #929 说话人为甲瑞;T1 本轮只确认画面没有给出足以独立证明口型的清晰特写或反打。
T1 边界
本页支持:
-
929 甲瑞
对那个更大的东西发生在 #928 后45.233s,不是 #928 的即时解释。 -
929 前
85:05.000-85:11.866不是静音,而是高频/超高频很高的薄尾。 -
929 全句 RMS=
-15.6765dBFS、Peak=0.0000dBFS,context 样本级复核显示 clipped samples 只落在 #929 精确窗内。 -
929 低中频非常强,250-1000Hz 占比
0.7507,和 #928 的窄 1-4kHz 非词笑形不同。 -
929 后到 #930 前有
1.934s极薄高频/超高频间隙;#930你是怎么感觉的才在之后进入。 - 画面保持低机位公开空间,无高阈值 scene detect 命中,无反打、特写或可独立裁决口型的清晰声源显影。
本页不支持:
更大的东西已在画面中作为具体物体出现。-
929 解释了 #928
哈哈,或反向确认 #928 的声源、快乐、嘲笑、人物语言回归、关系缓和或场面结案。 -
929 本身已经构成完整问题;完整询问动作要到 #930
你是怎么感觉的才补上。 -
929 可被写成感受报告、梦/现实层级、真实心理、真实关系、consent、真实伤害、安全确认或现实大物事实。
- 本轮画面足以完成口型裁决或证明右侧侧脸候选独立承担声源。
文中引用的图像资料
以下图像由本篇已有文件引用对应;保留历史引用范围,图像展示不增加新的事实判断。












