# MiMo-4K无字幕第991啥到992回地球Public声画音频复核-2026-06-22

本文为研究档案公开版，保留来源版本的论述与限制。公开时间：2026-09-08；不表示已完成同行评审。 本文属于公开研究资料（历史笔记、研究稿或来源记录）：已完成格式、来源限制与重复项筛查，尚未完成逐篇独立事实复核；原文中的解释、候选判断和未确认内容均按其原有限制阅读。

来源版本日期：2026-06-22

证据边界：MiMo 只作 T2 候选。可保留其对 #991 `啥` 短促打断、声源距离/质地差异、无可辨认音乐、白衣前景压入公共观看空间和 #992 更强重复方向的辅助观察；必须降级可见人物身份、口型同步、白衣人物即声源、播放录音、外来者/科幻身份、观众心理、声音性别和具体材料声源裁决。

# MiMo-4K无字幕第991啥到992回地球Public声画音频复核-2026-06-22

## 运行对象

本轮使用新配置后的 public API 对 #990-#992 连续小段做两路复核：

```text
视频：01:33:22.033-01:33:30.700，fps=8，media_resolution=max
音频：01:33:22.033-01:33:30.700，analysis mode
```

原始报告与红acted 响应位于：

```text
inspool-wiki-zh/raw/assets/4k-nosub-restart-20260622/991-sha-nooffset/mimo-api-991-20260622
```

手工合计 usage：

```text
video total_tokens=36316
audio total_tokens=2688
manual_total=39004
```

`mimo_wave_ledger.py` 仅自动记入视频报告，音频报告在本来源页手工列入；这不改变证据等级。

## 可保留的 T2 观察

### 声音方向

- #991 `啥` 是短促、高位置、不同于 #990/#992 的打断声；它更像即时反问或接收失败，不像背景噪声。
- #990 与 #992 都是 `我可能要回地球了`，但 #992 更强、更清晰、更像对 #991 失败接收后的再次推出。
- 全段没有可辨认旋律、节拍、和声、固定音高中心或乐器进入；可写持续空间/环境/设备/材料底噪候选。
- #990、#991、#992 之间存在低能间隔，不应写成绝对静音。

### 画面方向

- #990-#992 连续段中，观众席、半透明塑料/薄膜、反光台面、室内结构和白衣前景人物共同构成公共观看空间。
- #991 附近，白衣人物/身体前景压入画面，遮挡或压缩观众席；这个视觉变化支持“接收失败落在公共空间里”，而不是私人脸部反应特写。
- 画面未给出地球、飞船、出口、出门或现实离场物证。
- 画面没有给出可靠口型同步，不能把可见人物直接裁决为 #991 或 #992 声源。

## 必须降级的部分

以下 MiMo 内容不能升为事实：

- 白衣人物就是说话人，或就是 #990/#992 的声源。
- #991 的声音性别、具体声源位置、声像归属和距离判断。
- “播放录音”“机械重复”“外来者身份”“科幻模拟舱”等解释性推断。
- 观众席心理状态、惊讶反应、表情细节和参与意图。
- 黄色胶带、薄膜呼吸、手指抽动等细节只能作候选，除非本地帧再复核。

## 与 T1 合并后的用法

本轮 MiMo 对 #991 最有价值的是补强三点：

```text
#991 是短促接收失败，而不是底噪；
#991 落在白衣前景/观众席/膜面的公共空间中，而不是脸部反应特写；
#992 是在 #991 后更强重复，而不是 #990 已结案后的普通复述。
```

最终判断仍以本地 T1 为主：#991 全句 RMS=`-26.7684dBFS`，比前间隔高约 `5.2275dB`，但比 #990 低约 `5.0162dB`、比 #992 低约 `12.0302dB`。这支持把 #991 写成“短促阻断/接收失败”，不支持写成新解释中心、理解完成或事实裁决。