一场三小时的直播,后台显示 20:47 在线人数从 380 掉到 190,之后再也没回来。主播把回放从头看了一遍,说没看出问题。问题就在这里——回放里没有数据叠加,你看的是内容,不是观众的反应曲线。要把「哪句话把人赶走」这件事说清楚,得让录制画面、在线人数、逐句话术落在同一条时间轴上。
先凑齐三份材料,缺一份就别开始
回放:自己录一份,用带时间戳的文件名
平台回放通常在直播结束后延迟生成,且不同平台对回放时长和清晰度的限制不一样,做复盘时经常取不到完整场次。更稳的做法是推流端本地录制。
OBS Studio 在「设置 → 输出 → 录像」里可以改文件名格式,把开播时间写进文件名:
%CCYY-%MM-%DD_%hh-%mm-%ss
这样得到的文件名形如 2026-09-10_20-00-12.mp4,后面和你记录的「开播按钮点击时刻」能直接对上。文件名不带时间,事后要一个个翻文件属性确认,三五场之后就乱了。
在线人数:只要分钟级,手工读点也够
抖音在电商罗盘的直播复盘里有分钟级在线人数趋势,视频号在视频号助手的直播数据里能看到,快手、淘宝直播也各有对应入口,具体字段以你自己后台当期提供的为准。
大部分平台不直接给 CSV 导出。不用纠结,截图后手工读点就行:只记录曲线出现明显拐点的那几个分钟,比如 20:47、21:03、21:38,够用了。逐分钟抄完三小时的数据,投入产出比不划算。
如果连分钟级曲线都拿不到,退一步用评论密度代替。评论突然变稀,通常比在线人数下滑早半分钟到一分钟出现,因为这个信号来自还在看的人,而不是已经退出的人。
转录稿:本地跑,把时间码留下来
需要的是「谁在第几分第几秒说了什么」,所以转录必须带时间码,纯文本没用。
本地跑 faster-whisper 是成本可控的选择,中文字幕质量在 large-v3 这一档已经够用。先把音轨抽出来:
ffmpeg -i 2026-09-10_20-00-12.mp4 -vn -ar 16000 -ac 1 audio.wav
16kHz 单声道是语音模型的标准输入,不转换会拖慢识别速度。然后用 whisper-ctranslate2 输出带时间码的 SRT:
whisper-ctranslate2 audio.wav --model large-v3 --language zh --output_format srt --vad_filter True
--vad_filter True 建议打开。三小时直播里有大量纯音乐、静音、环境噪音,不开 VAD 的话模型会在这些片段自行编造内容,转录稿里会凭空多出没有说过的话。模型档位按你的显卡显存调整,显存不够就降到 medium。
不想本地跑,通义听悟、飞书妙记这类在线转写也能出带时间码的文稿,超出免费额度后按量计费,具体档位看官网当期页面。
时间基准对齐:这一步错了,后面全部白做
三份材料有三个时间来源:录屏文件的创建时间、平台后台的在线人数时间、转录稿的相对时间。它们之间通常差 10 到 40 秒,来自推流握手和录制启动的延迟。
对齐方法很简单:直播时在开口第一句话里报一次时间,比如「现在是晚上八点零二分,我们正式开始」。转录稿里这句话自带时间码,拿它和真实时钟一比,就知道偏移量。之后所有数据平移这个差值。
不做这一步,你定位到的 20:47 掉人点,实际可能对应的是 20:46 那段话,改错方向比不改还亏。
把转录稿切成话术单元
SRT 是逐句的,一句话一行,颗粒度太细。按语义把转录稿合并成 30 秒到 2 分钟一段的「话术单元」,每段标注起止时间和这一段在做什么:讲痛点、讲价格、逼单、过款、闲聊。
这一步用大模型批量处理效率更高:把 SRT 全文丢给模型,要求它按语义切段并给每段打一个动作标签,输出成表格。三小时的稿子大概能切出 80 到 120 段。切完之后,把掉人的时间点往这个表格里一放,就知道当时在做什么。
掉人点和话术的四种对应关系
不是每次掉人都怪话术。频率最高的四种情况,处理方式完全不同:
| 曲线形态 | 当时的动作 | 通常原因 | 下次怎么改 |
|---|---|---|---|
| 30 秒内掉两成以上,之后走平 | 突然切品,或长时间念参数 | 观众判断这段和自己无关 | 切品前先给一句「接下来这个品只讲两分钟,适合 XX 的人留下」 |
| 缓慢下滑,但评论在增加 | 讲痛点、抛问题 | 正常流失,不是问题 | 不要打断节奏去救人数 |
| 阶梯式断崖,时间点和开奖完全重合 | 福袋、抽奖开奖结束 | 抽奖人群离场 | 开奖前预留一个留人的理由,比如马上要上的限量款 |
| 掉人同时评论骤减 | 语速变慢、重复上一段内容 | 节奏问题 | 把这段压到 15 秒以内,或者直接删掉 |
下一场开播前,只改三件事
一次复盘改十几处,等于没改,主播记不住,执行时全乱。挑掉人最狠的两到三个时间点动手:
- 把这三个时间点写在提词板对应位置,标注「此处不要说 X」,而不是写「要说得更好」
- 把掉人最严重的那段话术原文摘出来,重写成 15 秒版本,开播前念三遍
- 在建品脚本里给每个品设一个「最晚讲完时间」,到点就切,不管有没有讲完
- 下一场录屏文件名带上开播时间戳,省掉事后查文件属性的时间
学习视频
短视频平台和长视频平台上都有可用的公开课,这里只给检索入口,不指定具体 UP 主,因为个人账号的内容更新和迁移比较频繁,给出名字反而容易失效:
- 抖音电商学习中心(抖音官方免费学习平台)搜索「直播复盘」「话术节奏」,有官方录制的复盘方法课。
- B 站搜索「faster-whisper 字幕」,优先看 2025 年之后发布的实操演示;搜索「OBS 录制设置」可以找到录像分轨与命名的演示视频。
- 腾讯视频、优酷上搜索「直播运营 复盘」,有部分机构公开课,观看时注意核对发布时间,2023 年之前的录制里提到的后台入口可能已经改版。
今晚就能做的一件事
从最近一场直播里挑出掉人最狠的那一分钟,只做一件事:把那一分钟对应的话术原句找出来,抄在纸上,看看这句话是不是需要铺垫 40 秒才能听到重点。如果是,把它压到 15 秒,明天开播时用一次,对比同一时间点的在线人数变化。一次只验证一个变量,别的都别动。