Working with it
这一页讲的是人实际要做什么。五步里只有两步需要人做判断,其余是无人值守的等待;而人做判断的那两步,界面上的每一个设计都只服务一件事——让判断变快。
Who does what
这不是效率宣传,是这套系统的组织方式:机器负责把四十多分钟压缩成五条候选,人负责判断这五条里哪些值得发。机器不做审美判断,人不做重复劳动。
每一集的流程(窄屏可横向滚动)
从服务器已有素材里选一集,填剧名集数,勾输出侧重。
约 30 秒七个阶段依次执行,界面报告每一步用了什么工具、产出了什么。
无人值守逐条看分数依据、听台词、微调入出点,决定留用还是弃用。
这一步是重点觉得选得不对,改权重立刻重算。可选,也可以反复做。
每次 0.3 秒留用的切片各出横竖两版加封面,操作日志同步落盘。
每条约 1 分钟还有一件事只做一次,不在每集的流程里。第一次用之前,请剪辑师在工作台上标出一集的 Top-5 名场面——这是唯一能衡量「机器找得准不准」的尺子。
它是一次性投入:标完之后,每一次调权重都能立刻算出命中率是升是降。没有它,第 ④ 步就只能凭感觉,改完不知道是变好还是变差。
Walkthrough

STEP 01 · 人
为什么是选而不是传。一集正片 2–3GB,经浏览器上传没有意义,而且介质本就不该离开这台机器。把素材拷进服务器的素材目录,选择器会自动列出。
输出侧重会改变权重。选「明星高光」,主演在场那一路的权重会显著提高;选「剧情看点」,对白情绪与场景转折的权重上来。同一集用不同侧重跑,选出来的片段不一样。

STEP 02 · 机器
提交之后这一页会一直更新到跑完,不需要盯着。每个阶段报告用了什么工具、产出了什么——不是一条转圈的进度条,而是可以核对的中间结果。
任一环节失败会自动降级并继续,不中断整条链路。比如画面理解的接口不可用,视觉动作那一路会退回只用帧间差分与镜头切换频率,剩下的照跑。
降级发生时结果里会标明,不会假装那一路正常工作过。

STEP 03 · 人 · 核心页面
分数是摊开的,不是一个数字。92 分由四路信号加权而来,每一路的贡献都单列出来。看得懂为什么是 92 分,才谈得上信任它——黑盒分数没人会用。
入出点按镜头边界步进,不按秒。点一下箭头,跳到上一个或下一个镜头切换点。切在镜头中间的片段,观感上一眼就是机器剪的。

SETUP · 人 · 只做一次
这一页不在每集的流程里,但它决定了第 ④ 步有没有意义。剪辑师标出的 Top-5 是唯一能衡量「机器找得准不准」的尺子。
每段可以填一句话说明为什么它是名场面。这些说明将来是让机器学会自己判断的语料。

STEP 05 · 机器
留用的切片各出 16:9 与 9:16 两版,加一张封面、一份带文案的清单。竖版裁切跟随主演人脸的位置,不是死切中间。
操作日志同步落盘。这一集里每一次留用、弃用、微调都记了下来——包括弃用的原因。
The tuning loop
这是整个工作台最值得用熟的一个动作。判断标准写在配置文件里,不写在代码里——所以调整它不需要工程师,也不需要等。
四路信号各占多少,写在配置文件里。也可以直接往情绪词表里加词。
上游的转码、镜头分割、台词、人脸全部读缓存,不重跑。
0.3秒与剪辑师标注的 Top-5 比对,立刻知道这次改动是升是降。
为什么不是重跑一遍。整条链路跑一集要十几分钟,其中绝大部分是识别——而调权重根本不改变识别结果,只改变怎么给它们加权。
所以每个阶段的产物都落盘,重算时直接读缓存。十几分钟和 0.3 秒的差别,决定了这个动作是「值得试一下」还是「算了」——而调权重这件事,只有能反复做才有价值。
Two conventions
它们看起来是流程上的小要求,但都直接决定这套系统能不能变得更好。
界面上弃用必须填一句原因,不能跳过。这不是走流程——人工复核的留用与弃用,是这套系统将来学会自己判断的唯一训练标签来源。
「节奏太拖」「主演没露脸」「这段前面已经有类似的」——每一条都是一次标注。没有原因字段,攒再多操作记录也归纳不出规则。
它是一次性的,收益却贯穿之后每一次调权重。没有它,你能看到分数,但不知道分数对不对;调完权重,也不知道是变好还是变差。
换句话说:没有尺子,第 ④ 步就退化成凭感觉。