video-scaffold · 功能说明

让每段旁白有声音,也知道每个词在什么时候出现

每一场脚本先得到一段旁白,再得到真实时长和词级开始/结束时间。画面不需要靠人手写“第 2.4 秒出现”,而是可以跟着旁白真正说出的词触发;脚本或音频变了,也不会再把旧结果静默套进新视频。

当前情况:已有配音原生时间和本地按需对齐两条路线;本轮未发配音请求或运行对齐模型。

项目快照核对于 ;具体测试保留各自日期,页面不实时探测运行状态。

复制 AI 续作说明带着这个项目,交给 AI 接着做

写下接下来想做什么。这里会把你的目标、本页事实和来源整理在一起,复制给 Astra 或 Gemini 后,就不用重新介绍项目了。

整理续作说明

只在当前网页整理,不会发起 AI 任务。

用途与实际影响

这项功能怎样使用

为什么需要它

旁白是视频节奏的基准。只看文件是否存在,会让改过的脚本继续使用旧声音,或让新声音沿用旧时间轴,后面所有画面都可能错位。身份文件把内容和会改变结果的配置一起绑定,变更时先停下来。

举个实际例子

我可以说:“把三段已确认文案生成旁白和词级时间;第二段刚改过,只重做它,别把旧时间位置套回来。”系统只复用仍与当前输入一致的声音和时间轴。

最后我会得到什么

每场得到旁白音频、实际时长和逐词位置;画面能跟着读到的词出现。旧声音或词轴只有仍与当前文案对应时才继续使用。

正常时

旁白、时长和逐词位置属于同一份已确认脚本,场次一一对应。

发现问题时

脚本、声线或声音变了,就说明哪一层旧结果不能再用,保留原文件等待本人决定是否重做。

入口不可用或证据不足时

外部配音不可用就停在配音;若已有可靠的配音时间信息,本地对齐工具缺失不必让它失效。损坏的旧词轴会报错。

从哪里开始

在新视频工程把已确认旁白写为 script_NN.txt,再运行 run.ps1 tts 和 timing;已有音频先核对身份,不匹配时审阅后明确 force。

需要准备什么

  • 按场编号并审阅过的旁白
  • 旧音频不匹配时是否明确重做
  • 需要何种配音效果

从开始到拿到结果

  1. 1

    先检查旁白和旧音频

    工具核对每场脚本非空、编号一致,并确认旧音频是否属于当前文案;不匹配就请人决定是否重做。

  2. 2

    生成声音和时长

    工具按确认后的脚本生成语音、场间停顿及时间记录;可复用的旧音频保持原样。

  3. 3

    检查逐词位置

    优先用可用原生词轴,必要时共享对齐;听到错位再修,估算时间不当成精确发音。