ChineseASR · 功能说明

已有音频和确认文案,只找每个词在声音中的位置

我不用为改动画踩点再花一次配音费用,也不用让视频项目安装另一套语音识别。把一段现成音频和已确认文案交过来,就能取得词语出现的秒数,同时知道有没有漏对齐、来源有没有变。

当前情况:已有把确认文案对齐到音频的入口和公开音频验收;本轮只核对模型文件,没有重新执行,对齐也不验证文案真假。

项目快照核对于 ;具体测试保留各自日期,页面不实时探测运行状态。

复制 AI 续作说明带着这个项目,交给 AI 接着做

写下接下来想做什么。这里会把你的目标、本页事实和来源整理在一起,复制给 Astra 或 Gemini 后,就不用重新介绍项目了。

整理续作说明

只在当前网页整理,不会发起 AI 任务。

用途与实际影响

这项功能怎样使用

为什么需要它

重新识别可能把已经确认的名字和措辞改掉,按字数平均分配时间又会错过停顿和语速变化。这里把“说了什么”的确认与“这句话在哪一秒”分开,只处理后一个问题。

举个实际例子

“这段旁白已经满意,请给确认过的稿子标词语时间,别重新配音。”项目将原音与文案对齐,交回每个词从哪一秒到哪一秒;单段超过五分钟就按真实声音拆分,不能按文字长度猜时间。

最后我会得到什么

得到每个词在现成音频中的起止时间,附音频与文案的版本依据。覆盖不全或输入中途变化时保留旧结果;对齐成功仍不证明文案本身说得对。

正常时

原音和文案对应、时间顺序与覆盖都核对后,交回完整词语时间轴。

发现问题时

词语漏对、秒数异常或输入变了时不覆盖旧成果,说明具体缺口。

入口不可用或证据不足时

模型或显卡不可用、任务取消或超时,只停本次对齐;不下载、不上传或改走听写。

从哪里开始

给已有音频和确认文案,要求标出逐词起止时间。

需要准备什么

  • 现成音频
  • 对应且已确认的文案

从开始到拿到结果

  1. 1

    系统核对并处理

    核对输入对应后只按声音找词语时间,检查覆盖、顺序与输入是否变化,不重新判断文案真假。

  2. 2

    交付与接续

    交回词语秒数及原件身份;超长、覆盖不全或模型不可用时保留旧输出。