最后更新:
完成主要剪辑后再生成
访谈在发布前可能缩短问题、删除停顿或替换开场。字幕应来自准备给听众的最终版本,跟随同一段对话顺序。原始录制的文字即使正确,在答案被重新排列后也可能带来误解。
选择本地音频或视频,声音在设备上提取并压缩,然后上传识别与翻译。视频访谈的画面留在本地。最终下载的 SRT、VTT 或 ASS 只包含时间和文字,不包括节目本身,也不是对录制文件的长期云端备份。
分轨录音先检查是否包含双方
有些采访将主持人与嘉宾放在不同音频流。如果只选择一条,可能漏掉一半对话。开始前查看轨道列表并试听,需要完整问答时,通常应使用包含双方声音的成品混音,而不是某一人的独立麦克风。
远程声音过轻、回声和抢话都会影响识别。听不见的词无法靠翻译补回。某位嘉宾一直明显更轻时,先改善混音,往往比使用完全相同设置反复生成更有帮助;处理后再检查双方讲话的位置。
对重要措辞保持上下文检查
自然对话包含中断、修正、犹豫和依赖上一个问题的简短回答。预览时应放在语境中阅读,不能因为译文通顺就认定它保留了受访者的态度。限定条件、玩笑和否定词尤其可能改变一句话的含义。
嘉宾姓名、机构和专业名词可以放进术语表。准备公开引用时,仍应对照真实录音核实文字与前后语境。自动转写和翻译不是经过认证的引述,不能未经核查就把某句结果归为受访者准确说过的话。
根据发布渠道选择输出版本
目标语言目录提供 110+ 种语言,不受网站界面语言限制。译文可以帮助更多听众理解;原文适合想跟读同一语言的人。双语便于比较,但在快速问答中会增加屏幕阅读量。
本流程不承诺自动区分并命名每个说话者。如果渠道要求包含说话人标签和非对白声音的完整无障碍字幕,应在合适的编辑流程中补上这些信息。对白字幕可以作为基础,但不等于自动完成所有出版或无障碍要求。
用一段真实问答判断效果
网页预览从首条字幕开始,最长连续5 分钟。不要只检查事先写好的开场白,也应看短促插话、姓名和麦克风质量变化。可以访客开始,再登录保存同一个任务,避免因注册重复上传。
完整任务按所选录制的总时长每小时 1 美元计算,并向上取整到美分。评估窗口不从完整价格里扣除。多个目标语言对应独立任务;同一完成任务中的原文、译文和双语,以及不同下载格式,则属于输出选择。
明确参与者许可和节目版本
处理访谈前应获得适当许可,特别是包含私人或尚未公开的讨论时。不要将临时音频处理当作长期存档。自己的项目目录应保留录音、字幕下载和最终校对版本,便于日后修改或重新交付。
发布前,将字幕加载到正确一期节目,并检查多个时间点。语言标签应与实际文字一致,不同剪辑版要使用可区分的文件名。之后删除问题或更换开场时,应重新生成或调整时间,不能假定旧字幕仍然匹配。
开始之前,你可能想知道。
播客字幕会自动标出每位嘉宾姓名吗?
此对白流程不承诺自动说话人命名;需要的标签应在编辑校对阶段补充。
主持人与嘉宾分别录在不同轨道怎么办?
选择包含双方的成品轨,或先在编辑软件中准备适合的混音。
能直接把自动字幕当作核实过的访谈引述吗?
应先检查录音和语境,识别或翻译可能改变关键措辞。
访谈删减之前还是之后生成比较合适?
使用主要剪辑完成的最终版本,让字幕时间与准备发布的对话一致。