使用指南
剪辑与调色
时间线、逐字稿驱动剪辑、调色、字幕滤镜、导出。
「剪辑」页是一个多轨时间线编辑器:左侧素材 / 逐字稿 / 字幕,中间双监看器,底部时间线,右侧属性 / 调色。

创建主时间线并导入素材——素材池右上角「导入」,支持视频 / 音频 / 图片,导入后自动生成预览代理与缩略图:

把素材拖上轨道,移动播放头,按 S 在播放头处分割:

时间线#
- 多轨道:视频、音频、字幕轨并存;轨道可静音 / 锁定。
- 工具:选择 / 刀片(切分);拖拽跨轨移动,带落点吸附。
- 编辑:切分、复制、涟漪删除、多选、变速、淡入淡出、画中画(PiP)。
- 播放:逐帧步进、循环、倍速、音量、全屏;监看器带波形。
- 撤销 / 重做:全程可撤销(Cmd/Ctrl+Z)。
逐字稿驱动剪辑#
对音视频素材跑 ASR 转写后,得到逐字稿:
- 删句 / 删词直接从源片裁掉对应片段;静音、口头禅(呃、那个…)可一键检出并批量删。
- 每句的时间、说话人和正文首行保持对齐;长正文完整换行、不做省略,隐藏的行操作也不预留空白宽度。
- 转写走外部解释器,首次按需下载模型(见下载与安装)。
AI 助手#
机器人入口打开的是 AI 工作台、工作流与画板共用的会话池。剪辑页默认把助手停靠成真正的右栏, 时间线与监看器随之缩放而不是被覆盖;需要盖在上面时再切换为悬浮。左上角标题就是当前会话名称, 点击可搜索或切换会话。
调色#
右侧「调色」标签:
- 曲线:Luma / R / G / B 通道曲线,独立撤销栈(每次拖动记一步)。
- 风格预设:鲜艳 / 黑白 / 暖 / 冷 / 电影 / 褪色。
- 3D LUT:上传
.cube应用。 - 示波器:直方图 / 波形,实时监看。
字幕与滤镜#
- 字幕轨在 playhead 处加条,直接编辑文本,也可从逐字稿一键生成。
- 滤镜与字幕烧录进导出成片。
翻译#
字幕面板的「翻译」可整轨或只译选中的几条,勾「保留原文」得到「原文 / 译文」两行。 引擎二选一:Google 免费、不用配置,但整句直译、不看上下文;AI 模型走你在这个工作区配好的 供应商,能顺着上下文润色。默认 Google——它不花钱也不要密钥。
配音#


每条字幕自带配音入口(也可以整批配)。产物落到一条专门的配音轨:原声一个字不动,不满意整条 删掉就回到原样;再配一次回到同一条轨,而不是摞出一叠只有一两段音频的轨道。
- 缩放到段落长度(默认关):把配音拉伸或压缩到这条字幕的时长。用的是片段自己的倍速,渲染时 atempo 变速——无损、可撤销、事后还能在检查器里微调。超出 ±20% 语速会明显不自然,所以要不要付 这个代价由你按素材决定。
- 双语字幕会多问一句「念哪一行」。整段丢给合成 = 先念一遍原文再念一遍译文,一条 3 秒的字幕能 配出十几秒的音。
- 引擎可选本地音色克隆或任一远端引擎(Edge / OpenAI / 火山)。选了远端引擎时发音人按引擎现拉—— 火山的目录跟着你的账号走。
语言对不上时,引擎不会报错——它按自己认识的发音规则硬念一遍,交出一段听不懂的声音然后报成功。 所以选引擎的那一刻就会拦下来并说清出路,而不是等你听完才发现。
用自己的音色念外语#
本地音色克隆的语言能力取决于装了哪份权重,不是引擎的固有限制。基础权重是中英双语;日文、法语、 德语、西班牙语、意大利语、俄语、印地语、阿拉伯语、芬兰语各有一份社区微调权重,缺哪份就在配音弹层 当场下载(各约 1.4 GB)。
日文、韩文、俄文、阿拉伯文、印地文能按文字自动认出来,装好就直接用。而法语、德语、西班牙语、 意大利语、芬兰语和英语共用拉丁字母——没有任何字符能证明「这是法语而不是英语」,所以它们要在 「权重」下拉里明说用哪一份。
导出#
时间线工具栏「导出」渲染当前时间线,产出一条新素材;导出完成即可进入发布。



