LAPLACE Cap 的媒体编辑器是一个完全运行在浏览器中的音视频剪辑工具,与字幕转录深度集成,可实现以文字定位的精准剪辑工作流
特性
- 三栏可调布局:媒体预览、转录文本、片段列表三栏独立可拖拽调整宽度,布局自动持久化
- 波形可视化:加载媒体后自动渲染音频波形,支持最高 200× 缩放与拖拽平移,波形数据缓存至本地 IndexedDB 避免重复计算
- 逐词对齐转录:转录结果与时间轴逐词对齐,播放时自动高亮当前词语,双击词语可直接跳转至对应时间点
- 转录搜索与说话人筛选:支持关键词搜索与
speaker:姓名语法,实时过滤转录内容,搜索词高亮显示 - 说话人管理:对多说话人转录可重命名每位说话人,名称自动按媒体文件持久化保存
- 片段管理:新建、重命名、调整时间点、分割与删除片段,支持撤销/重做(最多 50 步)
- AI 片段标题生成:调用大模型根据片段内字幕内容自动生成简洁标题,支持单片段与批量操作
- 歌曲识别:支持通过 AI 大模型(从字幕文本)、Shazam 或网易云音乐三种方式识别片段中的歌曲
- SRT / JSON 导入:支持导入 SRT 字幕文件和 Soniox JSON 转录结果,无需重新转录即可使用已有字幕进行剪辑
- LosslessCut 项目兼容:可导入和导出
.llc格式项目文件,与 LosslessCut 工作流互通 - 精准剪辑导出:基于 MP4 重混流的无损剪辑,支持精确帧级修剪与按需导出字幕副轨
- Bilibili 视频源支持:可直接载入哔哩哔哩稿件视频,配合 LAPLACE Cap Helper 用户脚本实现播放控制与逐词转录同步,并支持导入 B 站 AI / 人工字幕轨道
打开编辑器
- 在 Generate Subtitles 完成转录后,点击「在编辑器中打开」直接进入并关联转录结果
- 或点击页面顶部的 Media Editor 选项卡手动打开,再通过菜单栏加载媒体和字幕
- 也可通过 URL 查询参数
?mediaUrl=、?subtitleUrl=、?clipsUrl=深链至/editor,直接载入指定的媒体、字幕与片段
加载文件
编辑器支持拖放操作,将以下类型的文件直接拖入编辑器窗口即可加载:
| 文件类型 | 说明 |
|---|---|
| 视频文件 | MP4、WebM、MOV、MKV |
| 音频文件 | 所有主流音频格式 |
| 字幕文件 | .srt 或 Soniox .json |
| 项目文件 | LosslessCut .llc 格式 |
也可通过菜单栏「File」逐项加载:
- Load Local Media… — 从本地加载音视频文件
- Load Media from URL… — 从远程 URL 加载(直链需支持 CORS,同时支持哔哩哔哩视频 URL)
- Open Recent… — 重新打开最近加载过的媒体(含本地文件与 URL 记录),可通过「Clear Recently Opened…」清空列表
- Load Demo Project — 加载内置示例项目,快速了解功能
Bilibili 视频源
媒体编辑器可直接载入哔哩哔哩稿件视频,无需先行下载:
- 通过「File → Load Media from URL…」粘贴稿件链接(支持
b23.tv短链与标准BV链接),编辑器将内嵌官方哔哩哔哩播放器 - 由于哔哩哔哩播放器运行在独立 iframe 中,需安装 LAPLACE Cap Helper 用户脚本,编辑器才能双向控制其播放(播放 / 暂停、跳转、逐词同步、片段标记)
- 用户脚本需配合 Tampermonkey 等用户脚本管理器使用
- 可在主界面 Media Editor 选项卡中一键安装;未安装时载入 B 站视频会弹出安装提示
- 未安装脚本时编辑器仍会显示播放器,但无法驱动其播放与同步
- 安装脚本后,可通过「Subtitles → Import from Bilibili…」自动发现并导入该视频的字幕轨道(包括 B 站 AI 生成与人工上传字幕),无需重新转录
哔哩哔哩视频源仅用于浏览与字幕对齐,无法进行片段剪辑导出或媒体下载(相关菜单项会显示为不可用)。如需剪辑,请改用本地文件或可直接下载的远程 URL
转录面板
搜索与筛选
- 在搜索框输入文字可实时过滤转录内容,搜索词以高亮标注
- 使用
speaker:姓名语法可筛选特定说话人的内容;如转录包含多位说话人,占位符会自动提示该语法 - 搜索框右侧显示「已过滤条数 / 总条数」,点击 × 清除搜索
逐词对齐与卡拉 OK 模式
- 播放时,当前播放位置对应的词语实时高亮(卡拉 OK 效果),其余词语适度暗显
- 双击任意词语跳转至该词对应的时间点
- 非活动段落双击可跳转至该段落的起始时间点
说话人标签
- 每位说话人以不同颜色标注,点击标签可重命名该说话人
- 重命名结果按媒体文件持久化,下次加载相同文件时自动恢复
- 「View → Always Show Speaker Labels」控制是否在每一段都显示说话人标签,默认仅在说话人切换时显示
跟随播放
- 「View → Follow Active Segment」开启后,转录列表会自动滚动至当前播放位置对应的段落
- 快捷键:
⌥F(Alt+F)快速切换
波形与播放控制
波形操作
| 操作 | 效果 |
|---|---|
command/Ctrl + 滚轮 | 以光标为锚点缩放波形(1× – 200×) |
| 水平滚动 | 在缩放状态下平移时间轴 |
command/Ctrl + 拖拽 | 平移时间轴(抓手模式) |
| 点击进度条 | 跳转至对应时间点 |
| 拖拽进度条 | 拖拽定位 |
波形数据会在首次加载后缓存至本地 IndexedDB,再次打开相同文件时直接读取缓存,无需重新计算
播放控制
| 操作 | 说明 |
|---|---|
Space | 播放 / 暂停 |
← / → | 前进 / 后退 1 秒 |
Alt + ← / Alt + → | 前进 / 后退 1 帧 |
command/Ctrl + ← / command/Ctrl + → | 前进 / 后退 5 秒 |
- 点击底部时间码可直接编辑并跳转至指定时间点
- 视频模式下显示帧计数器,点击可直接输入帧编号跳转
片段管理
新建片段
- 点击片段列表右上角「+」按钮,在当前播放时间点创建新片段
- 快捷键:
C
片段默认以当前播放时间为起点,以转录总时长(或当前时间 + 10 秒)为终点,命名为「Clip N」
调整片段时间
- 在片段列表中直接编辑起止时间输入框,按 Enter 确认
- 在波形上将播放头定位至目标时间后,点击播放控制区的「Set Start」或「Set End」按钮
- 在转录面板的段落行上点击「设置为起点」或「设置为终点」小按钮
分割片段
将播放头定位至片段内部,点击「Slice」或按快捷键 S,将当前片段从播放头处一分为二
撤销与重做
command/Ctrl - Z— 撤销(最多 50 步)command/Ctrl - Shift - Z— 重做
AI 功能
每个片段的 AI 菜单(✦ 图标)提供以下操作:
| 功能 | 说明 |
|---|---|
| 生成标题 | 调用大模型根据片段内字幕内容生成简洁标题(最多 40 字) |
| 从字幕识别歌曲(AI) | 将字幕文本作为歌词输入大模型进行歌曲识别 |
| Shazam 识别 | 提取片段音频指纹,通过 Shazam 识别歌曲(仅限本地文件) |
| 网易云音乐识别 | 通过网易云音乐指纹识别歌曲(仅限本地文件) |
批量操作可通过片段列表工具栏的「AI 批量操作」下拉菜单执行,对所有片段并发处理
AI 标题生成和歌曲识别功能使用 General 设置中配置的 LLM API Key 和模型。Shazam 与网易云音乐识别仅支持本地加载的文件,无法对远程 URL 媒体使用
导出
导出设置
在菜单栏「Clips → Clips Settings…」中配置导出行为:
| 选项 | 说明 |
|---|---|
| 文件名模板 | 自定义导出文件名,支持 {filename}、{index}、{name}、{cut_from}、{cut_to} 变量 |
| 精确修剪 | 开启后使用帧级 Edit List 实现精准剪切点,适合追求帧精度的场景;极少数旧播放器可能对 Edit List 处理异常 |
| 导出流 | 音视频均导出 / 仅视频 / 仅音频(仅音频时输出为 .m4a) |
| 同时导出字幕 | 每个片段附带对应时间段的 SRT 字幕副文件,字幕时间戳自动对齐至片段起点 |
| Shazam 语言 | 设置 Shazam 识别优先使用的语言区域 |
| AI 提示词 | 自定义标题生成与歌曲识别的系统提示词,可恢复默认值 |
导出方式
- 单片段导出:点击片段行的导出按钮,导出单个片段
- 批量导出:点击工具栏「Export (N)」或菜单栏「Clips → Export All Clips」,批量导出所有片段
对于超大文件(导出估算大于 500 MB),导出时会调用 File System Access API 将数据直接写入磁盘,避免内存溢出
导出 LosslessCut 项目
「Clips → Export as LosslessCut Project」将当前片段列表导出为 .llc 文件,可在 LosslessCut 中继续编辑
导出字幕
- Export SRT — 将完整转录内容导出为
.srt字幕文件 - Export TXT — 导出含时间戳与说话人信息的纯文本,适合二次编辑
- Export TXT for LLM — 导出为更适合大模型处理的纯文本格式,便于交给 LLM 做摘要、翻译或二次创作
数据存储
编辑器的所有数据均存储于本地浏览器,不上传至任何服务器:
| 数据 | 存储位置 |
|---|---|
| 片段列表 | IndexedDB(按媒体文件索引) |
| 波形缓存 | IndexedDB(加速重复加载) |
| 布局比例 | localStorage |
| 说话人名称 | localStorage(按转录 ID 索引) |
| 导出设置 | localStorage(通过 useSettings 持久化) |
最終更新日:2026年9月19日