00:00 / 00:00

Cap

媒体编辑器

LAPLACE Cap 的媒体编辑器是一个完全运行在浏览器中的音视频剪辑工具,与字幕转录深度集成,可实现以文字定位的精准剪辑工作流

特性

  • 三栏可调布局:媒体预览、转录文本、片段列表三栏独立可拖拽调整宽度,布局自动持久化
  • 波形可视化:加载媒体后自动渲染音频波形,支持最高 200× 缩放与拖拽平移,波形数据缓存至本地 IndexedDB 避免重复计算
  • 逐词对齐转录:转录结果与时间轴逐词对齐,播放时自动高亮当前词语,双击词语可直接跳转至对应时间点
  • 转录搜索与说话人筛选:支持关键词搜索与 speaker:姓名 语法,实时过滤转录内容,搜索词高亮显示
  • 说话人管理:对多说话人转录可重命名每位说话人,名称自动按媒体文件持久化保存
  • 片段管理:新建、重命名、调整时间点、分割与删除片段,支持撤销/重做(最多 50 步)
  • AI 片段标题生成:调用大模型根据片段内字幕内容自动生成简洁标题,支持单片段与批量操作
  • 歌曲识别:支持通过 AI 大模型(从字幕文本)、Shazam 或网易云音乐三种方式识别片段中的歌曲
  • SRT / JSON 导入:支持导入 SRT 字幕文件和 Soniox JSON 转录结果,无需重新转录即可使用已有字幕进行剪辑
  • LosslessCut 项目兼容:可导入和导出 .llc 格式项目文件,与 LosslessCut 工作流互通
  • 精准剪辑导出:基于 MP4 重混流的无损剪辑,支持精确帧级修剪与按需导出字幕副轨
  • Bilibili 视频源支持:可直接载入哔哩哔哩稿件视频,配合 LAPLACE Cap Helper 用户脚本实现播放控制与逐词转录同步,并支持导入 B 站 AI / 人工字幕轨道

打开编辑器

  • Generate Subtitles 完成转录后,点击「在编辑器中打开」直接进入并关联转录结果
  • 或点击页面顶部的 Media Editor 选项卡手动打开,再通过菜单栏加载媒体和字幕
  • 也可通过 URL 查询参数 ?mediaUrl=?subtitleUrl=?clipsUrl= 深链至 /editor,直接载入指定的媒体、字幕与片段

加载文件

编辑器支持拖放操作,将以下类型的文件直接拖入编辑器窗口即可加载:

文件类型说明
视频文件MP4、WebM、MOV、MKV
音频文件所有主流音频格式
字幕文件.srt 或 Soniox .json
项目文件LosslessCut .llc 格式

也可通过菜单栏「File」逐项加载:

  • Load Local Media… — 从本地加载音视频文件
  • Load Media from URL… — 从远程 URL 加载(直链需支持 CORS,同时支持哔哩哔哩视频 URL)
  • Open Recent… — 重新打开最近加载过的媒体(含本地文件与 URL 记录),可通过「Clear Recently Opened…」清空列表
  • Load Demo Project — 加载内置示例项目,快速了解功能

Bilibili 视频源

媒体编辑器可直接载入哔哩哔哩稿件视频,无需先行下载:

  • 通过「File → Load Media from URL…」粘贴稿件链接(支持 b23.tv 短链与标准 BV 链接),编辑器将内嵌官方哔哩哔哩播放器
  • 由于哔哩哔哩播放器运行在独立 iframe 中,需安装 LAPLACE Cap Helper 用户脚本,编辑器才能双向控制其播放(播放 / 暂停、跳转、逐词同步、片段标记)
    • 用户脚本需配合 Tampermonkey 等用户脚本管理器使用
    • 可在主界面 Media Editor 选项卡中一键安装;未安装时载入 B 站视频会弹出安装提示
    • 未安装脚本时编辑器仍会显示播放器,但无法驱动其播放与同步
  • 安装脚本后,可通过「Subtitles → Import from Bilibili…」自动发现并导入该视频的字幕轨道(包括 B 站 AI 生成与人工上传字幕),无需重新转录

转录面板

搜索与筛选

  • 在搜索框输入文字可实时过滤转录内容,搜索词以高亮标注
  • 使用 speaker:姓名 语法可筛选特定说话人的内容;如转录包含多位说话人,占位符会自动提示该语法
  • 搜索框右侧显示「已过滤条数 / 总条数」,点击 × 清除搜索

逐词对齐与卡拉 OK 模式

  • 播放时,当前播放位置对应的词语实时高亮(卡拉 OK 效果),其余词语适度暗显
  • 双击任意词语跳转至该词对应的时间点
  • 非活动段落双击可跳转至该段落的起始时间点

说话人标签

  • 每位说话人以不同颜色标注,点击标签可重命名该说话人
  • 重命名结果按媒体文件持久化,下次加载相同文件时自动恢复
  • View → Always Show Speaker Labels」控制是否在每一段都显示说话人标签,默认仅在说话人切换时显示

跟随播放

  • View → Follow Active Segment」开启后,转录列表会自动滚动至当前播放位置对应的段落
  • 快捷键:⌥F(Alt+F)快速切换

波形与播放控制

波形操作

操作效果
command/Ctrl + 滚轮以光标为锚点缩放波形(1× – 200×)
水平滚动在缩放状态下平移时间轴
command/Ctrl + 拖拽平移时间轴(抓手模式)
点击进度条跳转至对应时间点
拖拽进度条拖拽定位

波形数据会在首次加载后缓存至本地 IndexedDB,再次打开相同文件时直接读取缓存,无需重新计算

播放控制

操作说明
Space播放 / 暂停
/ 前进 / 后退 1 秒
Alt + ← / Alt + →前进 / 后退 1 帧
command/Ctrl + ← / command/Ctrl + →前进 / 后退 5 秒
  • 点击底部时间码可直接编辑并跳转至指定时间点
  • 视频模式下显示帧计数器,点击可直接输入帧编号跳转

片段管理

新建片段

  • 点击片段列表右上角「+」按钮,在当前播放时间点创建新片段
  • 快捷键:C

片段默认以当前播放时间为起点,以转录总时长(或当前时间 + 10 秒)为终点,命名为「Clip N」

调整片段时间

  • 在片段列表中直接编辑起止时间输入框,按 Enter 确认
  • 在波形上将播放头定位至目标时间后,点击播放控制区的「Set Start」或「Set End」按钮
  • 在转录面板的段落行上点击「设置为起点」或「设置为终点」小按钮

分割片段

将播放头定位至片段内部,点击「Slice」或按快捷键 S,将当前片段从播放头处一分为二

撤销与重做

  • command/Ctrl - Z — 撤销(最多 50 步)
  • command/Ctrl - Shift - Z — 重做

AI 功能

每个片段的 AI 菜单(✦ 图标)提供以下操作:

功能说明
生成标题调用大模型根据片段内字幕内容生成简洁标题(最多 40 字)
从字幕识别歌曲(AI)将字幕文本作为歌词输入大模型进行歌曲识别
Shazam 识别提取片段音频指纹,通过 Shazam 识别歌曲(仅限本地文件)
网易云音乐识别通过网易云音乐指纹识别歌曲(仅限本地文件)

批量操作可通过片段列表工具栏的「AI 批量操作」下拉菜单执行,对所有片段并发处理

导出

导出设置

在菜单栏「Clips → Clips Settings…」中配置导出行为:

选项说明
文件名模板自定义导出文件名,支持 {filename}{index}{name}{cut_from}{cut_to} 变量
精确修剪开启后使用帧级 Edit List 实现精准剪切点,适合追求帧精度的场景;极少数旧播放器可能对 Edit List 处理异常
导出流音视频均导出 / 仅视频 / 仅音频(仅音频时输出为 .m4a
同时导出字幕每个片段附带对应时间段的 SRT 字幕副文件,字幕时间戳自动对齐至片段起点
Shazam 语言设置 Shazam 识别优先使用的语言区域
AI 提示词自定义标题生成与歌曲识别的系统提示词,可恢复默认值

导出方式

  • 单片段导出:点击片段行的导出按钮,导出单个片段
  • 批量导出:点击工具栏「Export (N)」或菜单栏「Clips → Export All Clips」,批量导出所有片段

对于超大文件(导出估算大于 500 MB),导出时会调用 File System Access API 将数据直接写入磁盘,避免内存溢出

导出 LosslessCut 项目

Clips → Export as LosslessCut Project」将当前片段列表导出为 .llc 文件,可在 LosslessCut 中继续编辑

导出字幕

  • Export SRT — 将完整转录内容导出为 .srt 字幕文件
  • Export TXT — 导出含时间戳与说话人信息的纯文本,适合二次编辑
  • Export TXT for LLM — 导出为更适合大模型处理的纯文本格式,便于交给 LLM 做摘要、翻译或二次创作

数据存储

编辑器的所有数据均存储于本地浏览器,不上传至任何服务器:

数据存储位置
片段列表IndexedDB(按媒体文件索引)
波形缓存IndexedDB(加速重复加载)
布局比例localStorage
说话人名称localStorage(按转录 ID 索引)
导出设置localStorage(通过 useSettings 持久化)

最終更新日:2026年9月19日

Tech otakus destroy the world