LAPLACE Cap 的媒體編輯器是一款完全在瀏覽器中執行的影音剪輯工具,與字幕轉錄深度整合,可實現以文字定位的精準剪輯流程
特性
- 三欄可調版面:媒體預覽、轉錄文字、片段清單三欄可獨立拖曳調整寬度,版面配置會自動保存
- 波形視覺化:載入媒體後自動渲染音訊波形,支援最高 200× 縮放與拖曳平移,波形資料會快取至本機 IndexedDB,避免重複計算
- 逐詞對齊轉錄:轉錄結果與時間軸逐詞對齊,播放時自動高亮目前詞語,雙擊詞語可直接跳至對應時間點
- 轉錄搜尋與說話者篩選:支援關鍵字搜尋與
speaker:姓名語法,即時過濾轉錄內容,搜尋關鍵字會高亮顯示 - 說話者管理:多說話者轉錄可為每位說話者重新命名,名稱會依媒體檔案自動保存
- 片段管理:新增、重新命名、調整時間點、分割與刪除片段,支援復原/重做(最多 50 步)
- AI 片段標題產生:呼叫大型語言模型,依片段內字幕內容自動產生簡潔標題,支援單一片段與批次操作
- 歌曲辨識:可透過 AI 大型語言模型(從字幕文字)、Shazam 或網易雲音樂三種方式辨識片段中的歌曲
- SRT / JSON 匯入:支援匯入 SRT 字幕檔與 Soniox JSON 轉錄結果,無需重新轉錄即可使用既有字幕進行剪輯
- LosslessCut 專案相容:可匯入與匯出
.llc格式專案檔,與 LosslessCut 工作流程互通 - 精準剪輯匯出:基於 MP4 重新封裝的無損剪輯,支援精確的影格級修剪與依需求匯出字幕副軌
- Bilibili 影片來源支援:可直接載入嗶哩嗶哩稿件影片,搭配 LAPLACE Cap Helper 使用者腳本達成播放控制與逐詞轉錄同步,並支援匯入 B 站 AI / 人工字幕軌道
開啟編輯器
- 在 Generate Subtitles 完成轉錄後,點擊「在編輯器中開啟」可直接進入並關聯轉錄結果
- 或點擊頁面頂端的 Media Editor 標籤頁手動開啟,再透過選單列載入媒體與字幕
- 也可透過 URL 查詢參數
?mediaUrl=、?subtitleUrl=、?clipsUrl=深層連結至/editor,直接載入指定的媒體、字幕與片段
載入檔案
編輯器支援拖放操作,將以下類型的檔案直接拖入編輯器視窗即可載入:
| 檔案類型 | 說明 |
|---|---|
| 影片檔案 | MP4、WebM、MOV、MKV |
| 音訊檔案 | 所有主流音訊格式 |
| 字幕檔案 | .srt 或 Soniox .json |
| 專案檔案 | LosslessCut .llc 格式 |
也可透過選單列「File」逐項載入:
- Load Local Media… — 從本機載入影音檔案
- Load Media from URL… — 從遠端 URL 載入(直接連結需支援 CORS,同時支援嗶哩嗶哩影片 URL)
- Open Recent… — 重新開啟最近載入過的媒體(含本機檔案與 URL 紀錄),可透過「Clear Recently Opened…」清空清單
- Load Demo Project — 載入內建範例專案,快速了解各項功能
Bilibili 影片來源
媒體編輯器可直接載入嗶哩嗶哩稿件影片,無需事先下載:
- 透過「File → Load Media from URL…」貼上稿件連結(支援
b23.tv短連結與標準BV連結),編輯器會內嵌官方嗶哩嗶哩播放器 - 由於嗶哩嗶哩播放器在獨立 iframe 中執行,需安裝 LAPLACE Cap Helper 使用者腳本,編輯器才能雙向控制其播放(播放 / 暫停、跳轉、逐詞同步、片段標記)
- 使用者腳本需搭配 Tampermonkey 等使用者腳本管理器使用
- 可在主介面 Media Editor 標籤頁中一鍵安裝;未安裝時載入 B 站影片會跳出安裝提示
- 未安裝腳本時編輯器仍會顯示播放器,但無法驅動其播放與同步
- 安裝腳本後,可透過「Subtitles → Import from Bilibili…」自動探索並匯入該影片的字幕軌道(包括 B 站 AI 產生與人工上傳字幕),無需重新轉錄
嗶哩嗶哩影片來源僅供瀏覽與字幕對齊,無法進行片段剪輯匯出或媒體下載(相關選單項目會顯示為無法使用)。如需剪輯,請改用本機檔案或可直接下載的遠端 URL
轉錄面板
搜尋與篩選
- 在搜尋框輸入文字可即時過濾轉錄內容,搜尋關鍵字會以高亮標示
- 使用
speaker:姓名語法可篩選特定說話者的內容;若轉錄包含多位說話者,輸入框的提示文字會自動說明此語法 - 搜尋框右側顯示「已篩選筆數 / 總筆數」,點擊 × 可清除搜尋
逐詞對齊與卡拉 OK 模式
- 播放時,目前播放位置對應的詞語會即時高亮(卡拉 OK 效果),其餘詞語則適度淡化
- 雙擊任一詞語可跳至該詞對應的時間點
- 雙擊非作用中的段落可跳至該段落的起始時間點
說話者標籤
- 每位說話者以不同顏色標示,點擊標籤可重新命名該說話者
- 重新命名的結果會依媒體檔案保存,下次載入相同檔案時自動還原
- 「View → Always Show Speaker Labels」控制是否在每一段都顯示說話者標籤,預設僅在說話者切換時顯示
跟隨播放
- 開啟「View → Follow Active Segment」後,轉錄清單會自動捲動至目前播放位置對應的段落
- 快速鍵:
⌥F(Alt+F)可快速切換
波形與播放控制
波形操作
| 操作 | 效果 |
|---|---|
command/Ctrl + 滾輪 | 以游標為錨點縮放波形(1× – 200×) |
| 水平捲動 | 在縮放狀態下平移時間軸 |
command/Ctrl + 拖曳 | 平移時間軸(抓手模式) |
| 點擊進度條 | 跳至對應時間點 |
| 拖曳進度條 | 拖曳定位 |
波形資料會在首次載入後快取至本機 IndexedDB,再次開啟相同檔案時直接讀取快取,無需重新計算
播放控制
| 操作 | 說明 |
|---|---|
Space | 播放 / 暫停 |
← / → | 前進 / 後退 1 秒 |
Alt + ← / Alt + → | 前進 / 後退 1 影格 |
command/Ctrl + ← / command/Ctrl + → | 前進 / 後退 5 秒 |
- 點擊底部的時間碼可直接編輯並跳至指定時間點
- 影片模式下會顯示影格計數器,點擊可直接輸入影格編號跳轉
片段管理
新增片段
- 點擊片段清單右上角的「+」按鈕,在目前播放時間點建立新片段
- 快速鍵:
C
片段預設以目前播放時間為起點,以轉錄總長度(或目前時間 + 10 秒)為終點,命名為「Clip N」
調整片段時間
- 在片段清單中直接編輯起訖時間輸入框,按 Enter 確認
- 在波形上將播放頭定位至目標時間後,點擊播放控制區的「Set Start」或「Set End」按鈕
- 在轉錄面板的段落列上點擊「設為起點」或「設為終點」小按鈕
分割片段
將播放頭定位至片段內部,點擊「Slice」或按快速鍵 S,將目前片段從播放頭處一分為二
復原與重做
command/Ctrl - Z— 復原(最多 50 步)command/Ctrl - Shift - Z— 重做
AI 功能
每個片段的 AI 選單(✦ 圖示)提供以下操作:
| 功能 | 說明 |
|---|---|
| 產生標題 | 呼叫大型語言模型,依片段內字幕內容產生簡潔標題(最多 40 字) |
| 從字幕辨識歌曲(AI) | 將字幕文字作為歌詞輸入大型語言模型進行歌曲辨識 |
| Shazam 辨識 | 擷取片段音訊指紋,透過 Shazam 辨識歌曲(僅限本機檔案) |
| 網易雲音樂辨識 | 透過網易雲音樂指紋辨識歌曲(僅限本機檔案) |
批次操作可透過片段清單工具列的「AI 批次操作」下拉選單執行,對所有片段並行處理
AI 標題產生與歌曲辨識功能使用 General 設定中所指定的 LLM API Key 與模型。Shazam 與網易雲音樂辨識僅支援本機載入的檔案,無法用於遠端 URL 媒體
匯出
匯出設定
在選單列「Clips → Clips Settings…」中設定匯出行為:
| 選項 | 說明 |
|---|---|
| 檔名範本 | 自訂匯出檔名,支援 {filename}、{index}、{name}、{cut_from}、{cut_to} 變數 |
| 精確修剪 | 開啟後使用影格級 Edit List 達成精準剪輯點,適合追求影格精度的場景;極少數舊版播放器可能對 Edit List 處理異常 |
| 匯出串流 | 影音一併匯出 / 僅影片 / 僅音訊(僅音訊時輸出為 .m4a) |
| 一併匯出字幕 | 每個片段附帶對應時間範圍的 SRT 字幕附屬檔,字幕時間戳記自動對齊至片段起點 |
| Shazam 語言 | 設定 Shazam 辨識優先使用的語言區域 |
| AI 提示詞 | 自訂標題產生與歌曲辨識的系統提示詞,可還原為預設值 |
匯出方式
- 單一片段匯出:點擊片段列的匯出按鈕,匯出單一片段
- 批次匯出:點擊工具列「Export (N)」或選單列「Clips → Export All Clips」,批次匯出所有片段
對於超大檔案(預估匯出大於 500 MB),匯出時會呼叫 File System Access API 將資料直接寫入磁碟,避免記憶體溢位
匯出 LosslessCut 專案
「Clips → Export as LosslessCut Project」會將目前的片段清單匯出為 .llc 檔案,可在 LosslessCut 中繼續編輯
匯出字幕
- Export SRT — 將完整轉錄內容匯出為
.srt字幕檔 - Export TXT — 匯出含時間戳記與說話者資訊的純文字,適合後續編輯
- Export TXT for LLM — 匯出為更適合大型語言模型處理的純文字格式,方便交給 LLM 做摘要、翻譯或二次創作
資料儲存
編輯器的所有資料均儲存於本機瀏覽器,不會上傳至任何伺服器:
| 資料 | 儲存位置 |
|---|---|
| 片段清單 | IndexedDB(依媒體檔案建立索引) |
| 波形快取 | IndexedDB(加速重複載入) |
| 版面配置比例 | localStorage |
| 說話者名稱 | localStorage(依轉錄 ID 建立索引) |
| 匯出設定 | localStorage(透過 useSettings 保存) |
最後更新於 2026年9月19日