原影片:Bilibili BV118Kh6yEMq

本文整理 Bilibili 影片〈掌握这三步,Codex真的能替你剪视频了!〉。影片約 3 分鐘,主旨不是「一句話自動出片」,而是把人的內容判斷、審美與規則,轉成 Codex 能執行的影片施工圖。

一、影片的核心觀點

作者比較兩個月前後用 Codex 剪片的效果,指出差距不在 AI 突然變聰明,而在使用者終於把需求說清楚。資訊卡、字幕、排版、動效、轉場及節奏等工作,可以交給 Codex 執行,但「什麼叫高級」「哪一句配哪個畫面」仍然需要人作判斷。

影片把 Codex 定位成會寫程式的剪輯助理,而不是傳統時間線剪輯軟件。它適合按照規則生成卡片、圖表、轉場及版面;如果只說「加點高級動效」「再酷一點」,結果就像抽卡,難以穩定複製。

二、三步工作流

第 1 步:先做 Video Spec,不要直接叫它剪

先提供完整文案、影片素材,以及剪映等工具匯出的 SRT 字幕。接著要求 Codex 產生 Video Spec,也就是影片剪輯執行說明書,列明:

  • 哪一句使用真人畫面或旁白。
  • 哪一句放資訊卡、放大字或圖表。
  • 哪一段需要補錄屏、截圖或真實案例。
  • 字幕、畫面、動效及轉場的時間點。
  • 不能自行臆測、必須由使用者補充的素材。

這一步看似沒有剪片,實際上先把腦中的判斷轉成 AI 能理解的施工圖,減少後面反覆返工。

第 2 步:先剪 30 秒樣板

不要一開始就處理全片,先讓 Codex 按同一套邏輯製作約 30 秒預覽。開啟本地預覽,逐項檢查人物是否被遮擋、資訊卡是否與口播對上、字幕是否清楚,以及動效是否影響閱讀。

樣板不對,只修改這 30 秒;樣板成立後,再把同一邏輯套用到整條片。影片提到通常需要來回調整兩三次,效果才會穩定。

第 3 步:用時間點、位置與參考圖說清楚動效

不要只用抽象形容詞。要指定哪個時間點不對、人物和卡片放哪裡、文字何時出現,並提供一張想要的效果參考圖,要求 Codex 按需求重現。清楚的需求加上參考圖,AI 才較容易理解使用者的視覺目標。

三、人與 AI 的分工

  • 人負責:主題、內容重點、案例真實性、素材選擇、敘事、審美、品牌風格及最後驗收。
  • Codex 負責:把明確規則轉成程式與剪輯執行,處理資訊卡、動態圖表、排版、動效、字幕機械調整及重複修改。
  • 共同工作:先做樣板、開本地預覽、指出具體時間點問題,再逐輪修正。

影片也提醒:如果影片需要截圖、真實案例或額外片段,Codex 不會憑空補出可靠素材;使用者仍要提供並核對來源。

四、把一次經驗沉澱成可重用系統

當一條片調整完成後,可以把動效、卡片、排版、Video Spec 規則及修正經驗沉澱成專屬 skill 或模板。下一條影片便能重用結構,同時避開上一條片已發現的問題。這是影片所說的「建立影片生產線」,而不是單次一鍵生成。

五、實作檢查表

  1. 準備文案、SRT、原始影片、圖片、錄屏及案例素材。
  2. 標示每段內容的畫面類型、字幕、重點及禁用素材。
  3. 要求 Codex 先輸出 Video Spec,再開始製作。
  4. 先做 30 秒樣板並開本地預覽。
  5. 用時間碼指出遮擋、錯位、字幕、節奏及動效問題。
  6. 用參考圖和具體數值描述視覺效果。
  7. 人工核對事實、版權、品牌素材、字幕及最終成片。
  8. 把成功規則與常見錯誤保存成下一次可重用的 skill。

六、限制與風險

  • 語音轉文字可能出現錯字,SRT 仍要人工校對。
  • AI 生成的案例、截圖或數據不能未經核實直接放入影片。
  • 參考圖、音樂、字體、品牌素材及影片片段要確認使用授權。
  • AI 動效可能遮擋人物、破壞可讀性或產生不一致的視覺節奏。
  • 「全自動剪輯」「效率翻倍」等影片宣稱沒有在影片中提供完整可比較數據。

結論

這段影片最實用的不是某一句提示詞,而是三個工作習慣:先做 Video Spec、先用 30 秒驗證、用時間點與參考圖提出具體修改。Codex 可以把剪輯判斷快速執行,但不能代替內容策略、素材查核及審美驗收。適合把它當成可訓練、可重用的剪輯助理,逐步建立自己的規則與模板。

來源與聲明

來源:Bilibili 影片 BV118Kh6yEMq。本文根據頁面資訊及音訊轉錄整理;轉錄可能有個別專有名詞或術語辨識誤差,影片中的效率及效果描述未作獨立驗證。