AI 應用

DaVinci Resolve 21.1 內建 MCP 伺服器:Claude 能剪初剪,抓不到功能時還會自己開 FFmpeg

2026-09-10 | 約 11 分鐘 | MAQ 技術團隊

DaVinci Resolve 21.1 為軟體內建了 MCP 伺服器,讓 Claude、ChatGPT 這類 AI 代理可以直接透過 Resolve 的應用程式介面(API)執行剪輯工作,不需要再仰賴社群自行開發的第三方外掛。YouTube 頻道 Team 2 Films 實際測試了這項功能,示範從媒體匯入、音畫同步、鏡頭拆分、組裝初剪,到大型專案的批次渲染、直式短影音生成與調色協助,並在過程中誠實記錄了目前的能力邊界。本文整理這支實測影片的內容。

一、技術基礎:AI 代理走 API,不是操作圖形介面

這項功能的關鍵前提是:AI 代理並不是模擬滑鼠鍵盤去點選 Resolve 的操作畫面,而是呼叫 Resolve 原本就開放給 Python 腳本使用的同一套 API 函式。這代表代理能做到什麼,完全取決於 API 目前實際開放了哪些函式——影片作者預期,隨著代理式工作流的普及,Resolve 每個新版本開放的 API 函式會持續增加,但當下仍存在明確的功能缺口。這項功能僅限 DaVinci Resolve Studio(付費版),且需搭配支援 MCP 協定的 AI 代理,影片全程使用 Claude Pro 搭配 Claude 桌面版應用程式。

二、實測項目

影片按專案流程逐步下達指令,展示了以下工作:

  • 媒體匯入:只描述網路共享上資料夾名稱的一部分,Claude 就正確找到對應的媒體資料夾並匯入,同時重建原有的資料夾結構。
  • 踩到 API 缺口,自行找替代路徑:作者要求 Claude 依 B-cam 錄下的音軌時間碼更新對應設定,這項特定函式並未開放在 Resolve 的 API 中。Claude 沒有停在這裡,而是自行下載 FFmpeg、直接讀取每支素材的時間碼,再呼叫另一個 Resolve 確實開放的 API 函式完成更新——用外部工具補上 API 沒開放的那一步。
  • 聲道清理與音畫同步:正確辨識並移除錄有時間碼雜訊的聲道,接著把分軌收音的對白同步到雙機畫面、保留機頭收音,並附上一份處理報告——這是在 Resolve 圖形介面手動操作時不會自動取得的細節記錄。
  • 鏡頭拆分:把整捲掃描底片(一捲一個檔案)用「偵測場景切換」功能拆成個別鏡頭,並在沒有特別要求的情況下,主動判斷出僅一格畫格長度的切點是畫格閃爍、予以忽略。
  • 初剪組裝:依素材的逐字轉錄稿內容,將場次重新排序以符合原本的製程敘事、把時間碼相符的素材放上第二軌,組出一支約十五分鐘的初剪——這個步驟耗時較長,因為 Resolve 得先在背景完成所有素材的轉錄。
  • 大型專案批次自動化:把長時間軸快取成 TIFF 影像序列、分段渲染到外接硬碟、重新匯入、再渲染最終的 H.265 母版檔案。Claude 自動拆成多個渲染工作而非單一個大工作,且可在無人看管下持續運行,遇到問題甚至 Resolve 當機時能自行排除並延續作業。
  • 直式短影音批次生成:從一支五十分鐘的長片,一次生成二十支約六十秒的直式短影音建議,含前後十五秒的緩衝素材、時間軸標記與智慧重新構圖,並沿用原時間軸的音軌設定。唯一的缺陷是無法移除複製時間軸後留下的空白區段——這是目前 API 尚未開放的功能。作者也提醒:Claude 完全依素材的逐字轉錄稿內容做判斷,並沒有真正看過畫面。
  • 調色協助:面對來自不同機型、不同 Log 格式的多機素材,Claude 依需求為每支素材建立多個序列節點並套用對應的輸入 LUT。由於節點建立與命名尚未開放在 API 中,Claude 改用電腦操作直接控制滑鼠在圖形介面完成這一步,其餘設定再透過 API 下達——與時間碼那段案例呼應,展示代理如何跨越當下的 API 缺口。

三、影片提出的能力邊界

作者在影片最後給出幾項現階段的誠實結論。AI 目前還不能取代剪輯師:比較貼切的定位是「助理剪輯師」,需要人給出清楚的指令,並對產出的成果做審核與把關。剪輯工作本身有程序性與創意性之分,程序性的部分——素材整理、音畫同步、初剪組裝、批次渲染——會是最先被自動化的一塊,但創意判斷與情感表達,作者認為仍是人類的領域:AI 能模仿既有創作中的模式並加以複製,卻沒有自身的情感經驗可以依循。

能力邊界目前來自兩個方向:其一是 Resolve API 本身尚未開放的功能(例如作者提到,Blackmagic 尚未把素材的內容辨識資料開放給 AI 代理讀取);其二是 AI 代理自身理解影像內容的能力——目前 Claude、ChatGPT 都沒有逐格觀看素材畫面的能力,所有涉及內容判斷的工作都仰賴逐字轉錄稿,而非真正「看」過畫面。作者也給出一項實務建議:由於複雜指令的運算多半發生在雲端、Resolve 在等待代理回應時會處於無法操作的狀態,適合另外準備一台輔助電腦專門排隊執行代理指令(影片示範用的是 Mac mini M4),讓主要剪輯站保持可用。

資料來源:YouTube 頻道 Team 2 Films 發布之影片《DaVinci Resolve 21.1 BEST New Feature TESTED - AI Editing with Claude and ChatGPT》。內文為本站對影片內容之整理與摘述,非逐字翻譯;影片中之實測結果、效能表現與作者評論均為原作者於測試當下之陳述,未經本站覆核或複現,實際功能請以 Blackmagic Design 官方文件與版本更新公告為準。本站與 Team 2 Films、Blackmagic Design、Anthropic 均無合作或對價關係。DaVinci Resolve 為 Blackmagic Design Pty Ltd 之商標;Claude 為 Anthropic PBC 之商標;ChatGPT 為 OpenAI 之商標;Mac、Mac Studio、Mac mini、Apple Silicon 為 Apple Inc. 之商標;FFmpeg 為 FFmpeg 專案之商標;其餘商標歸各自所有者所有。

常見問題

DaVinci Resolve 21.1 的 MCP 伺服器是什麼?跟以前的第三方版本有什麼不同?

MCP(Model Context Protocol)是讓 AI 代理與外部軟體溝通的開放協定。先前已有社群自行開發的第三方 Resolve MCP 伺服器,21.1 版將這項功能收進官方內建。AI 代理是透過 Resolve 既有的應用程式介面(API,同一套供 Python 腳本操作的介面)下指令,並不是模擬滑鼠鍵盤去操作 Resolve 的圖形介面,因此代理的能力上限,就是 API 目前實際開放了哪些函式。

這個功能所有版本的 Resolve 都能用嗎?

不行。這項功能僅限 DaVinci Resolve Studio(付費版),且需要搭配支援 Anthropic MCP 協定的 AI 代理。實測影片使用的是 Claude Pro 訂閱搭配 Claude 桌面版應用程式,設定路徑為「File → Setup AI Assistant」,並依 Claude 端的提示完成授權。

AI 代理真的看得懂剪輯素材的畫面內容嗎?

目前不行。影片作者多次強調:Resolve 的 API 尚未把畫面內容辨識的資料開放給 AI 代理讀取,Claude、ChatGPT 目前也沒有逐格觀看影像素材的能力。示範中的直式短影音建議、初剪組裝等工作,都是依剪輯素材的逐字轉錄稿內容去判斷情節與段落,而不是真正「看」過畫面,選段品質仍需要人工複核。

導入這類 AI 剪輯工作流,對硬體配置有什麼建議?

影片作者建議另外準備一台電腦專門排隊執行 AI 代理的指令,讓主要剪輯站保持可用;由於代理運算主要在雲端完成,這台輔助電腦不需要頂規配備(影片示範用的是 Mac mini M4)。但要留意,Resolve 本身的背景轉錄、場景偵測、大型專案的分段渲染與 TIFF 快取,仍會占用剪輯站本身的運算與儲存頻寬,這部分的規格仍應以實際專案規模為準,不能因為代理運算在雲端就低估本機需求。

AI 剪輯會取代剪輯師嗎?

影片作者的結論是不會,至少目前不會。目前這類 AI 比較接近「助理剪輯師」的角色:能處理程序性、重複性的工作,例如媒體匯入整理、音畫同步、初剪組裝、批次渲染,但仍需要人下達明確指令、審核成果並做最終的創意判斷。影片也指出,剪輯工作本來就有程序性與創意性之分,程序性的部分會是最先被自動化的一塊。

MAQ,一直是後期剪輯的硬體與技術夥伴

MAQ 提供 Mac mini 與 Mac Studio 的客製配置,Mac Studio M5 Ultra 為站上標示之專業剪輯建議規格,適合搭配 DaVinci Resolve 進行轉錄、場景偵測、渲染與快取等背景運算。出廠可預載開發與剪輯環境,並提供在地交機與售後技術支援。