一支訪談,
拆成 6 種可上架素材
給訪談、Podcast、長影片創作者用的 AI 後製流程
錄一場訪談要一個下午
剪完發出去,通常只變成一支影片
這頁把同一支原片怎麼變成長影片、開場鉤子、預告、短影片、封面圖跟文字素材,一步一步拆開
每一步都寫清楚三件事:輸入什麼進去、產出什麼結果、由誰做
你不是做影片的也讀得下去
把「訪談原片」換成你手上那份會重複處理的東西,整套邏輯一樣成立
它被換去做只有你能做的那些事
那 6.5 小時原本花在對錯有標準答案的事情上:對規格、量時間碼、算圖、檢查有沒有出包
這些機器驗得了,就該交給機器
剩下的 1.5 小時,螢幕前的你幾乎只在做一件事,做最重要的那幾個決定
- 工作流的定義:把重複做的事拆成固定步驟,每一步寫清楚吃什麼進去、吐什麼出來、由誰做
- 省時間的來源不是剪得比較快:一是共用前置只做一次就餵給六條產線,二是機器接手所有對錯有標準答案的步驟
- 人機分工的判準只有一條:這件事的結果能不能被驗證,能驗證的交給機器,不能的留給人
- 人保留兩個決策點加一次抽查:決策點會擋住流程等你決定,抽查在成品出來之後才做
- 每一條檢查規則背後都有一次返工:踩坑不值錢,把它寫成下次會被自動擋下來的檢查項目才值錢
- 要搬到自己的工作上,先回答四個問題:唯一輸入是什麼、哪一步做一次就好、同一份素材還能收成什麼、想在哪兩個地方停下來決定
一,工作流到底是什麼,怎麼判斷自己那套算不算
二,一條真的在跑的流程長什麼樣,包含每一步的做法跟踩過的坑
三,怎麼把它搬到你自己的工作上,不用先學任何工具
最後還會給你一張成熟度階梯,讓你知道自己現在站在哪一格、下一格往哪走
工作流是什麼,不是什麼
這個詞被用得很鬆,先給一個能拿來檢查的定義,後面整頁都照這個定義跑
不是:每次重新想一遍
步驟只存在腦袋裡,這次憑手感做完,下次換個心情又變一套
這種狀態沒辦法交給別人,也沒辦法交給 AI,因為你講不出來要它做什麼
不是:「這個我 AI 一下」
單點用工具跟流程是兩回事
工具之間沒接起來,中間還是靠人開資料夾、複製貼上、改檔名,省下的時間又賠回去了
不是:一份素材只做一種東西
辛苦錄了一小時,只剪出一支影片就收工
素材沒有分岔,收成只有一次,前面花的力氣攤不掉
一,同一個步驟產出的檔名跟位置每次都一樣,找東西不用回想,用猜的都猜得到
二,出錯時知道要重跑哪一段,不用整批重來,這代表步驟之間的邊界是清楚的
三,做新的一集不用重新做決策,只換「每次會變的那幾樣」,其餘沿用
訪談工作流完整地圖
整套流程最值錢的地方在這張圖
驗證檔案、定裁切座標、判斷誰在說話這三件事只做一次,六條產線全部共用
忙的時候只做長片跟短影片,也完全可以
但前置那三件事不管開幾條產線都要做,所以多開一條的額外成本非常低
這就是分岔的意義:不是逼自己做更多,是讓「多做一種」變得便宜到你願意做
拆開來看,工作流由六個零件組成
這六個零件跟剪片沒關係
換成客服回信、報價單、月報表一樣成立,每張卡最下面那格就是給你對應用的
接下來四章會進到很細的實作,看起來全是影片的事
讀的時候不用記那些規格,只要對照這六個零件看:每一段細節,都是其中某一個零件的實際長相
每章開頭也會標出「換成一般工作看」是什麼,方便你隨時拉回自己的情境
只認一個輸入
整條流程只吃一樣東西,那支原片
其他檔案都是從它長出來的,不會有人中途丟一個「我另外剪過的版本」進來
輸入不唯一,後面每一步都要先問「這是哪一版」
越前面的步驟,越值得做一次就好
驗證檔案、定裁切座標、判斷誰在說話,這三件事六條產線都會用到
做一次,六條線攤掉;每條線各做一次,就是白做五次
分岔收成:同一份素材還能長出什麼
一場訪談的素材密度,遠高於一支影片裝得下的量
同一批畫面跟逐字稿,可以同時餵給長片、預告、短影片、封面、貼文跟網站
前置的成本一樣,收成多五份
人機分工,以及兩個必停的決策點
機器做可以被驗證的事:規格、時間碼、算圖、品檢
人做審美跟判斷
流程只在兩個點停下來等人,其餘一路跑完,不中途問
降級路徑:最好的做法不成立時,還有第二第三種
「判斷誰在說話」這步準備了三種做法
素材條件好就走最省的,條件差就往下降一級
流程不會卡死在「這次沒有分軌錄音」
錯誤回收:每踩一次坑,就長出一條規則
後面「兩道關」的每一條,都是真的做壞、退件重來換到的
踩坑本身不值錢,把它寫成下次會自動被擋下來的檢查項目才值錢
先把共用的事做好,後面六種成品都能用
AI 能不能幫你省時間,常常不是從剪片開始,而是從素材乾不乾淨開始
大部分人把 AI 想成後段的救火隊,實際上前面多做三件事,後段有好幾道工序可以直接不用做
這一章最容易被跳過,也是跳過之後代價最大的一章
換成一般工作看:這章講的是「整理輸入」
就像做報表之前先確認資料表格式對不對、欄位有沒有缺,先花五分鐘檢查,比事後整份重做便宜太多
錄的時候:三件事決定後面省多少力
兩個人各接一支麥克風,各錄成一條獨立音軌
後製時要知道「這一秒是誰在講話」,才有辦法自動切鏡頭
兩個人的聲音混在同一條音軌裡,機器分不出來,只能靠人聽或靠逐字稿
錄的時候就分開存,一人一條音軌,這叫分軌錄音
判斷誰在講話變成「比同一秒哪一軌比較大聲」,不用讀任何文字,零人工
沒有分軌就得靠逐字稿的語者標籤,或人工標時間碼,兩種都比較慢
人工那條路,一集就是一次完整播放的時間
用已知答案的六句話當考卷,六題全對,整集抓出 218 個換手點
附帶好處:算出來的說話比例可以當健檢,那一集是來賓 82%、主持人 18%,訪談節目落在來賓七到八成算正常,如果主持人講超過一半,通常表示題目問太碎
單機位廣角,把兩個人完整拍進畫面
多機位才有節奏感,但架兩三台機器等於多兩三倍的設備、對時、檔案管理成本
一個人做節目扛不動
只用一台攝影機,但拍得夠寬、解析度夠高
後期從同一張畫面裁出全景、主持人特寫、來賓特寫三種鏡位,等於一台機拍出多機位的效果
畫質夠不夠撐得住裁切放大,是這步唯一要顧的事,1080p 原片放大超過 2.7 倍,臉就開始糊
倍率不要憑感覺決定:抽同一張畫面做 2.1 倍、2.4 倍、2.7 倍三個版本並排比一次,選「構圖夠緊、臉還清楚」的那個,實際跑下來 2.4 倍是多數場地的折衷點
兩人之間留一點距離再坐
坐太近的話,單人特寫一定會切到旁邊那個人的肩膀
關掉手機的自動字幕,也順便看一眼畫面邊緣有什麼
自動字幕會直接燒進畫面,變成畫面的一部分,不是可以關掉的圖層
燒死了就拔不掉,也不能再疊自己的品牌字幕,整支素材的用途被鎖死
錄之前把自動字幕關掉
順便看一眼畫面的四個角,台標、時間戳、logo 浮水印都會限制之後的裁切範圍
曾經有一集因為左上角有 logo,主持人的特寫框只能往右退,構圖被迫偏掉
錄之前多看那一眼,比事後補救便宜太多
拿到素材之後:三查,任一項不過就停下來
這三查加起來不到五分鐘
不做的話,通常是做到一半才發現,然後整批重來
時長比對:逐字稿跟影片是不是同一支
拿錯逐字稿的話,所有時間碼會整批偏掉
而且你不會馬上發現,剪出來的畫面是順的,只是字幕跟人講的話對不上,通常要剪到一半才察覺
看逐字稿最後一句的時間,跟影片總長度對不對得上
差超過兩分鐘,大概就不是同一支的稿子,停下來確認
畫面查字幕:有沒有已經燒死的字
燒死的字幕多半在畫面下緣,直式短影片要把人臉裁大,下緣幾乎一定會被帶到
出片時會看到一條切了一半的白框,那時候整套裁切座標都要重定
抽頭、中、尾三張畫面看一眼就好
有燒死字幕的話,這個場地的裁切座標要另外定一套
查色域:這支是不是 HDR
有些手機拍出來的影片顏色特別亮,那叫 HDR,直接拿去剪會變得灰白沒血色
單獨看那一段不會覺得怪,等到跟別支素材接在一起,才會發現顏色淡一階、人臉泛白,而且是全片統一問題,補救等於整批重轉
動手前先確認這支是不是 HDR,iPhone 拍的常常是
是的話,全片統一先轉成一般色彩再進剪輯
靠時長比對當場抓出來(100 分鐘對 54 分鐘)
如果沒做這步,會一路剪到品檢才發現字幕全錯,前面所有工都白做
分鏡校準:新場地做一次,同一個棚之後沿用
校準就是把「特寫要框住誰、頭頂留多少空白、下緣要避開什麼」這些座標量一次,存成設定檔
這件事每個場地只做一次,但它決定之後每一集的構圖,所以值得慢慢做
抽一張有代表性的畫面,把三個框都框好
每一集重新目測構圖,同一個節目會出現忽大忽小的特寫,觀眾感覺得到不穩定
抽一張有代表性的畫面,把全景、主持人特寫、來賓特寫三組座標一次框好
判準:人的頭大約落在畫面上方三分之一,不切臉、不切耳朵,頭頂留一點空但不要留到像證件照
把這個場地的「禁區」一起寫進設定檔
「這個場地的下緣不能裁太低」這種限制,在腦袋裡放兩週就會忘
下一集換個人做、或你自己隔一個月回來做,很容易踩回去
把禁區直接寫進設定檔:底部有燒死字幕就鎖住裁切下緣、左上角有 logo 就鎖住左邊界
寫下來之後它就變成流程的一部分,不再依賴記性
做完這一步,之後每一集都不用再來一次
同一個場地錄下一集直接沿用,不用重新目測
這也是為什麼「固定一個錄音場地」本身就是一種省力
場地不變,這一整步的成本就攤到零
判斷誰在說話:三種做法,照素材條件選
這是整條流程唯一「條件不成立就會卡住」的步驟,所以準備了三層
能走第一種就走第一種,走不了往下降一級,流程不會停
| 做法 | 成立條件 | 人要做的事 | 代價 |
|---|---|---|---|
| 分軌錄音自動判 首選 |
錄音是多軌,兩人各佔一軌 | 不用做 | 零人工,連讓 AI 讀文字的錢都省了 |
| 逐字稿語者標籤 | 轉錄工具能輸出「誰說的+時間碼」 | 提供逐字稿,想粗剪的話附一行刪除清單 | 要等轉錄,另外花一點讓 AI 讀文字的成本 |
| 人工標時間碼 備援 |
前兩者都不成立 | 邊看邊記「幾分幾秒換誰講」 | 一集大約等於完整看過一次的時間 |
共同鐵則:對原始檔標,標之前不可以先剪
先剪再標,後面整批時間軸會對不上
這個坑踩過一次:拿重新排過順序的稿子去切原始檔,字幕整批差了 8 秒,而且症狀很難認——畫面正常、聲音正常,只有字幕慢半拍,很容易誤以為是字幕軟體的問題
連分軌錄音也判不出來的兩種狀況
一是兩個人同時搶話,二是麥克風互相收到對方的聲音
遇到這種段落,機器只知道「兩軌都有聲音」,還是要人過片抓
知道機器的邊界在哪,比相信它全能重要
同一支原片,怎麼變成六種成品
前置做完之後,這六條可以同時跑
每一條都寫清楚要解決什麼問題、怎麼做、產出什麼
換成一般工作看:這章講的是「同一份原料的多種用法」
一場客戶會議的錄音,可以同時變成會議紀錄、報價依據、常見問答、內部教學案例,做法不同但來源只有一份
後面會出現幾個影片圈的詞,先講白話:
算圖=把影片正式輸出成檔案,通常要等好幾十分鐘
抽幀=從影片裡截幾張畫面出來檢查
品檢=出片前的自動檢查,看有沒有明顯不合格的地方
一台攝影機一鏡到底,畫面一小時不動,觀眾會累
要做出像多機位的節奏感
- 把「誰在說話」的時間表切成三段,整集分三段跑,錯了只重跑一段,不用整集重來
- 先跑一次只出分鏡表不出影片的品檢:超過 28 秒的長鏡頭、短於 2.4 秒的碎鏡頭,數量都必須是零
- 品檢過了才真的算圖,之後抽幀檢查
- 過片時順手留兩三張表情生動的畫面,等一下產線 F 的封面圖要用
先想清楚節目的主軸是什麼,這一集的主軸是讓來賓發光,所以來賓的切鏡門檻比主持人低(來賓 2.5 秒、主持人 3.5 秒),快速一問一答也切來賓不切全景
三秒內的附和(對啊、真的耶)不切鏡,鏡頭留在原本說話的人身上
不設門檻會怎樣:畫面每一秒都在跳,觀眾會累但講不出為什麼,只會覺得「這支片有點吵」然後滑掉
算圖一次要好幾十分鐘,錯了才發現等於整段時間丟掉
分鏡表是純文字,十秒就掃完,超長鏡跟碎鏡一眼看得出來
便宜的檢查放在昂貴的動作前面,這是整條流程反覆出現的原則
留住已經點進來的人,開場一分鐘決定他要不要繼續看
- 從逐字稿挑全集最有張力的一段
- 剪成 60 秒內,接在正片最前面,然後正片馬上開始
開場鉤子跟預告不是同一種東西
鉤子放在正片開頭,對象是已經點進來的人,目的是留客
預告是獨立影片發到社群,對象是還沒點進來的人,目的是拉新
功能不同,選的片段也不該一樣
搞混會怎樣:把預告當鉤子放在正片前面,等於一開場就把最好的段落用掉,而且觀眾會覺得自己被騙進來看一支剛剛已經看過的東西
再長就變成「正片還沒開始你已經看了兩分鐘別的東西」,觀眾會失去耐性
鉤子的工作只是撐過開頭那段最容易被滑掉的時間,撐過去就交棒給正片,不要貪心
吸引還沒點進來的人來點,只給張力不給答案
- 只挑猜不到結局的反轉:觀眾先預設一個答案,結果被來賓推翻的那一瞬間
- 痛點要具體到有數字或畫面,「資產歸零」「每月存三千」可以用,「投資要謹慎」這種泛泛的講法不用
- 每一段自己就是一個完整的小故事,沒看過全集也聽得懂
對逐字稿搜這幾個詞:其實、沒想到、結果、反而、以為、誰知道、才發現
八成能直接定位到反轉句,再往前後各抓兩三句補完故事
寬螢幕版跟直式版的字幕位置、字級、節奏全部不同,各自有各自的規格
混用會做出兩邊都不對的東西:寬螢幕的字放到直式會小到看不清,直式的字放到寬螢幕會擋住人臉
寬螢幕版全片平均每 7 秒一刀,全長 24 到 35 秒,比正片明顯快
預告的敘事通常是「反差開場、代價、反轉」,寫配樂需求時很自然會寫出「慢慢堆疊」「由淡入濃」這種詞
結果生出來的曲子偏陰鬱、前十秒都在醞釀,配上去整支預告像懸疑片
要正向有衝勁的版本,就要在需求裡明講「一開始就要有節奏」「不要醞釀、不要氛圍感」,不然它預設會往電影感走
社群上的人不會點進一小時的節目
要有能單獨成立、看完聽得懂的一分鐘版本
- 選段:掃逐字稿出六支候選,人來拍板;片段必須是完整的邏輯單位,不看貼文光看影片本身也要聽得懂在講什麼
- 動態運鏡:開場雙人,來賓為主,主持人一開口就切雙人,講完切回來賓,字幕始終在畫面正中間
- 來賓名條:第一次切到來賓單人鏡位時,左下打出姓名與資歷停三秒;頭銜寫具體資歷不寫職業標籤,而且只能寫他在逐字稿裡真的講過的事實
- 封面:來賓認真講話的單人畫面,中間一行大標
- 結尾卡:合照加上真實平台 icon 跟上架時間,同一集共用一張
- 組裝:封面只放第一格(0.04 秒,播放時無感,但平台會抓第一格當縮圖),接本體、接結尾卡、蓋配樂
單行四到五個字,只寫「他要談的是哪一類東西」,不要把結論寫上去
寫「投資越無聊越好」,觀眾看完封面就拿到答案了,沒有理由點進來
寫「投資策略」,答案留在影片裡
四五個字本來就塞不下完整結論,字數限制就是策略的護欄
成品要對齊 −14 LUFS,那是串流平台的響度標準,白話說就是讓你的片跟別人的片音量差不多大
做法是先量一次現在多大聲,再把整支片的音量調到同一個標準,兩趟
只混不校正會怎樣:成品大概比同頻道的舊片小一截,觀眾滑到你這支要自己把音量調大,滑走的時候又被下一支震到,這種體驗會讓人下意識避開你的內容,而且他永遠不會留言告訴你
封面只放一格不要放一秒:放一秒會像影片卡住,觀眾以為當掉就滑走了,只放一格(0.04 秒)人眼無感,但平台照樣抓得到當縮圖
平台 icon 一律用官方圖檔,不要自己畫:自己畫的 icon 一眼就假,會把整支片的質感往下拉一階
合照要挑眼睛睜開、人物夠大的那張:閉眼或人太小的合照,是最常見的「差一點就好可惜」
兩個相鄰片段如果本來就是連續的時間,接的時候頭尾都不要多留
多留 0.2 秒會讓同一段聲音重複播兩次,聽起來像來賓突然結巴
這個症狀很容易被誤判成「來賓講話卡卡的」,其實是剪接造成的
影片剪完就結束,等於把一小時的內容只用在一個平台
逐字稿本身就是一份現成的文字素材庫
- 金句挑出來,寫成社群貼文跟短影片腳本
- 逐字稿整理後放上網站,讓 Google 比較容易找到你的內容,同一份稿子順便當節目筆記
- 訪談當下的觀察寫成採訪筆記發電子報,信本身要有價值,不是上架通知
機器轉出來的稿子直接貼上去會很難讀:簡體字混在裡面、人名前後不一致、滿滿的「嗯」「啊」「就是」
固定洗四件事:簡轉繁、人名統一、清掉語助詞、修明顯錯字
不洗會怎樣:讀者點進來看到一頁口水,會直接離開,那反而傷了你辛苦換來的搜尋排名
轉述別人講的話時,不新增原文沒有的事實、動作或因果,也不為了湊「三件事」硬補第三點
加工只能停在重組跟語感
為什麼這條不能鬆:來賓把他的故事交給你,寫錯一個因果,傷的是他的名譽跟你們的關係,而這種錯誤幾乎不可能事後補救
封面決定點擊率,但每集重新設計太慢,風格也會飄
- 把生圖用的指令做成固定範本,也就是每集照同一張格式換內容,只換三樣:來賓外觀、標題兩行、參考附圖
- 參考附圖是本集的對談截圖,加上過去的封面當風格參照
- 標題直接吃產線 C 的定稿,不重新發想;封面問句要跟影片標題同一個軸線,不然點擊率被自己稀釋
- 標題固定兩行,第一行問句當鉤子,第二行答句反轉,用品牌色當全圖焦點
字有沒有全對:這是 AI 生圖最常出錯的地方,它會把中文畫成「看起來像那個字」的圖案,遠看沒事、放大就穿幫,所以每次都要把標題逐字比對一遍
品牌色對不對:生出來的橘常常會偏紅或偏黃,跟你其他集數擺在一起才看得出來不同掛
人物像不像本人:不像的話,來賓自己分享時會尷尬
有沒有多出莫名其妙的 logo:AI 很愛自己加不存在的品牌標誌
封面問句跟影片標題如果不同軸,等於同一集對外講了兩個賣點
觀眾的注意力被分掉,兩邊都不夠強
共用一句,是免費的加成
交出去之前的兩道關:技術過了,不代表能看
第一道關機器可以驗,第二道關只能用眼睛跟耳朵
兩關都過才送出去
換成一般工作看:這章講的是「交件前的檢查表」
一關驗格式對不對(數字有沒有算錯、欄位有沒有漏),一關驗內容通不通(讀者看得懂嗎、有沒有前後矛盾),兩關的檢查方式完全不同,不能合併成一次看
拼接完的字幕,時間軸要用實際長度重算
影片是由很多張連續照片組成的,剪點沒辦法剛好落在你指定的那一毫秒,系統會自動往前後挪一點點
所以切出來的每個小片段,實際長度都會比你以為的長一咪咪
切完之後逐段量實際長度、重建對照表,再產字幕
段落之間的空白交給機器掃,不要用眼睛找
用偵測靜音的功能掃出段落內的停頓,每邊留 0.12 秒當呼吸再剪掉
那 0.12 秒不能省,全部剪乾淨的話語速會快到不像人講話,聽起來像機器唸稿
訪談的停頓比口播多,這步省下的秒數很可觀
HDR 素材要先轉成一般色彩再進剪輯
iPhone 錄的多半是 HDR 格式,直接轉檔會泛白
全片統一轉換並補曝光,跨機器跨天的素材才接得起來
標題卡的大標鎖在 10 個字以內
標題卡只出現兩三秒,工作是讓人在三秒內認出主題,字夠大才做得到
位置對齊人物頭部高度,太高會浮在天花板,太低會壓到頭
設定明明照著做,出來的東西就是不對,於是你開始重試、換參數、以為是自己哪裡設錯
實際上是工具那一端根本沒吃你的設定:像是指定了很粗的字重,工具卻只認得最細的那一種,畫面看起來就是「字型沒套用成功」
遇到這種鬼打牆,先確認工具有沒有真的收到你的指令,不要一直懷疑自己的參數
確認的方法很土但有效:故意設一個誇張到不可能看不出來的值,如果畫面沒變,就是它根本沒在聽
第二道關:把字幕從頭讀一遍,過這三題
有一支片被退了兩次,沒有一次是技術問題,全部是語意問題
剪完不要只看畫面順不順,把字幕當文章讀一遍
有沒有重複?
相鄰兩段是不是在講同一件事
留一句,另一句改成往前推進的說法就順了
有沒有斷裂?
有沒有哪一句是前面沒鋪陳就跳出來的
話講到一半被打斷的段落,拿掉就通了
有沒有畫面?
整支片至少要有一個觀眾身上發生過的具體場景
而且場景只能從逐字稿裡挑來賓真的講過的,不能自己補
每一條規則,背後都有一次返工
拿到手的逐字稿其實是同一天另一場會議的,做到一半才發現,整批時間碼作廢
動手前先做來源檔三查,時長對不上就停下來,不進下一步
直接拿重新排過順序的逐字稿時間碼,去切原始攝影機檔案,字幕整批差了 8 秒
切原始檔之前先確認這份逐字稿有沒有被重排過,有的話要用對照表反推回原始時間
只想改名條,結果連配樂也一起換錯,兩支片重新算圖兩次
重出之前先貼一張參數對照表,白紙黑字寫清楚這次只動哪一項;每一集的參數只留一份
從固定鏡位改成動態運鏡之後,來賓的名字整個消失了,觀眾不知道講話的人是誰
名條列為必要元素;舊做法靠標題卡帶出來的資訊,換做法時要逐項確認有沒有人接手
交出去之前,連發布也要固定格式
片子做好只是完成一半
標題、說明欄、逐字稿這些東西如果每次重想,品質會忽高忽低,而且你會發現自己每一集都在同一個地方卡住
換成一般工作看:這章講的是「交付格式」
同一份提案,寄出去的信怎麼寫、附件怎麼命名、給客戶的摘要放哪幾段,固定下來之後,你就不用每次重新決定,對方也知道去哪裡找他要的東西
標題跟說明欄照固定範本寫,不要每次重想
每一集從空白開始想標題跟說明欄,品質忽高忽低
而且最花時間的不是打字,是猶豫
標題固定一個句型:問句鉤子加上答句反轉,再掛來賓
說明欄固定四個區塊:一段導言、重點時間軸、來賓是誰跟他的連結、主持人是誰
格式一致,回訪的觀眾知道去哪裡找他要的東西
光是不用從空白開始,一集就省掉二十分鐘的猶豫
時間軸列九到十個就好,列太細觀眾反而不知道要點哪裡
逐字稿上網站,順手更新網站地圖
影片平台裡的內容,Google 抓不完整
等於你辛苦錄的一小時,只有點進那個平台的人找得到
同一份逐字稿放上自己的網站
這一集就多了一個永久入口,而且是你自己擁有的,平台改規則也帶不走
新頁面要加進網站地圖
不加的話搜尋引擎不知道它存在,等於白上
把這一集用了什麼參數寫回紀錄,而且只留一份
下次要重出其中一支的時候,你只想改一個地方,卻很容易連帶動到別的
真實案例:只想換名條,結果配樂也一起換錯,兩支片重算兩次
把配樂用哪首、從第幾秒開始、字幕樣式、名條寫什麼、封面用哪張、結尾卡日期,全部寫回這一集的紀錄,而且只留一份
重出之前先貼一張參數對照表,白紙黑字寫清楚這次只動哪一項,其餘不准碰
音效跟轉場目前還是手動加的,沒有全自動
判斷一件事值不值得交給機器,標準跟前面一樣:它的結果能不能被驗證
音量對不對、時間碼準不準,機器驗得了,所以先自動化;音效放哪裡好聽,沒有標準答案,就先留著
流程不用一次做到全自動,先把驗得了的那些搬過去,剩下的慢慢來
你只做兩個關鍵決定,最後快速抽查
這是整套流程能不能省力的關鍵
分工的判準只有一條:這件事的對錯有沒有標準答案
有標準答案的交給機器,沒有的留給人
人插手的地方精確講是三處,但性質不同:兩個決策點會擋住流程,機器做到那裡就停下來等你;最後那次抽查不擋流程,是成品出來之後快轉看一遍的品管
所以說「兩個決定」,指的是需要你動腦判斷、而且不決定就走不下去的那兩個
| 步驟 | 誰做 | 會不會擋住流程 | 為什麼這樣分 |
|---|---|---|---|
| 檔案驗證、分鏡校準、逐字稿、算圖、品檢、草案、生圖 | AI | 不會,一路跑完 | 結果可以用規格驗證,對錯有客觀答案 |
| 分鏡位置確認 | 你 | 會,決策點一 | 構圖好不好看沒有客觀標準,而且錯了會影響整集 |
| 切片候選拍板 | 你 | 會,決策點二 | 哪一段有張力是判斷題,也牽涉到你對來賓的責任 |
| 過片抽查 | 你 | 不會,成品出來之後才做 | 最後一道品管,快轉看換手點就夠,不用你動腦判斷 |
決策點一:分鏡位置確認
特寫要框住誰、頭頂留多少空白
這一關過了,同一個場地之後每一集都沿用,不用再看第二次
放掉這個決定會怎樣:構圖歪掉是整集歪掉,而且要等成品出來才看得出來,那時候重算圖的成本已經付掉了
決策點二:切片候選拍板
機器掃出六支候選,你挑
哪一段值得被放大、哪一段對來賓不公平,只有你知道
放掉這個決定會怎樣:機器會挑出「聽起來最有張力」的那幾段,但張力最高的往往也是來賓最脆弱的地方,發出去之前你得替他想一次
停太多,就退化回人工;完全不停,會做出一堆你不要的東西
多數流程兩個決策點就夠
搬到你的工作上:先回答四個問題
不用先學任何工具
這四題答得出來,流程的骨架就有了;答不出來,先買工具也接不起來
- 你每週重複做的那件事,唯一的輸入是什麼? 如果答案是「看情況」,先把它收斂成一份,輸入不唯一,後面每一步都要多花力氣確認版本
- 哪一步做一次,就能讓後面所有分支都用到? 那一步就是你的共用前置,值得投資最多時間把它做穩
- 同一份素材,還能收成什麼? 先列出來,不用馬上全做,知道有六種收成跟只知道一種,決定了你願意在前置上投多少成本
- 你希望流程在哪兩個地方停下來等你? 這題答完,你就知道自己在這條流程裡的位置,剩下的都可以交出去
你的下一步:找到自己的起點,今天做一件事
四題答完會發現,起點不一樣,第一步就不一樣
找到最像你的那一欄,只做那一件事就好,不要一次全開
更大的畫面:流程本身,最後會變成你的產品
這頁講的東西,其實只是一個階梯裡的第三格
知道整座階梯長什麼樣,你才知道自己現在站在哪裡、下一格要往哪走
步驟只在腦袋裡
做得完,但只有你做得完
你請假這件事就停擺,也沒辦法交給任何人,包含 AI,因為你講不出來要它做什麼
有一份清單,人照著做
可以交給別人了,品質也開始穩定
但速度沒變快,因為每一步還是人在做,你換到的是「不會出錯」,不是「不用你做」
機器做可驗證的,人只在決策點停這頁在這裡
時間開始明顯下降,而且下降的是重複勞動那一段,不是你的判斷
到這一格才會有「同一份素材多種收成」的餘裕,因為前置成本已經被攤平
流程本身變成可以交付的東西
當一條流程跑穩、寫清楚、還有踩坑紀錄,它就不只是你的工具
它可以變成賣給同行的範本、教給員工的教材、交付給客戶的一套系統
判斷自己到了沒有,看一個現象就好:你沒有在做這件事的時候,它還在替你產生價值
多數人優化流程是為了少加班,那只到第二格
真正的槓桿在第三格:你每整理一條流程,就多一份可以拿出去交換的東西
而且它跟你的本業不衝突,它就是你本業的副產品
不想從頭讀?把這頁丟給 AI,問這三題
這頁的結構是設計過的,整頁複製貼給任何一個 AI 助理都讀得懂
貼完之後照下面三題問,它會直接幫你把內容換算成你自己的流程
括號裡換成你的狀況就好
先讓它幫你拆出流程草稿
「這是一份訪談後製的 AI 工作流拆解
我的工作是(你的職業),每週重複做的事是(那件事)
請照這份的六個零件,幫我拆出我的流程草稿,並指出哪一步是我的共用前置」
再讓它幫你分工
「照這份的判準(結果能不能被驗證),把我上面的步驟分成兩欄:可以交給 AI 做的、必須我自己決定的
並告訴我哪兩個是會擋住流程的決策點」
最後問自己在哪一格
「照這份的成熟度階梯,我現在在第幾格
要走到下一格,具體要補的是什麼,請給我三件本週做得完的事」
那份草稿一定不完美,但它的價值不在完美,在於你終於有一個可以修改的東西
從零開始很難,從一份七十分的草稿開始修,任何人都做得到
把你的重複工作,也拆成一條流程
這條流程長成現在這樣,不是一次設計出來的
是被跑過很多次、退件過很多次,一條一條長出來的
你手上那件每週重複的事,如果攤開來看
應該也會有一段,是對錯有標準答案、可以交出去的
找人一起看一眼你的流程
這是一場建議,不是代工
不會把你的東西拿走做完再還給你,是陪你把流程攤開,告訴你哪一段該交給機器、哪一段該留給自己、先動哪一步
用你現有的工具接,不逼你換一套新的
填表單需要六到八分鐘,把現在的狀況寫下來
如果這個題目不適合用顧問解決,會直接告訴你,不收費
每個週末一封,一杯咖啡就讀完
- 2則本週值得讀的好內容
- 1個從工作與生活裡撿到的啟發
- 1-2個 AI 工作流優化場景應用