方法筆記
做 AI 虛擬主持人,我後來不是先追嘴型
做 Mina 的時候,我先把角色、字幕、畫面證據和聲音拆開處理。只盯著嘴型,整支影片還是接不起來。
Mina 是一條和 AI vin 分開的實驗線,目前沒有發布,停在 Pilot gate。這篇記錄我怎麼把生成影片整理成可以繼續組裝的模板。
角色分工字幕位置剪輯驗證
今天的問題是什麼
我想做一個能重複使用的 AI 虛擬主持人,放在短影音裡講工具或案例。但嘴型、畫風和循環接點只要有一個不穩,注意力就會被角色拉走。
為什麼不是只換模型
換模型沒有直接解決問題。有些模型的嘴型比較好,卻會推鏡、改構圖、換掉畫風,甚至多生一個角色。模型能力更強,也不一定適合這套影片結構。
我後來怎麼拆
我回頭分析參考影片,看每一層畫面各自在做什麼。上方放畫面證據,中間處理字幕,下方角色穩定陪講。角色不用獨自扛起整支影片,也不用先把精準對嘴做到完美。
- 先看參考影片的畫面結構,不只看角色漂不漂亮
- 把角色、字幕、畫面證據、聲音和剪輯分開判斷
- 可用片段先救回來,再用轉場和節奏處理重複使用
目前整理到哪
目前有一個 30 秒的主持模板基底,可以接著組字幕和聲音。這條線停在 Pilot gate,最終聲音、字幕和完整成片都還沒完成,也沒有併進 AI vin 主品牌。現在能確認的是模板可以往下組裝,還不能當成已完成或已發布的案例。