MiniMax H3 Ref2VA (人物替換)
玩了一天的 Ref2VA 分享點心得
主要是嘗試將杰哥不要影片的場景換成光美的角色 = =
場景一:保留參考影片
場景一:移除參考影片 (生成時間只要上一個影片的 1/5)
場景二:保留參考影片
主要製作方式:
1. 用 chatgpt 分析影片,提取影片和角色表情/動作/對話時間戳敘述
看起來是用 ffmpeg 多次截圖後在分析圖片而成

2. 用 chatgpt 製作背景圖片和角色卡
3. 把時間戳敘述丟給有 H3 Prompt Writing 技能的 Agent
讓他給出 Ref2VA 的提示詞
我覺得重點是提示詞要強調不保留原影片角色的外貌/服裝/聲音
僅保留動作與表情,其他用參考檔案生成
並且提示詞內每個時間戳要說明角色的動作和表情
才可能盡量還原原始影片的內容

4. 工作流/節點/模型
模型就用官方的 沒用加速lora(只試過一次 效果很差就沒再試了)
特別節點只用了大絲襪的節點和 CK attension(速度快了30%以上 必用)
其他都是從原始官方工作流修改而來

https://github.com/darksidewalker/ComfyUI-DaSi…
https://github.com/AesSedai/ComfyUI-MiniMaxH3-…
心得:
1. 在保留原始參考影片的前提下,角色的肢體動作可以比較好的還原
但代價就是生成時間長。
如果沒有複雜動作的話,可以只保留提示詞而不使用原始影片
但我不知道為什麼在製作第一段影片時
H3 死活不用2D動畫化的背景參考圖而是一直使用原影片生成
第二段倒是很好的就配合,指令遵循標準很迷 = =
2. 如果是想要作原影片替換人物,有些影片的分鏡時間比較長
像是我做的兩段影片其實也是同一個分鏡,
實作兩段影片不連貫,還要再研究怎麼可以整合在一起
--
08/31/2026 00:05:26 ※ 文章網址: https://www.ptt.cc/bbs/AI_Art/M.1788105927.A.3…