各位寶子們,現在做短視頻的人越來越多,誰還沒個「想拍但懶得拍」的念頭呢!品牌片、口播、短劇小樣,要是能一條龍在同一個地方做完,再發到網上,那肯定能少走很多冤枉路。
以前做條片子,得在出圖軟件、視頻模型、配音工具、剪映之間來回橫跳,素材導進導出,靈感早磨沒了。現在 AI 把整條鏈路縫進一塊畫布,普通人也能端到端地把想法做出來。
今天的教程:教你怎麼用 MetaDig 把一句想法做成可發佈的短視頻。從出圖、生視頻到畫布底部直接出片,讓你少下一個軟件、少導一次素材。
MetaDig 是一站式 AI 視頻專業創作平台。用戶可在無限畫布上完成文生視頻、圖生視頻、數字人、AI 配音配樂與剪輯合成,節點連線就能當參考。平台接入 Wan 3.0、Seedance 2.5、GPT Image 2 等模型,還帶 3D 導演台和雙軌時間線。公開模板支持一鍵克隆,團隊可以同一塊畫布實時協作。
官網入口:https://waytometa.cn/
一起來看看如何操作吧~
01. 單鏡頭角色短片
訪問 MetaDig 官網:https://waytometa.cn/

註冊登錄,新建項目,打開畫布。
新建圖片節點,選擇 GPT Image 2,生成一張包含長相和服裝的圖:
出圖提示詞:
寫實,傍晚巷口,暖黃路燈,積水反光。二十多歲女生,黑短髮,深色衝鋒衣,斜挎包,半身側臉看手機。鏡頭略低,能看到鞋面。不要字幕,不要海報感。

「圖1」
圖沒問題了,新建一個視頻節點,選 Wan 3.0,把這張圖丟進參考槽,在提示詞中引用「圖1」。注意:這張圖只負責鎖定人物的臉和衣服,不要讓模型重新生成面部。
視頻提示詞:
「圖1」是角色正臉和服裝,不要改五官,不要換衣服。傍晚街巷,「圖1」從右側入畫,走向暖燈,低頭看一眼手機。鏡頭跟拍到半身,最後兩秒停在鞋面反光。只要巷口環境聲,不要旁白,不要字幕,無人臉變形。時長 5 秒。
點擊生成。如果發現臉部變形或衣服被改了,直接在提示詞裏用自然語言描述問題,局部調整即可,不用整條重新抽卡。
看看效果:人物被圖片固定住了,這條 5 秒視頻可以當封面,也能作爲下一段的開頭。
02. 視頻+BGM,畫布直出成片
第二條只換機位和動作,模型選 Wan 3.0 或 Seedance 2.5:
第二條視頻提示詞:
圖1是角色正臉和服裝,視頻1只提供走路節奏,音頻1提供巷口環境聲。不要改五官,不要換衣服。
傍晚街巷,圖1從畫面右側入畫,按視頻1的步頻走向巷口暖燈。鏡頭跟拍到半身,最後兩秒停在鞋面反光。不要旁白,不要大字幕,無人臉變形。

兩段都出來後,丟進畫布底部的時間線:
選中第一段,點「加入時間線」;第二段再點一次
空格預覽,片頭片尾空就把手往裏收;接得跳,交界處加 0.5 秒黑場
播放頭拖到開頭,把 BGM 加進下面那條音頻軌
點「導出成片」,1080P,畫幅選自動或 9:16
合成不消耗積分,成片會自動回到畫布。支持最多 40 個片段、總長 5 分鐘,做短視頻完全夠用。
來看效果:同一個人,從巷口走到便利店,BGM 全程鋪底。不用再去剪映裏手動對齊。
03. 一些分享
在嘗試用 MetaDig 做短視頻之後,我真是大開眼界,收穫滿滿!
過去製作 AI 視頻如同抽卡:提示詞冗長,生成一條 5 秒視頻後若不滿意只能整條重抽,之後還需導入剪映進行對齊。作爲新手一晚上能燒掉好多積分,片子還是散的。將流程整合進畫布後,這想法徹底變了。
就拿出圖來說,以前一張參考圖既要管臉,又要管動作,又要管濾鏡,模型只能平均。
現在槽位分開:圖1管長相,導演台管站位,視頻節點管這一段正在發生的事。同樣積分,成功率會高一截。不是模型突然變聰明,是你少讓它猜。