你提供咩、你會得到咩

適用對象

敘事及 IP 團隊

以分集形式講故事嘅團隊:角色主導嘅短篇系列、動畫敘事,以及需要下個月再出場但仍然要一眼被認得嘅品牌 IP 角色。

起手有咩

你已經定好嘅角色

文字角色描述或參考圖片、你嘅劇本或對白,以及(如角色建基於真人面孔或音色)該人士嘅書面授權。

你會得到咩

可重用嘅 persona 同鏡頭

一個固定嘅角色檔案,加上基於佢生成嘅場景圖片、動態鏡頭同交付尺寸嘅主視覺 key art,並以檔案形式交回,方便你自行剪輯同發佈。

當角色唔再「走樣」,會有咩改變

角色主導嘅作品,往往會以一種好特定嘅方式失手:唔係寫得唔好、亦唔係渲染唔靚,而係當觀眾喺第 5 集突然唔再相信「畫面入面嗰個人就係第 1 集見過嗰個人」嗰一刻。以下內容就係講點樣喺不同場景、不同季度、甚至每星期換人做嘅情況下,都維持住呢份相信;同埋邊一部分可以交畀流程承擔,邊一部分仍然要由人作出決定。

第 9 集仍然似第 1 集

第 3 集一上線,下面第一個留言就問:呢個係咪第 1 集嗰個女仔?技術上係。但下巴窄咗、髮界分去另一邊、眼色又淺咗一度;觀眾一旦留意到,就會開始睇塊面多過睇個故事。就算你用返第 1 集行得通嗰段 prompt,再生成出嚟嘅都只係「似親戚」,唔係嗰個角色。

解法係:唔好再不停「描述」角色,而係開始「重用」佢。persona 一次建立,就會將面孔、音色同外觀固定做參考;之後每個場景都以呢個參考去生成,而唔係靠某個人憑記憶重寫出嚟嘅一段文字。VisionStory 令角色保持易於辨認;但唔會替你決定佢係邊個。你仍然要把角色寫清楚,同時仍然要睇住每個新場景第一格畫面入面會走樣嘅細節:服裝、髮際線、必須留喺同一邊面頰嘅細細條疤。

用「剪輯思維」寫對白場口,而唔係靠一段 prompt

呢個節奏好易描述,但好難生成:兩個角色坐喺張枱度,一個講大話,另一個遲咗一秒先醒覺。你用一段 prompt 直接要一個多角色場景,結果往往係兩個人同一時間對住鏡頭講嘢,互相唔望對方,最關鍵嗰一下停頓消失晒。片段入面冇嘢可以畀你剪接對位,因為個鏡頭由一開始就唔係為「可剪」而構建。

用剪接師會收到嘅方式去砌場口。每個角色都有自己嘅鏡頭,並由各自鎖定嘅 profile 生成,咁個樣就可以保持一致;你只需要決定每句對白邊個出鏡、落句嗰刻佢望向邊度。輪流接話、遲到一步嘅反應、回答前嘅沉默——呢啲都係你做嘅剪接,而唔係一堆設定。VisionStory 會出鏡頭同音色;令場口成立嘅節奏,依然係導演嘅決定。

角色係一套規則,而唔係一個截圖資料夾

最熟個角色嘅,可能得一個 freelancer;佢知道嘅嘢只係放喺自己手提電腦嘅參考資料夾,同埋喺佢腦入面。季與季之間合約完咗,下一手打開 archive,只能由定格圖倒推再估:件褸究竟係角色設定定係只係第 4 集咁着?佢會唔會喺第一幕講口頭禪?觀眾應該覺得佢幾多歲?拍到第 10 集,冇人唔撳住滾動都答唔到。

將角色當成四樣會一齊行嘅嘢:一張臉、一個音色、一種講嘢方式,同埋一小段唔容許改動嘅外觀規則清單。把佢當成一個可重用 persona,再配一個有命名嘅場景資料庫,就可以成套交接。新加入嘅合作夥伴打開個 profile,就可以由佢生成下一場,而唔使再由上一場反向拆解。規則係你寫嘅,而且應該喺第 2 集之前就寫好,唔係到第 9 集先補救。

當角色係基於真人去建立

好多故事角色都係由真人出發:成為品牌吉祥物嘅創辦人、劇集選角嘅演員、又或者大家一聽就知係個節目嘅同事聲。當初令一切開始嘅「可以」,可能只係喺一次會議上答咗一次,為咗一個連會唔會拍多過 6 集都冇人肯定嘅試播集。兩季之後,同一張臉就喺另一個市場做緊付費植入,仲要用嗰位本人唔識講嘅語言——而呢啲全部都唔喺最初嗰次對話入面。

授權唔係過一次閘就完事;佢係一個有邊界嘅範圍,而節目愈做愈大,就最鍾意不斷踩過嗰啲邊界。要令成件事可用,靠嘅係一份寫清楚角色、內容、市場同期限嘅書面授權;所以每一次擴張,都應該喺生成畫面之前返去擴闊範圍,而唔係等到 campaign 出街先追:新一季、新地區、付費植入、外傳、合作品牌。喺呢個邊界之內,工作流程就好正常:將一張臉放入定格圖,同時保留原本嘅燈光同構圖;而一段已錄好嘅讀稿可以保留節奏同重音,同時交付嘅音色就變成角色嘅。超出邊界之外,冇任何 workflow 可以令片段變得可發佈。

角色一開口,就係用口同眼嚟評分

一張大家都 approve 咗嘅角色設定圖,只要角色一開口講對白,就可能即刻崩。觀眾唔再「睇張相」,而係開始「睇個口」:口形有冇對到輔音?對話時對眼係望住被講嗰個人,定係望住鏡頭旁邊?句子落咗之後個頭會唔會仲飄緊?呢啲喺定格圖入面完全睇唔到,而提升定格圖質素亦解決唔到。

所以要將講嘢鏡頭當成「有長度嘅鏡頭」,而唔係「音訊幾長就播幾耐嘅 clip」。生成角色嘅單一連續 take,通常頂到幾秒講話;再長落去小錯誤會慢慢累積,張臉就開始變得好假。面對一段長對白,最誠實嘅做法其實係剪:剪去聽眾、剪去反應、剪去手部,再剪返嚟。生成之前先決定好視線方向,唔好之後先同佢拗;每個 take 保持夠短先會乾淨;到句尾就剪,唔好硬拉一個鏡頭超過佢負擔到嘅程度。當某個時刻真係要拖長,補救靠嘅係導演調度,而唔係渲染更耐。

角色主導嘅團隊點樣用 VisionStory

做 AI 角色影片嘅簡單答案係:先定好角色,其後所有內容都以佢做基準去生成。角色 profile 比角色描述更值錢,分別在於你放咗乜入去:一張臉、一個音色、一種講嘢方式,同埋一小段永遠唔容許改動嘅外觀規則。四樣嘢定咗,之後大部分都係執行。下面 6 個步驟亦標示咗邊啲位仍然需要人作決定——尤其係涉及真人嘅臉或音色,以及最後要出街嘅內容。

任何內容發佈之前,內容負責人要確認角色臉部同音色背後嘅授權範圍、來源圖片同錄音已獲准用於呢個用途,並確保生成角色絕不會被呈現成真人。

  1. 01

    第一個場口出現之前先定死個角色

    一次過建立好一個可反覆使用嘅 persona,令佢嘅臉、音色同外觀喺每條由佢生成嘅影片入面都保持固定;之後就將呢個 persona 當成所有下游製作嘅參考基準。喺產品入面,呢個 persona 就係一個 avatar:一個已儲存嘅 profile,之後每個場景都指向佢,而唔係每次重新打描述。喺旁邊寫低乜嘢唔可以郁:角色應該畀人覺得幾多歲、髮際線、服裝規則、口音、以及令對白聽落像佢嘅 2 個口頭習慣。VisionStory 會令呢個 persona 喺不同場景之間保持一致。決定個角色係邊個、同埋乜嘢令佢一眼可辨——呢部分由你話事。

    工具 AI Influencer
    AI Influencer
    建立一個可反覆出現嘅虛擬人設,固定面孔、音色同造型,確保每條影片都一眼認得。
  2. 02

    未開始搭建周邊之前,先令角色郁起身

    人設定好之後,下一步要驗證嘅就係:佢郁唔郁得自然。用「圖片轉影片」將一張已授權嘅角色圖片做成可控動作嘅短片段—逐個鏡頭做,而唔係一次過整個場景。可剪可切嘅鏡頭,先係對白交流嘅基本單位,亦令你有位放入「慢半拍」嘅反應位。動作只做當下需要嘅份量就夠,因為角色喺畫面入面飄嚟飄去,觀感會似特效多過演出。咁早就見到角色郁起身,亦可以趁仲容易改動嘅時候,判斷個側面輪廓啱唔啱。將呢啲片段剪成一場戲嘅剪接,就交畀你自己。

    工具 圖片轉影片
    圖片轉影片
    將一張已核准的人像、產品或場景圖片製作成可控動作的短影片片段。
  3. 03

    唔使重演成場戲,都可以畀角色一把固定音色

    你可以自己讀對白,或者用返你已有嘅錄音 take,之後交畀「變聲器」處理—咁就可以將輸出嘅音色變成角色嘅,同時保留原本演繹嘅節奏、重音同停頓,完全照住演員放嘅位置。當一段讀白除咗音色之外全部都啱,或者同一個角色要跨成季、由唔同人喺唔同日子錄音都要聽落一致時,佢就最有用。如果目標音色係基於真人去建模,喺你生成任何內容之前,必須先攞到對方嘅書面許可。

    功能 變聲器
    變聲器
    喺保留原本節奏同演繹嘅情況下,替換現有錄音輸出嘅音色。
  4. 04

    搭建角色所身處嘅世界

    當角色郁起身嘅觀感已經啱,就可以用「AI 圖片生成器」去做角色周圍嘅一切:配角、每場戲需要嘅房間同街道、道具、封面圖同每集縮圖。將成果按「集數」同「節拍」命名,放入場景素材庫,咁就算係項目入面第三位編劇,都可以搵返第 2 集嗰個廚房,而唔使重新生成一個。連戲問題其實更常出喺環境同道具,而唔係角色本身,所以每張新圖入庫之前,都要先對照角色規則檢查一次,再同上一集對比觀眾會留意嘅細節。

    工具 AI 圖片生成器
    AI 圖片生成器
    根據提示或參考生成相關封面圖、角色、場景及輔助視覺。
  5. 05

    只替換你有權使用嘅面孔

    Face Swap 會將一張靜態圖片入面嘅面孔替換成已授權嘅肖像,同時保留原有光線同構圖—呢個就係以真人為原型嘅角色,點樣喺主視覺同劇照之間保持一致。佢只適用於靜態圖,唔適用於已完成嘅影片片段。喺第一格畫面出現之前,就要先向當事人攞到書面許可,清楚列明角色名稱、內容同投放渠道,亦絕對唔可以將結果當作佢本人嘅真實片段。如果授權唔清晰,就改為直接生成角色。

    工具 換臉
    換臉
    將靜態圖片入面嘅面孔替換成已授權嘅肖像,同時保留原本嘅打光同構圖。
  6. 06

    將角色美術升級到交付尺寸

    將主視覺、角色肖像、場景參考同縮圖交畀「圖片升級」處理,令佢哋喺最終母帶嘅交付尺寸都撐得住—包括面部填滿全畫面嘅 4K 特寫。通常最易出事嘅,係最初測試時隨手做嘅角色設定圖(用咩尺寸就做咩尺寸嗰啲),所以要用原尺寸檢查觀眾真係會望嘅位置:眼睛、髮際線、嘴形。升級只會提升清晰度同可用尺寸;佢唔會憑空加返原圖冇嘅細節,所以細圖已經唔啱嘅面,大圖都一樣唔啱—解法係按返人設重新生成。

    工具 圖片升級
    圖片升級
    提升人像、產品相片、縮圖及參考圖片的清晰度與可用尺寸。

常見問題

  • 唔好再反覆重寫角色描述,改為重用同一個人設。先一次過建立面孔、音色同造型,存成一個可重用嘅 avatar;之後每一場新戲都以呢個人設作為生成基準,而唔係每次都重新寫 prompt。再寫一份簡短清單,列明「唔准變」嘅項目:佢讀落似幾多歲、髮線分界喺邊、佢永遠著乜、聲線應該點聽。最後,每個新場景都用第一格畫面對照上一集,因為走樣通常會先喺細節出現,未必即刻講得出邊度唔同。

用戶熱愛 VisionStory

了解內容創作者和市場推廣人員為何信賴 VisionStory 處理 AI 影片需求。由強大功能到輕鬆體驗,我們的社群都對 VisionStory 的成果讚不絕口。

查看 G2 上所有評價