如何使用 Elser AI:從初構想到匯出的新手教學

來源: Elser AI

你的第一個 Elser AI 專案應該教你工作流程,而不是測試生成式影片的極限。從一個能用一句話說明的場景開始,並在少數幾個鏡頭內完成。這樣的限制能提供足夠的素材,讓你學習腳本撰寫、角色設定、分鏡、生成與剪輯,同時讓修改過程易於理解。

本教學使用一個25秒的範例:「在一個下雨的公車站,一位害羞的學生將一隻迷路的機器鳥歸還給它的主人。」選單名稱可能會演變,因此請將此順序視為一種製作方法,並依照您當前工作區中可見的標籤進行操作。

登入前:製作一份簡短的製作簡報

撰寫六行:觀眾、格式、目標時長、主角、可見動作與情感結局。以範例而言,觀眾為一般社群影片觀眾;格式為直式;學生發現鳥兒、看到牠焦急的主人並歸還鳥兒;結局為如釋重負。

添加限制條件:單一地點、最多兩人、無群眾對話、無服裝更換、無可辨識品牌標誌。限制條件能改善診斷,因為可變因素越少,越不易出錯。

在自己的專案中試試看: 建立一個免費帳戶,並將這個 25 秒的練習作為你的第一個受控測試。使用 Elser AI 將指引轉變為受控實驗,而非大型盲目批次處理。

步驟 1:選擇創意模式或腳本模式

使用「構想路徑」當您需要協助擴展前提時。使用「腳本路徑」當場景順序與對話已獲批准時。目前的 Elser 電影頁面記錄了這兩種途徑。

如果您從一個想法開始

要求一個簡短場景,需明確指定時長、地點、演員人數及結局。移除擴展情節中新增的任何支線。

如果您上傳腳本

確認場景標題、動作和對話是可區分的。保留必要的台詞,但讓視覺描述轉變為鏡頭。

無論您使用哪種方式,請大聲朗讀生成或匯入的腳本。如果以自然語速朗讀時超過目標時間長度,請立即縮短它。

步驟 2:編輯場景分解

產品工作流程可將故事分段為場景,您可新增、刪除或編輯這些場景。將範例轉換為四個節拍:空景停頓;學生注意到鳥;主人出現;返回並微笑。

  • 每個場景分配一個任務。
  • 將背景故事移到視覺提示中,而非用敘述表達。
  • 保持台詞簡短,以配合鏡頭長度。
  • 將雨、時間與衣著標記為全域連續性規則。

場景不是一個鏡頭。「返回」場景可能需要一個交接特寫加上一個反應鏡頭。在你的筆記中保持這個區別清晰可見。

在自己的專案中試試看: 在生成剩餘鏡頭前,先儲存已核准的學生與機器鳥設計。Elser AI 為您提供一個實用的平台,讓您註冊並測試最小可行版本。

步驟 3:設定格式、樣式與時間

為最終目的地選擇長寬比,而非個人習慣。選定一致的視覺風格與保守的鏡頭長度。模型選擇與可用性會變動,因此在確定專案前,請檢查目前的選擇器並執行具代表性的樣本。

在學習專案期間避免混合視覺風格。一個穩定的水彩動畫方向比在寫實、Q版和漫畫墨線之間切換更容易評估。

步驟 4:建立並核准演員陣容

定義具有不變特質的學生:短赤褐色頭髮、綠色雨衣、海軍藍背包及謹慎姿態。定義鳥類的形狀、材質、眼睛光澤及受損翅膀。先產生中性參考。

  • 核准正面或三分之三視圖。
  • 建立一個全身比例參考圖。
  • 為臉部與材質細節建立一個特寫鏡頭。
  • 刻意命名變體,例如「濕外套」,而非覆寫基礎版本。

檢查以縮圖尺寸儲存的素材。如果輪廓在那裡混淆不清,觀眾在快速剪輯中也會難以辨識。

在自己的專案中試試看: 僅生成通過靜態畫面審查的鏡頭。在 Elser AI 上建立帳戶,執行測試,並僅保留通過審查的素材。

步驟 5:選擇分鏡模式

目前產品頁面列出自動分鏡、手動分鏡與分鏡工作室。使用自動化以快速解讀,當劇本分段必須保持固定時使用手動分鏡,而當畫面構圖需要更多關注時則使用分鏡工作室。

在此練習中,製作四到六個分鏡。在每個分鏡下方寫下構圖、動作、鏡頭行為、情緒和持續時間。替換任何試圖呈現兩個不同時刻的分鏡。

步驟 6:生成關鍵影格,再生成動作

當工作流程允許時,以靜態形式批准構圖。對於圖像轉影片,應描述動作與鏡頭行為,而非重新描述每個可見物體。這遵循一項持久的提示原則:來源圖像已定義外觀。

  • 鏡頭1:固定廣角鏡頭;雨景與遠處車流移動。
  • 鏡頭2:輕柔推近;學生跪下;鳥眼閃爍。
  • 鏡頭3:中景;主人進入並停下。
  • 鏡頭4:近距離交接;動作受限。
  • 鏡頭5:反應特寫;背景中的雨勢漸緩。

僅針對最弱的決策生成替代方案。若框架有誤,修正框架;若動作不當,調整動作;切勿同時更改兩者。

步驟 7:加入語音、音效與最終剪輯

在粗略畫面時間後建構音效。以雨聲作為持續的背景音,用安靜的伺服馬達聲代表鳥,腳步聲代表主人,或許加上一句台詞:「你找到皮普了。」在對話下方加入鴨子環境音,並為學生的微笑留一個節拍。

在線上剪輯階段,修剪進出點、匹配動作剪接,並移除任何重複資訊的鏡頭。輸出審閱版本,在目標手機或螢幕上觀看,並在解析度升級前修正可讀性問題。

初學者疑難排解

當某件事失敗時,要精確地指出失敗之處。

  • 不同臉孔:返回已核准的參考資料,並減少衝突的身份詞彙。
  • 混沌運動:要求一個主要動作和更簡單的相機行為。
  • 慢節奏故事:延後進入場景,並刪除多餘的反應。
  • 扁平音效:在加入更多音樂之前,先添加位置氛圍和一個有動機的效果。
  • 非預期費用:請檢查模型、時長與解析度;計價方式依模型而異的消耗量。

保留簡短的實驗紀錄。當你知道是哪個變數改變時,提示詞的改進會更快。

為第一個 Elser 專案定義成功

在下一代來臨之前,為雨天公車站練習撰寫三項通過條件。包含一項故事條件、一項連貫性或技術條件,以及一項傳達條件。這能將品味轉化為可審查的決策。一個結果可能吸引人,但如果初學者在目標裝置上觀看結果時無法理解其目的,仍可能失敗。記錄拒絕的原因,以便下一次嘗試以證據而非情緒來回應。

執行一個小型代表性測試

選擇包含第一個 Elser 專案正常難度的鏡頭或素材——不是最簡單的美化畫面,也不是不可能的巔峰。保持參考資料、格式和驗收標準不變。改變一個變數,然後在正常播放尺寸下進行比較。測試在產生批准、修改、重新設計或刪除的決定時完成,而不是在產生最大圖庫時完成。

保留決策記錄

針對雨天公車站練習,請儲存提示詞、參考資料、可見模型名稱、設定、輸出ID與核准備註。加上簡短的缺陷標籤,例如「輪廓模糊」、「反應遲緩」或「音訊蓋過對話」。這份記錄能讓協作者了解某個版本勝出的原因,並在介面或模型目錄變更時保護專案。

常見問題

我的第一個專案應該要多長?

大約15到30秒就足夠測試完整鏈路,而不會產生難以管理的審查佇列。

初學者應該使用自動分鏡嗎?

對於快速初步解讀很有幫助。若拍攝選擇很重要,請與受控版本進行比較。

我可以上傳自己的腳本嗎?

是的,目前的電影工作流程記錄了遵循劇本的路線。清晰的格式有助於改善場景分割。

我應該何時添加語音?

粗剪之後。實際鏡頭長度應決定台詞長度與停頓。

我怎麼知道結果好不好?

評估故事清晰度、連貫性、動態、音訊契合度、技術缺陷及可用秒數——而非單一畫面的美感。

結論

一個成功的第一個專案是你能夠診斷的。保持故事簡短,區分劇本決策與鏡頭決策,批准角色參考,只動畫好的幀,並讓剪輯——而非無止盡的重製——創造動能。

最新發布