Process

Tools

Techniques

  • vid2vid

  • txt2vid

  • img2vid

Generation data

COPY ALL

Prompt

External Generator
subject_definitions: <Subject 1> 是來自 的人物,其外貌、服裝與姿態完全保留該圖特徵,作為目標視頻中唯一可視角色。 <Subject 2> 是畫面上方中央的雲狀對話氣泡,粗黑邊白底,內部以英文手寫字呈現文字內容。 僅作為 <Subject 1> 的外貌來源,不提供時間線或分鏡結構。 僅作為 (S1) 的語氣與音調參考,不對白內容進行複製。 summary: [reference generation + audio reference] 目標視頻在 5 秒內呈現一名角色面對鏡頭口述更新資訊,同時畫面頂部中央浮現對話氣泡同步顯示文字。視覺風格緊貼 的人物特徵,語調與節奏參照 但不複製原始語音內容。 retention_analysis: <Subject 1>(出現於 [Shot 1]):fully_preserved - 外貌、服裝、姿態與表情完全沿用 的視覺特徵。 <Subject 2>(出現於 [Shot 1]):fully_preserved - 形狀、邊框、底色與內部文字樣式完全保留。 (人物外觀來源):fully_preserved - 所有可見視覺屬性無損遷移至目標人物。 :weak_reference - 僅參考語氣、音調與節奏特徵,不對白內容進行複製。 detailed_description: 畫面呈現一位清晰可辨的人物正對鏡頭,背景為中性色調的靜態環境,光線均勻柔和,營造專業且自然的講述氛圍。人物從畫面中央開始說話,語氣流暢自然,節奏適中。 [Shot 1] At 00:00.000, 畫面以中近景構圖呈現 <Subject 1>,她(S1)面向鏡頭,口型同步運動說:<d>[English]"Simple workflow for Minimax H3 updated"</d>。語氣與節奏參照 的語調與音高變化,但不複製原始音頻信號。同時,<Subject 2> 從畫面頂部中央位置向上彈出,以雲狀對話氣泡形態浮現,粗黑邊框、白色底面,內部以英文手寫字體顯示 "Simple workflow for Minimax H3 updated.",文字內容與人物口述同步展開。 整體畫面維持固定機位,無明顯運鏡動作,僅有輕微的呼吸式微動以增強真實感。聲音方面,人物語音清晰可辨,無背景雜音干擾,語速與情緒表達與 保持一致但為重新演繹的語音。畫面中無其他可視元素或動態變化,結尾時人物保持說話姿態,對話氣泡完整顯示於畫面上方。 overall_soundscape: 環境中無明顯背景音,僅有清晰的人聲語音作為主要聲音元素。語音乾淨無雜音,語速穩定,語氣自然,符合日常講述節奏。無風聲、腳步聲或其他物理動作聲。 non_diegetic_music: N/A

Other metadata

cfgScale:1
steps:8
sampler:Euler
seed:560

Discussion