Generation data
COPY ALL
Resources used
Prompt
External Generator
subject_definitions:
<Subject 1> 是來自
的人物,其外貌、服裝與姿態完全保留該圖特徵,作為目標視頻中唯一可視角色。
<Subject 2> 是畫面上方中央的雲狀對話氣泡,粗黑邊白底,內部以英文手寫字呈現文字內容。
僅作為 <Subject 1> 的外貌來源,不提供時間線或分鏡結構。
僅作為 (S1) 的語氣與音調參考,不對白內容進行複製。
summary:
[reference generation + audio reference] 目標視頻在 5 秒內呈現一名角色面對鏡頭口述更新資訊,同時畫面頂部中央浮現對話氣泡同步顯示文字。視覺風格緊貼
的人物特徵,語調與節奏參照
但不複製原始語音內容。
retention_analysis:
<Subject 1>(出現於 [Shot 1]):fully_preserved - 外貌、服裝、姿態與表情完全沿用
的視覺特徵。
<Subject 2>(出現於 [Shot 1]):fully_preserved - 形狀、邊框、底色與內部文字樣式完全保留。
(人物外觀來源):fully_preserved - 所有可見視覺屬性無損遷移至目標人物。
:weak_reference - 僅參考語氣、音調與節奏特徵,不對白內容進行複製。
detailed_description:
畫面呈現一位清晰可辨的人物正對鏡頭,背景為中性色調的靜態環境,光線均勻柔和,營造專業且自然的講述氛圍。人物從畫面中央開始說話,語氣流暢自然,節奏適中。
[Shot 1] At 00:00.000, 畫面以中近景構圖呈現 <Subject 1>,她(S1)面向鏡頭,口型同步運動說:<d>[English]"Simple workflow for Minimax H3 updated"</d>。語氣與節奏參照
的語調與音高變化,但不複製原始音頻信號。同時,<Subject 2> 從畫面頂部中央位置向上彈出,以雲狀對話氣泡形態浮現,粗黑邊框、白色底面,內部以英文手寫字體顯示 "Simple workflow for Minimax H3 updated.",文字內容與人物口述同步展開。
整體畫面維持固定機位,無明顯運鏡動作,僅有輕微的呼吸式微動以增強真實感。聲音方面,人物語音清晰可辨,無背景雜音干擾,語速與情緒表達與
保持一致但為重新演繹的語音。畫面中無其他可視元素或動態變化,結尾時人物保持說話姿態,對話氣泡完整顯示於畫面上方。
overall_soundscape:
環境中無明顯背景音,僅有清晰的人聲語音作為主要聲音元素。語音乾淨無雜音,語速穩定,語氣自然,符合日常講述節奏。無風聲、腳步聲或其他物理動作聲。
non_diegetic_music:
N/A
Other metadata
cfgScale:1
steps:8
sampler:Euler
seed:560
Discussion


