最長 30 秒的連續敘事
從 2 秒動態素材到 30 秒完整鏡頭都能彈性設定。較長時長適合安排動作起承轉合、產品展示流程或逐步變化的環境氛圍,減少多段生成後再拼接的需求。
上傳圖片並描述你想要的動作、鏡頭與氛圍,使用 Wan 3.0 生成最長 30 秒、最高 1080p 的高品質 AI 影片。
Wan 3.0 需要上傳圖片才能生成影片,暫時不支援純文字生成。

Wan 3.0 是 Wan 系列的新一代 AI 影片模型,強化長鏡頭敘事、畫面一致性與影音表現。它能理解參考素材和提示詞之間的關係,讓創作者更具體地控制主體動作、鏡頭運動、場景變化與節奏。
LitVideo 目前提供 Wan 3.0 圖片轉影片模式。你可以從起始圖片建立動作與鏡頭,也能加入結束畫面指定影片最後到達的構圖,生成最長 30 秒、最高 1080p 的 AI 影片。
上傳起始圖片,並可加入結束畫面。
依照內容節奏選擇更短片段或完整長鏡頭。
支援 480p、720p 與 1080p 輸出。
可依需求開啟聲音效果,讓畫面更有臨場感。
一張好的參考圖片決定人物、產品和場景的視覺基礎;Wan 3.0 再依照提示詞延伸時間、動作、運鏡與聲音。
從 2 秒動態素材到 30 秒完整鏡頭都能彈性設定。較長時長適合安排動作起承轉合、產品展示流程或逐步變化的環境氛圍,減少多段生成後再拼接的需求。
依照測試、社群發佈或後期剪輯需求選擇 480p、720p 或 1080p。先用較低畫質確認動作方向,再用 1080p 生成定稿,可以更有效率地安排創作流程。
只上傳起始圖片時,Wan 3.0 會依提示詞延伸畫面;加入結束圖片後,還能指定鏡頭最後的構圖、人物位置或產品狀態,讓轉場方向更明確。
開啟聲音選項後,可讓生成內容同時包含與場景氛圍相符的聲音。提示詞可描述雨聲、腳步聲、環境聲或其他聽覺元素,讓影片更有臨場感。
從一張清楚的產品圖片開始,用提示詞指定運鏡、光線與環境變化,Wan 3.0 便能生成連續流暢的產品影片。
參考圖片
提示詞
生成影片
選擇主體清楚、構圖完整的圖片。若要指定結尾構圖,可在完整編輯器中加入結束畫面。
寫下主體如何移動、相機如何運鏡、光線如何變化,以及哪些人物或物件必須保持一致。
依用途選擇影片秒數與 480p、720p 或 1080p,再開始生成並預覽結果。
提示詞不需要重複描述圖片中已經清楚呈現的內容,重點是說明接下來會發生什麼,以及攝影機要如何記錄這段變化。
推薦提示詞公式
主體動作 + 鏡頭運動 + 環境變化 + 光線與氛圍 + 一致性要求 + 影片時長
人物特寫
人物先看向鏡頭,接著輕輕微笑並將視線移向右側。鏡頭以非常緩慢的速度從胸像推近至臉部特寫,背景保持柔和散景,窗邊自然光微微變亮,頭髮隨風小幅擺動。保持五官、髮型和服裝一致,動作自然,電影感,10 秒。
適合肖像、角色概念圖與人物故事鏡頭。動作幅度不要過大,有助於維持臉部穩定。
產品展示
攝影機從產品正面開始,平滑向右環繞約 90 度,同時緩慢靠近。金屬邊緣出現細緻流動的高光,桌面反射自然變化,背景燈光由冷色逐漸轉為暖色。保持產品標誌、外形、比例與表面材質完全一致,商業廣告質感,8 秒。
適合電商主視覺、產品廣告和品牌社群素材。提示詞要明確列出不能改變的產品細節。
風景場景
鏡頭沿著湖面低速向前移動,遠方山谷的薄霧逐漸散開,水面產生細微波紋,樹葉隨風輕柔晃動。清晨陽光從雲層後方慢慢照亮山脊,整體色調由偏冷轉為溫暖,保持地形和主要景物位置一致,平靜而電影化,15 秒。
適合概念場景、旅遊內容和情緒影片。長時長中只安排一到兩個主要變化,節奏會更穩定。
首尾幀轉場
從起始畫面的鉛筆建築草圖開始,線條逐步增加細節並轉化為真實建築材質。攝影機保持相同視角緩慢推進,牆面、玻璃與周圍景觀依序成形,最後自然抵達結束畫面的完整建築效果。轉換連續流暢,保持透視、構圖與建築輪廓一致,12 秒。
適合前後狀態明確的轉場,例如設計稿到成品、白天到夜晚或產品包裝變化。
首幀決定影片從哪裡開始,尾幀則為生成過程提供明確終點。是否需要兩張圖片,取決於你想控制的是動作方向,還是完整的畫面轉換。
讓 Wan 3.0 依照一張圖片和提示詞自由延伸動作、運鏡與環境變化。提示詞應聚焦描述圖片之後發生的內容,不必指定固定終點。
適合: 人物微動、產品環繞、景物動畫,以及需要保留更多生成空間的鏡頭。
用兩張構圖相容的圖片定義影片開頭與結尾,再由提示詞說明中間如何發生變化。起始與結束圖片比例應保持一致,主體位置差異也不宜過大。
適合: 前後狀態轉換、指定運鏡終點、角色位置變化,以及具有明確結果的敘事。
從產品展示到角色表演,使用明確的起始畫面可以讓生成方向更可控。
讓靜態商品產生環繞運鏡、材質反光與自然環境動態,同時保持外觀與比例穩定。
為肖像、角色設計或故事分鏡加入細微表情、身體動作和連續鏡頭。
延伸概念圖中的天氣、光線與空間動態,建立更完整的情緒和敘事節奏。
將主視覺轉成更吸睛的 Reels、Shorts、產品廣告或活動預告片段。
兩款模型都能製作高畫質 AI 影片,但在 LitVideo 的可用模式中,Wan 3.0 更適合需要較長時長與彈性畫質的圖片轉影片工作。以下規格以 LitVideo 目前提供的模型設定為準。
比較項目
Wan 3.0
Wan 2.7
LitVideo 輸入方式
圖片轉影片、首尾幀
文字轉影片、圖片轉影片與參考素材模式
影片長度
2–30 秒
2–15 秒
輸出畫質
480p、720p、1080p
720p、1080p
適合場景
較長敘事、完整產品展示與首尾畫面轉場
較短鏡頭、文字起稿與多種輸入工作流程
先確認參考圖片、影片時長和輸出用途,再開始生成,可以減少不必要的重試並讓結果更貼近預期。
選擇主體完整、細節清楚、沒有大面積遮擋的圖片。人物臉部、產品標誌或關鍵物件越明確,提示詞就越容易聚焦在動作與鏡頭。
單一動作或簡單運鏡可先使用較短時長;需要多階段變化、較慢節奏或首尾幀轉場時,再提高到 10–30 秒。避免在短時間內安排過多事件。
Wan 3.0 會依輸出畫質與影片秒數計算所需點數。調整設定時,生成器會顯示目前的點數需求,確認後再開始生成即可。
Wan 3.0 是 Wan 系列的新一代 AI 影片模型。LitVideo 目前提供圖片轉影片工作流程,讓你從參考圖片生成最長 30 秒的動態影片。
目前不支援純文字轉影片。請先上傳一張圖片,再用提示詞描述動作、運鏡、光線和影片氛圍。
LitVideo 上的 Wan 3.0 支援 2 到 30 秒影片。你可以依照鏡頭複雜度、敘事節奏和使用情境選擇長度。
目前可選擇 480p、720p 或 1080p。需要發佈或進一步剪輯時,建議選擇 1080p。
可以。起始圖片用來建立主體與構圖,加入結束畫面則能進一步指定鏡頭最後要到達的狀態。
聚焦描述畫面中要發生的變化,包括主體動作、相機運動、環境反應、光線和節奏;同時說明哪些人物、產品或背景細節必須保持一致。
使用 LitVideo 的 Wan 3.0 生成影片會消耗點數,所需點數取決於影片秒數與 480p、720p 或 1080p 畫質設定。生成器會在開始前顯示目前的點數需求。
建議使用主體完整、畫面清楚且構圖穩定的圖片。若是人物或產品,請避免關鍵細節被遮擋;若同時使用首尾幀,兩張圖片應採用相同長寬比並維持主體外觀一致。
在 LitVideo 目前的設定中,Wan 3.0 圖片轉影片最長可生成 30 秒,並提供 480p、720p 與 1080p;Wan 2.7 最長 15 秒,提供 720p 與 1080p,另外支援文字轉影片及參考素材模式。
可以。開啟聲音選項後,Wan 3.0 能依照生成內容製作相符的聲音。你也可以在提示詞中描述環境聲、腳步聲、雨聲或其他需要呈現的聽覺元素。
