如何使用 多模態 AI 影片生成器

透過文字提示及圖片或參考影片,在統一的多模態工作流程中生成 AI 影片。

  1. 視覺參考 在提示詞中使用 <Picture 1>、<Video 1> 和 <Audio 1>。點擊標籤即可插入。影片僅用作畫面及動作參考,請另外上傳聲音。
  2. 影片描述 描述場景、動作和想要的視覺效果...
  3. 開始處理 運行工具並讓它處理檔案。
  4. 下載結果 完成!您經 AI 產生的影片已準備好可供下載。

為甚麼人們使用此工具

  • 提示詞和結果不會被儲存。
  • 匿名且私密。
  • 採用高級 AI 模型。
  • 快速簡單的工作流程。

FAQ - 多模態 AI 影片生成器

咩係多模態 AI 影片生成?呢個工具有咩運作原理?
多模態 AI 影片生成將具體嘅文字提示詞同影像、聲音參考材料(圖片、影片同音訊)融合埋一齊。比起單靠純文字或者一張相,AI 模型可以同時分析多種媒體輸入,精準控制人物外貌、鏡頭走位、場景構圖同氣氛,製作出高畫質又連貫嘅影片片段。
點樣喺提示詞入面用 <Picture 1>、<Video 1> 同 <Audio 1> 呢類參考標籤?
上載參考檔案之後,系統會自動按順序編號。喺文字提示詞入面,你可以直接打 <Picture 1>、<Video 1> 或 <Audio 1> 標籤,或者撳吓標籤徽章插入。清楚話畀 AI 知每份素材嘅作用,例如:「<Picture 1> 嘅主角喺街度行,並跟隨 <Video 1> 嘅動態運鏡」。影片參考主要引導畫面動作,音訊就帶動整體聲音氛圍。
上載支援咩嘢檔案格式同容量限制?
你最多可以上載 3 張圖片(JPG、PNG 或 WebP,每張上限 10 MB)、1 條參考影片(MP4、WebM 或 MOV,長度 2–10 秒,上限 30 MB)同最多 2 個音訊檔案(MP3、WAV、M4A、FLAC 或 OGG,每個上限 10 MB)。全部參考檔案加埋嘅總容量唔可以多過 32 MB。
同平時嘅文字轉影片或者圖片轉影片有咩分別?
普通文字轉影片要 AI 單靠文字估畫面,出嚟嘅效果容易走樣;圖片轉影片多數只係將一張相微微動態化。多模態生成結合咗兩者嘅長處:用相片固定主角特徵,用參考片鎖定運鏡同節奏,再配合文字提示同聲音微調,畫面一致性同控制度高好多。
生成影片嘅長寬比同解像度點樣決定?
工具會根據你上載嘅相片或影片參考自動配合最適長寬比,確保構圖唔會變形;你亦可以喺設定入面手動揀標準比例,例如闊螢幕(16:9)、啱晒 Reels/TikTok/Shorts 嘅直倒(9:16)、正方形(1:1)或者 4:3。
生成一條片要幾多 Credits?收費係點計?
價格由伺服器計算:沒有影片參考時,費用為 90 Credits,加上超過 3 秒後每個已開始的額外秒數 5 Credits;至少包含一張圖片加 10 Credits,每個獨立音訊參考加 5 Credits。有影片參考時,費用為 150 Credits,加上超過 3 秒後每個已開始的額外秒數 10 Credits;至少包含一張圖片加 5 Credits,每個音訊參考加 5 Credits。時長為 3–10 秒。例如,附影片參考的 10 秒影片為 220 Credits。開始前按鈕會顯示確切價格;要求失敗或取消不會扣除 Credits。
生成一般要幾耐?輸出係咩格式?
由於多模態 AI 需要同步計算多組媒體內容,處理時間通常需要約 2 至 4 分鐘。完成後會輸出高質素 MP4 檔案,可以直接喺瀏覽器播放器即時預覽,仲可以無損下載落你嘅裝置。
生成出嚟嘅 AI 影片可以用喺商業用途嗎?
可以。根據我哋嘅服務條款,所有用 Premium Credits 生成嘅影片都可以自由運用喺商業項目、社交平台、YouTube、宣傳廣告同客戶專案入面。
開的數據和生成的媒體會被存儲嗎?
不會。為了保護您的隱私,所有上傳的媒體和提示都會臨時傳輸以進行處理,並在完成後立即刪除。雲端不會進行永久存儲。您的歷史記錄和所有生成的結果均專有地保存在您自己裝置的瀏覽器本機。

測試版多模態 AI 影片生成器

圖片
0/3
影片
0/1
音訊
0/2
音訊
使用我們的工具即表示您同意我們的服務條款隱私政策

此工具暫時無法使用

此工具已暫時關閉,很快就會恢復。在此期間,你可以使用我們其他的工具。