如何使用 多模態 AI 影片產生器
透過文字提示與圖片或參考影片,在統一的多模態工作流程中產生 AI 影片。
- 視覺參考 在提示詞中使用 <Picture 1>、<Video 1> 和 <Audio 1>。點擊標籤即可插入。影片僅供畫面與動作參考,請另外上傳聲音。
- 影片描述 描述場景、動作和想要的視覺效果...
- 開始處理 執行工具並讓它處理檔案。
- 下載結果 完成!您的 AI 生成影片已可供下載。
人們為何使用這個工具
- 提示詞和結果不會被儲存。
- 匿名且私密。
- 採用高級 AI 模型。
- 快速又簡單的工作流程。
FAQ - 多模態 AI 影片產生器
- 什麼是多模態 AI 影片生成?這項工具是如何運作的?
- 多模態 AI 影片生成將具體詳盡的文字提示詞與視覺、聽覺參考素材(圖片、影片與音訊)相互結合。不同於僅依賴文字或單張靜態照片,AI 模型能同步解析多重媒體輸入,從而在高畫質影片中精準掌控人物特徵、鏡頭運鏡、畫面構圖、光影層次與情境氛圍。
- 如何在提示詞中使用 <Picture 1>、<Video 1> 與 <Audio 1> 等參考標籤?
- 上傳參考檔案後,系統會自動編號。在文字提示詞中,您可以鍵入 <Picture 1>、<Video 1> 或 <Audio 1> 標籤,亦可點擊標籤徽章快速插入。清楚告知 AI 各素材的具體指引,例如:「<Picture 1> 的人物穿梭在街道上,並呈現 <Video 1> 的動態鏡頭運鏡」。影片素材引導畫面節奏與動作,音訊則提供聽覺氛圍指引。
- 上傳支援哪些檔案格式與大小限制?
- 您最多可上傳 3 張圖片(JPG、PNG 或 WebP,每張上限 10 MB)、1 部參考影片(MP4、WebM 或 MOV,長度 2–10 秒,上限 30 MB)以及最多 2 首音訊檔案(MP3、WAV、M4A、FLAC 或 OGG,每首上限 10 MB)。所有上傳參考檔案的合計總大小不可超過 32 MB。
- 與傳統的文字轉影片或圖片轉影片有何不同?
- 傳統文字轉影片須全憑文字推測畫面,細節容易飄忽不定;圖片轉影片通常僅能讓單一圖片產生微幅動態。多模態生成融會兩者優勢:透過圖片鎖定角色外貌,透過參考影片指定鏡頭運動與動作節奏,再以提示詞和音訊精確微調,達到極致的視覺連貫性與創作主導權。
- 生成影片的長寬比與解析度是如何決定的?
- 工具會根據您上傳的圖片或影片參考素材自動調整最佳長寬比,確保構圖完整;您也能在設定中自行挑選常用標準比例,包括寬螢幕(16:9)、適用於 Reels、TikTok 與 Shorts 的直向格式(9:16)、正方形(1:1)或 4:3。
- 生成影片需要消耗多少點數(Credits)?如何計費?
- 價格由伺服器計算:沒有影片參考時,費用為 90 Credits,加上超過 3 秒後每個已開始的額外秒數 5 Credits;至少包含一張圖片加 10 Credits,每個獨立音訊參考加 5 Credits。有影片參考時,費用為 150 Credits,加上超過 3 秒後每個已開始的額外秒數 10 Credits;至少包含一張圖片加 5 Credits,每個音訊參考加 5 Credits。時長為 3–10 秒。例如,附影片參考的 10 秒影片為 220 Credits。開始前按鈕會顯示確切價格;要求失敗或取消不會扣除 Credits。
- 影片製作需時多久?輸出的檔案格式是什麼?
- 由於多模態 AI 需同時運算與融合多種媒體素材,生成時間通常落在 2 至 4 分鐘之間。完成的影片以高品質 MP4 格式輸出,可直接於網頁內建播放器中預覽,並無損儲存至您的裝置。
- 我可以將生成的 AI 影片用於商業用途嗎?
- 可以。依據我們的服務條款,所有透過進階點數製作的影片皆可自由運用於商業專案、社群平台、YouTube、廣告行銷及客戶託託委託之作品中。
- 我的數據和生成的媒體會被存儲嗎?
- 不會。為了保護您的隱私,所有上傳的媒體和提示都會臨時傳輸以進行處理,並在完成後立即刪除。雲端不會進行永久存儲。您的歷史記錄和所有生成的結果均專有地保存在您自己裝置的瀏覽器本機。