Google Gemini Omni Flash 1.1 文生影片是 Google 原生多模態影片生成模型的正式版,會先思考畫面安排再輸出影片,並同步生成配樂、環境音或對白等原生音訊,擅長把文字描述轉成流暢自然的短影片。使用時以中文或英文描述想要的場景、主角動作、運鏡與聲音,AI 會生成 mp4 短片並附上下載連結。輸入框上方的控制面板可選擇解析度(預設 720P,或選 1080P、4K,兩者由 720P 放大)與長寬比(16:9 橫式或 9:16 直式)。也可以上傳一張 PNG 或 JPG 圖片作為參考(圖生影片),例如上傳商品照再描述鏡頭環繞效果,影片就會以這張圖為基礎演進;上傳兩張圖片時,可在提示中說明要從第一張畫面過渡到第二張畫面(首尾幀插補),或說明兩張圖各是哪個主體或角色(主體參考),由模型依提示決定用法;一次最多取兩張參考圖。也可以上傳一部 10 秒以內的 MP4 影片作為來源,描述要修改的內容(影片編輯)或要求接續畫面往後延伸(影片延伸);一次只取一部影片,延伸只會接在影片結尾。支援連續對話(多輪編輯與延伸):影片生成後直接繼續輸入修改指令(例如把天空改成夕陽、放慢節奏),或要求接續這段影片往後延伸,AI 會接續前一部影片繼續處理,不需重新上傳;若上傳新圖片或新影片則改以新素材重新生成。生成屬雲端推論,通常需要一到三分鐘,解析度越高耗時越久,請耐心等候。適合製作社群短片、產品展示、分鏡預覽或創意動畫。若對畫面有具體要求,可在描述中加入 dolly zoom、slow motion 等電影術語,或明確描述光影、節奏與背景音樂,成品會更貼近想像。生成影片為 MP4 並含音訊,解析度預設 720P,可在面板選 1080P 或 4K(由 720P 放大),長寬比可選 16:9 橫式或 9:16 直式,影片長度由模型依提示內容自動決定(官方範圍約 3~10 秒)。 單次上傳總大小上限:256MB(全部檔案與訊息內容合計)。 可接受圖片格式:jpeg、jpg、png。 圖片數量上限:2 張。 單張圖片檔案大小上限:14MB。 單次訊息圖片總大小上限:14MB(文字與對話歷史共用同一請求容量,接近上限時仍可能被 AI 服務拒絕)。 圖片尺寸:每邊至少 300 像素。 圖片總像素上限:36,000,000 像素。 可接受影片格式:mp4。 影片數量上限:1 部。 單部影片檔案大小上限:14MB。 影片長度限制:1~10 秒(合計最多 10 秒)。 影片尺寸:每邊 64~4,096 像素。 影片總像素限制:4,096~9,437,184 像素。 影片長寬比限制:0.25~4.0。 影片幀率限制:1~120 fps。 輸出內容格式:影片 影片輸出:一部含音訊的 MP4 影片,解析度(預設 720P,可選 1080P/4K 放大)與長寬比(16:9 或 9:16)依面板選項,長度由模型決定(約 3~10 秒)。 支援連續對話。 AI可能會出錯,請查核重要資訊。