Google Gemini Omni Flash 文生影片

Google Gemini Omni Flash 原生多模態影片生成模型,由文字提示生成短影片,可上傳一張圖片作為參考(圖生影片),並支援連續對話多輪編輯。

Google Gemini Omni Flash 文生影片是 Google 原生多模態的影片生成模型,會先思考畫面安排再輸出影片,擅長把文字描述轉成流暢自然的短影片。使用時以中文或英文描述想要的場景、主角動作與運鏡,AI 會生成 16:9 的 mp4 短片並附上下載連結。也可以上傳一張 PNG 或 JPG 圖片作為參考(圖生影片),例如上傳商品照再描述鏡頭環繞效果,影片就會以這張圖為基礎演進;一次僅取一張參考圖。支援連續對話(多輪編輯):影片生成後直接繼續輸入修改指令(例如把天空改成夕陽、放慢節奏),AI 會接續前一部影片繼續編輯,不需重新上傳;若上傳新圖片則改以新圖重新生成。生成屬雲端推論,通常需要一到三分鐘,請耐心等候。適合製作社群短片、產品展示、分鏡預覽或創意動畫。若對畫面有具體要求,可在描述中加入 dolly zoom、slow motion 等電影術語,或明確描述光影與節奏,成品會更貼近想像。生成影片畫面尺寸為 720P(16:9 橫式),影片長度由模型依提示內容自動決定(官方範圍約 3~10 秒)。 單次上傳總大小上限:256MB(全部檔案與訊息內容合計)。 可接受圖片格式:jpeg、jpg、png。 單張圖片檔案大小上限:14MB。 圖片尺寸:每邊至少 300 像素。 圖片總像素上限:36,000,000 像素。 輸出內容格式:影片 影片輸出:一部 720P MP4 影片(16:9),長度由模型決定(約 3~10 秒)。