Techub News 消息,谷歌發佈原生多模態視頻生成與編輯模型 Gemini Omni 1.1 Flash。該版本支持基於最長10秒上下文進行場景擴展,總擴展時長可達40秒,並能通過固定首尾幀控制攝像機運動。用戶可提供視頻片段作為參考以保持角色一致性,並支持以360p分辨率快速生成草稿,再升級至4K輸出。 模型通過 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 提供,Adobe、Figma Weave、GMI Cloud 和 Runway 已作為生産用戶接入。輸入視頻代幣成本為每百萬1.5美元,視頻輸出代幣成本為每百萬17.5美元,720p視頻生成成本約為每秒0.1美元。所有生成視頻均帶有 SynthID 水印。(MarkTechPost)
内容來源:TECHUB NEWS
更多精彩內容,請登陸
財華香港網 (https://www.finet.hk/)
現代電視 (http://www.fintv.com)