当地时间2026年8月27日,谷歌正式推出新一代视频生成AI模型Gemini Omni 1.1 Flash,最高支持4K超高清视频输出,在场景扩展、运镜控制、生成效率等维度实现全面升级,单次可扩展10秒视频,累计生成最长可达40秒,支持3秒参考片段维持画面一致性,主要面向开发者及专业内容创作者,推动多模态视频生成向高清长时方向演进。

近两年,全球大模型厂商的多模态能力竞争早已越过文本、图像的成熟赛道,转向视频生成这一技术门槛更高的细分领域。此前行业内已落地的视频生成模型普遍存在分辨率上限低、生成时长短、画面逻辑一致性差、运镜不可控等痛点,始终无法满足专业内容创作者的商用需求。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录