谷歌AI近期正式推出多模态大模型更新版本Gemini Omni 1.1 Flash,面向视频生成场景新增三项核心能力:最长40秒的智能场景扩展、生成内容首尾帧自定义控制,以及原生4K分辨率超分处理,所有能力均已通过Gemini API面向开发者开放。该版本是谷歌在生成式AI视频赛道布局的重要产品,将大幅降低专业内容创作的技术门槛。

过去半年来,生成式AI视频工具的市场需求持续爆发,从UGC短视频创作到商业影视后期场景,从业者对生成内容的时长、可控性、清晰度的要求不断提升。此前多数商用视频生成模型最多支持20秒左右的输出,且帧级控制能力有限,分辨率大多停留在1080P级别,难以满足专业生产的标准化需求。
此次推出的Gemini Omni 1.1 Flash,核心升级全部围绕视频生成的痛点展开。
登录后解锁全文,体验收藏、点赞、评论等完整功能
立即登录