2026年9月15日,生数科技正式发布视频大模型产品Vidu S2,发布当日即全量开放在线体验。本次共推出S2-Avatar、S2-Editing两款细分模型,分别面向持续交互数字角色生成、输入视频流实时编辑两大场景,在交互响应、分辨率、多场景适配等维度均实现了能力升级。
本次推出的两款模型各有明确的场景定位,其中S2-Avatar面向持续交互数字角色生成场景,将实时输出分辨率提升至720P,同时支持用户在互动过程中随时加入新的参考图,让生成角色能够持续响应新的指令和视觉信息。
另一款S2-Editing则面向输入视频流实时编辑场景,可针对持续输入的视频流进行实时处理,支持修改视频中的风格、服装、人物、背景等多类内容。
除了实时生成与编辑能力之外,Vidu S2还进一步探索了空间视频相关能力。据介绍,该模型可以将实时生成或实时编辑的视频转换为左右眼格式的视频,支持通过VR头显直接观看。
具体落地场景上,S2-Avatar生成的数字角色可以在持续互动过程中以空间视频形式呈现;现实世界采集的视频流也可以通过S2-Editing实时修改后,再转换为空间视频格式输出。
从能力演进路径来看,Vidu S2将视频模型的能力边界从传统的单次生成,进一步扩展至对持续视频流的实时处理,目前已经覆盖实时生成、实时编辑以及空间视频三大类场景。
本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。