生数科技发布Vidu S2视频大模型 支持实时编辑与头显适配

2026年9月15日,生数科技正式推出全新Vidu S2视频大模型系列,涵盖面向持续交互数字角色生成的Vidu S2-Avatar、面向输入视频流实时编辑的Vidu S2-Editing两大核心模型,同时同步探索VR头显实时空间视频生成与编辑能力,项目全链路研发由生数科技流式视频生成与推理负责人张金涛主导。

两大核心模型覆盖不同应用需求

本次推出的Vidu S2是生数科技在视频大模型赛道的最新产物,两款核心模型分别指向不同的商用场景:Vidu S2-Editing主打视频流实时编辑能力,可针对用户输入的实时视频流完成快速修改操作,大幅降低视频二次创作的技术门槛;Vidu S2-Avatar则聚焦数字人交互场景,解决此前数字人动作僵硬、交互自由度低的痛点。

数字角色交互能力实现关键升级

据公开信息,Vidu S2-Avatar实现了从语音持续控制到更高交互自由度的跨越。用户仅需上传一张角色图片,即可通过文本或语音指令与生成的数字角色互动,模型不仅可以精准匹配说话时的表情与姿态动作,还新增了舞蹈等大幅度动作的指令跟随能力。
更为重要的是,该模型支持在视频流生成的任意时刻,动态加入物品、服装或背景参考图,可直接实现角色在互动过程中拿起指定物品、换上指定服装或切换至新场景的效果,无需中断生成流程重新调整参数。

前瞻布局VR内容生成场景

除了两款已落地的核心模型之外,生数科技本次还同步披露了其在VR内容生产领域的探索方向,正在研发面向VR头显的实时空间视频生成与编辑能力,为后续VR场景下的内容生产做技术储备。
本次Vidu S2系列的全链路研发工作,由朱军教授的博士生、生数科技流式视频生成与推理负责人张金涛牵头完成。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。