从"抽卡等结果"到"像改PPT一样实时改画面"
9月中旬,生数科技在Hugging Face发布实时视频生成模型Vidu S2,支持720p分辨率、25-42FPS实时输出,并同步放出在线演示与API。其中S2-Avatar可从一张图片生成实时交互数字人,对话中动态注入参考图更新角色、服装与道具;S2-Editing可对连续视频流做实时文字驱动的风格迁移、虚拟试穿、角色替换与背景替换。训练中加入独舞与2D/3D动画数据,强化全身动作跟随。
"实时"两个字,被行业低估了
对短剧行业,"实时"的意义远超技术炫技。过去做一集漫剧,要在提示词、生图、生视频之间反复抽卡等待,创作反馈循环以"小时"计;Vidu S2把这条链路压到"秒"级,试错成本随之崩塌。更关键的是,它首发即开源,等于把军备门槛又拉低一截——接下来比的是谁先用实时管线做出新形态内容。
三条产品线同时被打开
S2同时触碰了真人互动直播、数字人剧、头显内容三条赛道。S2-Avatar的实时交互数字人,让"观众对话驱动剧情"从概念走向可用;S2-Editing的实时风格迁移,让后期从工序变成现场创作;首发实时空间视频方案,可为头显生成双目立体画面,直接对接沉浸式内容需求。对漫剧与仿真人剧生产,这些是底层生产工具级的升级。
结语
Vidu S2的出现,标志着AI视频从"生成一段"迈向"生成一条流"。当画面能随对话和指令实时变化,短剧的创作范式会被重写——导演不再等结果,而是和模型一起演。