ChengRang
EN

Vidu S2 热门 新增

AI 视频工具 免费试用
本页为 Vidu 的版本 / 子产品详情。查看 Vidu 总览 →

生数科技 2026/9/15 发布(距 Vidu S1 仅 69 天)的实时视频双模型,发布即全量开放体验:S2-Avatar 把数字角色实时输出从 540P 提到 720P、25-42 FPS,支持生成过程中随时递入物品/服装/场景参考图并保持持物状态;S2-Editing 对输入视频流实时换风格/虚拟试穿/换角色/换背景;另探索面向 VR 头显的空间视频

生数科技 实时交互 实时编辑 数字人 空间视频
访问 Vidu S2 官网

免责声明:测评内容仅代表编辑个人观点和使用体验,不构成任何商业推荐或投资建议。产品信息和价格可能随时变动,请以官方最新信息为准。

产品简介

Vidu S2 是生数科技于 2026 年 9 月 15 日发布的实时视频模型,距离 Vidu S1 发布仅 69 天,包含两个模型:面向持续交互数字角色生成的 Vidu S2-Avatar,以及面向输入视频流实时编辑的 Vidu S2-Editing。发布当天即全量开放网页体验与 API,不需要申请早期体验名额。

S2-Avatar 相比上一代的提升集中在三处:实时输出从 540P 提升到 720P,帧率 25 至 42 FPS;支持在视频流生成过程中随时递入新的参考图,让角色拿起指定物品、换上指定服装或进入新场景;动作能力从以说话为主扩展到独舞、2D 与 3D 动画等全身大幅度动作。这类交互还涉及动作完成后的状态保持,例如「拿起杯子然后微笑」要求角色在微笑时继续持杯,模型通过 VLM Agent 读取用户指令并按时序检查输出帧,判断动作是已完成、部分完成还是偏离要求,再调整后续提示词。

S2-Editing 接收持续输入的视频流,用一条文本指令加一张可选参考图完成四类实时编辑:风格迁移、虚拟试穿、人物替换与背景替换。人物抬手、转身或镜头移动时,编辑结果需要跟随这些变化,底层依靠帧对齐稀疏注意力,让目标帧只读取源视频同一时刻的画面,避免不同时刻的动作信息互相干扰。

两个模型之上,生数科技还把探索延伸到了空间视频:把实时生成或实时编辑的画面转换为左右眼有视差的同步视图,流式传输到 VR 头显,用于空间视频中的角色互动与画面编辑。目前以固定视角的双目视频为主,全景空间视频仍在探索阶段。整条实时链路的技术路线由生数科技流式视频生成与推理负责人张金涛(朱军教授博士生)负责。

核心功能

适合谁用

以下类型的用户会特别受益于 Vidu S2:

优点亮点

价格与方案

网页体验入口为 vidu.com/vidu-stream,API 通过 platform.vidu.com 的 Vidu S2 文档接入。计费按模型与调用方式区分,实时数字人可选择包含语音识别、语言模型、语音合成与实时通信的整套服务,也可使用组件模式接入已有语音系统;离线生成走异步接口。具体单价与新用户额度以官网与 API 平台公告为准。

总结与建议

Vidu S2 把视频生成从生成一段内容推进到实时操控一条持续运行的视频流,两条线各有明确场景:S2-Avatar 面向实时数字人交互,S2-Editing 面向实时视频编辑。相比 Vidu S1,这一代的变化不只是分辨率从 540P 到 720P,控制对象从固定数字人扩展到动态参考图与完整视频流,动作能力扩展到全身表演,还多了一步面向 VR 头显的空间视频探索。做直播、虚拟试穿、实时虚拟拍摄或短剧素材批量派生的团队,值得从 Day 1 直接上手测试;如果需求只是离线生成一段成片,Vidu Q3 这类成熟的成片模型仍是更省事的选择。

版本演进

分类
AI 视频工具
价格
免费试用
标签
生数科技 · 实时交互 · 实时编辑
官网