关于 Vidu
从参考图到一致性视频
Vidu 是北京生数科技股份有限公司联合清华大学发布的中国首个长时长、高一致性、高动态性视频大模型,基于团队 2022 年 9 月全球首创的 U-ViT 融合架构打造。Vidu 于 2024 年 4 月在中关村论坛首次发布,同年 7 月全球上线,目前提供网页版、App 与 API 服务。
Vidu 最具辨识度的能力是全球首个「参考生视频」:上传 3 张以上参考图,模型会依据提示词融合多个视觉元素生成连贯视频;也可上传同一人物或物体的多个角度(最多 7 张)以确保主体一致性。配合「主体库」把角色、道具与场景保存下来一键复用,显著改善了 AI 视频里角色漂移的老问题。
生数科技成立于 2023 年 3 月,由瑞莱智慧、蚂蚁集团与 BV 百度风投联合孵化,创始团队均具清华背景,创始人兼首席科学家朱军现任清华大学人工智能研究院副院长。2026 年 1 月发布的 ViduQ3 覆盖文生、图生与参考生三大能力,发布之初曾在 Artificial Analysis 视频生成榜单位列第二。
核心功能一览
六大核心能力,覆盖创作全流程
参考生视频
全球首个参考生视频功能,让创作的角色、物体与场景在视频中始终保持一致。
多主体一致性
最多上传 7 张主体图片,确保人物、物体与场景在整段视频中稳定不漂移。
主体库复用
把角色、道具和场景保存进主体库,一键选择参考主体,提升效率与出片质量。
图生视频与首尾帧
任意图片可动态呈现;上传首帧与尾帧后,Vidu 自动填充流畅过渡。
动漫画质出色
高品质动漫动画视频,角色动作自然流畅,也支持漫画图片直接转为动画。
极速生成与模板
最快 10 秒出片;模板库提供亲吻、拥抱、万物生花、AI 换装等爆款玩法。
零基础快速上手
4 步完成你的第一件 AI 作品,无需任何设计经验
注册登录
访问 vidu.cn 注册并登录,进入创作台查看文生、图生与参考生入口。
选择生成方式
按需求选择文生视频、图生视频、首尾帧或参考生视频四种创作模式。
上传参考主体
参考生视频下上传 3~7 张主体图片,或直接从主体库选择已保存的角色与道具。
配置模型与 画质
选择 ViduQ3 等模型系列,设定清晰度(540p/720p/1080p)与时长后生成。
套用模板或接 API
可直接套用模板库爆款玩法,或在 platform.vidu.cn 接入 API 做批量生产。

常见问题解答
遇到问题?这里可能有你想要的答案
Vidu 是什么?
Vidu 是北京生数科技股份有限公司联合清华大学发布的中国首个长时长、高一致性、高动态性视频大模型,可将文本和图片转化为高质量视频,支持文生视频、图生视频与参考生视频。
参考生视频和图生视频有什么区别?
图生视频是让一张静态图动起来,可自定义首尾帧;参考生视频则允许上传 3 张以上参考图,由 Vidu 融合多个视觉元素生成视频,并可用同一主体的多角度图确保一致性。
Vidu 有免费额度吗?
官网提供错峰模式无限积分,可在错峰时段无限次免费生成视频;高峰时段与高画质需消耗积分或订阅,具体以官网为准。
支持 API 接入吗?
支持。开放平台 platform.vidu.cn 提供 ViduQ3、ViduQ2、ViduQ1 与 Vidu2.0 等模型的 API,并覆盖图像生成、音频生成与实时数字人能力。
同类对比
和同类工具横向对比,帮你选对工具。
| 对比维度 | Vidu | 可灵 AI | 即梦 AI | Runway |
|---|---|---|---|---|
| 厂商 | 生数科技 | 快手 | 字节跳动 | Runway |
| 架构 / 模型 | U-ViT / ViduQ3 | 可灵系列 | Seedance | Gen 系列 |
| 主体一致性 | 参考生视频,最多 7 图 | 较强 | 较强 | 中等 |
| 单次时长 | 1~16s | 按套餐 | 按模型 | 按套餐 |
| 特色能力 | 主体库 / 实时数字人 | 人物质感 | 全模态一站式 | 导演级运镜控制 |
同类推荐工具
发现更多优质 AI 创作工具,找到最适合你的那一款
剪映 CapCut
CapCut(剪映海外版)是字节跳动出品的免费视频编辑器,融合多轨剪辑与 AI 工具——自动字幕、文生视频、AI 数字人、配音克隆,跨 Web/桌面/移动端云同步。
Hailuo AI
Hailuo AI 是 MiniMax 旗下的 AI 视频生成平台,支持文生视频与图生视频,以流畅的物理运动、Omni Reference 一致控制与更低的价格,成为 2026 年高性价比视频生成代表。
HeyGen
HeyGen 是用 AI 数字人快速生成专业视频的平台,无需摄像与演员,支持 175+ 语言翻译对口型与上千个数字人形象。
即梦 AI
即梦 AI 是字节跳动剪映团队推出的一站式 AI 视觉创作平台,搭载自研 Seedream 图片模型与 Seedance 视频模型,支持文/图生图、文/图生视频、智能画布与数字人。