一、Vidu AI 是什么?
Vidu AI 由北京生数科技股份有限公司联合清华大学发布,是中国首个长时长、高一致性、高动态性的视频大模型(端到端文生视频大模型),官方口号 「让想象发生」。它能将文本和图片转化为高质量视频,支持文生视频、图生视频、参考生视频等模式,专为独立创作者与团队设计。Vidu 具备强大的语义理解与高级镜头运动设计能力,从低分辨率到高清 1080P 输出。

二、公司背景与融资
生数科技(Shengshu):由清华大学朱军教授团队于 2023 年创立,团队在多模态大模型与扩散概率模型领域积累深厚,提出自研无训练推理框架 Analytic-DPM 与全球最快采样算法 DPM-Solver。
融资:2024 年 3 月完成新一轮数亿元融资,由启明创投领投,达泰资本、鸿福厚德、智谱 AI 以及老股东 BV 百度风投、卓源亚洲跟投,主要用于多模态基础大模型迭代、应用产品创新与市场拓展。
三、核心产品功能
1. 文生视频
输入一段文字描述,即可生成电影级、动漫或写实风格的视频,画面质感支持到 8K/高清,具备强语义理解与镜头运动设计。
2. 图生视频
基于任意图片描述想象画面,即刻动态呈现;提供首尾帧功能(设定起始与结束帧)与漫画图片生成动画,让图片「动起来」。
3. 参考生视频(全球首个)
全球首个「参考生视频」功能,上传参考图即可让创作的角色、物体、场景始终保持一致,含多主体一致性与主体库能力,解决主体漂移难题。
4. 模板库
内置多样化模板,一键套用,快速创作。

四、Vidu Claw 与 Vidu S1
Vidu Claw:属于「雇佣 AI 创意员工」的智能体能力,输入想法即刻解锁无限场景,把复杂创作流程交给 AI 执行。
Vidu S1:官网导航中的新一代视频模型入口(Vidu S1),与 Vidu 2.0、Vidu Q3 等共同构成当前视频生成模型阵容;Vidu Q1 专注图片生成(极质体验)。
API 开放平台:面向企业与开发者,提供接口便于集成与自动化内容生产。
五、模型与技术
U-ViT 架构:采用 Diffusion 与 Transformer 融合的 U-ViT 架构,端到端训练,是 Vidu 的核心创新。
DPM-Solver / Analytic-DPM:全球最快采样算法与无训练推理框架,显著提升生成速度。
技术能力:具备模拟真实物理世界与丰富想象力,支持多镜头生成、时空一致性,长时长、高一致性、高动态性。
六、核心优势
极速生成:快速产出视频,大幅缩短创作周期。
流畅动漫画质:动画渲染流畅,画质出众。
主体一致性:参考生视频/主体库让角色、物体、场景保持一致。
错峰无限积分:在错峰时段可无限生成,配合新用户免费积分,低门槛上手。
语义理解强:理解复杂文本与镜头运动,出品更具电影感。
七、使用场景
社交媒体内容创作:快速产出短视频、创意镜头。
专业视频制作:预告片、宣传片、动画成片。
商业广告:高一致性的品牌视觉与角色。
个人创作:独立创作者、团队把想法变成作品。
八、怎么使用 Vidu AI?
访问官网:打开 vidu.com / vidu.cn,进入产品界面。
注册登录:新用户注册,即可获免费积分用于生成。
选择功能:根据需要选择文生视频 / 图生视频 / 参考生视频 / 模板库。
输入内容:输入文本描述,或用首尾帧、参考图设定主体与镜头。
生成与调优:可结合 Vidu Claw 智能体输入想法解锁场景,或用 API 开放平台自动化集成。
预览下载:预览满意后下载;错峰时段可享无限积分。
九、Vidu AI 常见问题(FAQ)
Q1:Vidu AI 是什么?
由北京生数科技联合清华大学发布的 AI 内容生产平台(中国首个长时长、高一致性、高动态性视频大模型),支持文生视频、图生视频、参考生视频与 Vidu Claw 智能体。
Q2:Vidu AI 是谁开发的?
北京生数科技股份有限公司联合清华大学;团队创始人朱军教授,提出 Analytic-DPM 与 DPM-Solver 加速框架。
Q3:Vidu AI 免费吗?
新用户可获得一定数量的免费积分,无需付费即可生成视频;并提供错峰无限积分与订阅套餐,具体额度与价格以官方为准。
Q4:Vidu AI 的「参考生视频」是什么?
全球首个参考生视频功能,上传参考图让角色、物体、场景始终保持一致,含多主体一致性、主体库与首尾帧能力。
Q5:Vidu AI 和 Sora 等有什么区别?
Vidu 是全球范围内首个攻克「一致性」难题的视频大模型,采用国产自研 U-ViT 架构,提供免费积分与错峰无限积分,并深度融入国内创作者与商业场景。
Q6:Vidu AI 能生成多长、多清晰的视频?
支持长时长视频生成,分辨率最高达 1080P/高清,亦可产出 8K 质感画面;具体时长与分辨率以当前版本与套餐为准。
Q7:Vidu Claw 是什么?
Vidu 的智能体能力,类似「雇佣 AI 创意员工」,输入想法即刻解锁无限创作场景,把复杂流程交给 AI 执行。
Q8:Vidu AI 适合哪些人?
社交媒体创作者、专业影视制作团队、商业广告品牌方,以及追求高效创作的独立创作者与团队。
十、结语:Vidu AI 的定位与价值
Vidu AI 的价值,在于用国产自研的视频大模型重新定义「AI 内容生产」:以 U-ViT 架构与 DPM-Solver 做到了高一致性、高动态性、长时长,用参考生视频与主体库攻克业界最难的主体漂移难题,靠 Vidu Claw 与 API 开放平台把创作流程交给智能体与开发者,再通过免费积分、错峰无限积分把门槛降到「人人可用」。对创作者而言,它是从想法到成片的加速器;对行业而言,它是AI 视频规模化落地的重要里程碑——正如它的口号:「让想象发生」。






