生数科技
Vidu
北京生数科技股份有限公司(ShengShu Technology) · 朱军(清华大学人工智能研究院副院长、教授,创始人/首席科学家)、唐家渝(联合创始人,现任总裁)、鲍凡(联合创始人)、骆怡航(2025年3月加盟,现任CEO,原字节跳动火


1 / 3 产品线9
底层架构
- 2022
U-ViT
全球首个 Diffusion+Transformer 融合框架,早于 DiT
Vidu 视频生成
- 2024
Vidu
中国首个 Sora 级视频大模型,最长 16 秒 1080P
- 2025
Vidu 2.0
10 秒内生成,成本降 55%,多主体一致性 92%
- 2025
Vidu Q1
高可控模型,VBench-1.0/2.0 双榜登顶
- 2025
Vidu Q2
图生视频进入演技生成时代,年底扩展生图全家桶
- 2026
Vidu Q3 Reference-to-Video
SuperCLUE 全球 R2V 榜第一
- 2026
Vidu S1
AR+Diffusion 架构,540P/42FPS 无限时长实时生成
世界行动模型
- 2026
MotuBrain
统一语言/视频/动作,两大国际榜单登顶
行业应用
- 2026
Vidu Claw
AI CMO,一句简报生成完整广告创意与素材
项目与产品时间线 15 个节点
- 2022
-
提出U-ViT扩散架构
全球首个Diffusion与Transformer融合框架,早于Sora所用的DiT。
-
- 2023
-
生数科技在北京成立
清华人工智能研究院朱军团队孵化,瑞莱智慧、蚂蚁集团与BV百度风投联合孵化。
-
完成近1亿元天使轮融资
蚂蚁集团领投,融资后估值约1亿美元。
-
- 2024
-
发布视频大模型Vidu
中国首个长时长高一致性视频大模型,一键生成最长16秒1080P视频。
-
完成数亿元Pre-A轮融资
百度、北京市人工智能产业投资基金领投。
-
Vidu海外商用版上线
首个实现商业化的产品,上线20天用户数突破百万。
-
- 2025
-
发布Vidu 2.0,进入秒级生成
10秒内生成单条片段,成本较行业均价降低55%,失败率降低80%。
-
骆怡航加盟出任CEO
原字节跳动火山引擎AI应用产品线负责人,唐家渝升任总裁。
-
发布高可控视频大模型Vidu Q1
4月全球上线后在VBench-1.0与VBench-2.0双榜登顶,超越Sora与可灵。
-
完成数亿元A轮融资
博华资本领投,百度战投、启明创投等老股东跟投。
-
Vidu Q2图生视频模型全球上线
面部微表情与运镜显著提升,提供闪电模式与影院模式。
-
- 2026
-
完成超6亿元A+轮融资
中关村科学城公司、星连资本领投。
-
近20亿元B轮融资,阿里云领投
首次系统提出“通用世界模型”战略;两个月累计融资26亿元,估值超120亿元。
-
发布世界行动模型MotuBrain
统一语言、视频与动作三模态,在WorldArena与RoboTwin 2.0双榜登顶。
-
发布实时交互视频模型Vidu S1
AR+Diffusion架构,支持540P/最高42FPS无限时长实时生成。
-
方向: 世界模型 / 视频生成 核心人物: 朱军(清华大学人工智能研究院副院长、教授,创始人/首席科学家)、唐家渝(联合创始人,现任总裁)、鲍凡(联合创始人)、骆怡航(2025年3月加盟,现任CEO,原字节跳动火山引擎AI应用产品线负责人) 机构: 北京生数科技股份有限公司(ShengShu Technology) 简介: 生数科技成立于2023年3月,由清华大学人工智能研究院朱军团队孵化,核心技术源自团队2022年提出的U-ViT(Diffusion+Transformer融合架构)。公司先以视频生成大模型Vidu对标Sora并多次登顶国际榜单,2026年起明确提出"通用世界模型"(General World Model)技术路线,将视频生成技术延伸至具身智能/机器人领域,推出世界行动模型MotuBrain,覆盖"数字世界生成"与"物理世界行动"两端。

关键成就
- 融资总额:天使轮(2023-06,近1亿元)→ Pre-A轮(2024-06,数亿元)→ A轮(2025-09,数亿元)→ A+轮(2026-02,超6亿元人民币)→ B轮(2026-04,近20亿元人民币/约2.93亿美元,阿里云领投),B轮后估值超120亿元人民币,两个月内累计融资约26亿元人民币。
- 技术指标:Vidu Q1于2025年4月在VBench-1.0与VBench-2.0双榜登顶;Vidu Q3据Artificial Analysis排名中国第一、全球第二,并在SuperCLUE全球首个Reference-to-Video榜单中排名第一;世界行动模型MotuBrain在WorldArena(63.77 EWM分)与RoboTwin 2.0(50项任务均分96.0)两项国际权威具身智能榜单登顶。
- 计划进展:2026年4月完成股份制改造(更名为"北京生数科技股份有限公司(未上市)"),拟以港交所18C章最快于2026年上半年启动港股IPO。
- 媒体报道: Alibaba leads $290m investment for Shengshu Vidu AI world model(CNBC,2026-04-10)
时间线(2022-2026)
2022-09 — 提出U-ViT扩散架构,早于Sora的DiT
- 朱军团队提出全球首个Diffusion模型与Transformer融合的技术框架U-ViT,该架构日后成为Vidu视频大模型的核心技术底座,其提出时间早于OpenAI Sora所采用的DiT架构。这一原创研究成果是生数科技后续视频生成、乃至世界模型技术路线的起点。
- 链接: ShengShu Technology Announces Vidu 2.0(引用U-ViT论文) / U-ViT论文 arXiv:2209.12152
2023-03 — 生数科技在北京成立
- 生数科技由清华大学人工智能研究院朱军教授团队孵化,联合创始人朱军、唐家渝、鲍凡均有清华大学背景,公司由清华系AI企业瑞莱智慧(RealAI)、蚂蚁集团与BV百度风投联合孵化成立,专注于多模态生成式大模型的自主研发。
- 链接: 生成式AI基础设施及应用建设公司生数科技完成近亿元天使轮融资
2023-06-19 — 完成近1亿元人民币天使轮融资
- 生数科技宣布完成近亿元人民币天使轮融资,由蚂蚁集团领投,百度发起的BV百度风投、卓源资本跟投,融资后估值约1亿美金。资金主要用于核心研发团队建设,加速多模态大模型与应用产品研发。
- 链接: 蚂蚁、百度联合投资AIGC赛道,生数科技首轮融资后估值1亿美金
2024-04-27 — 发布视频大模型Vidu,全面对标Sora
- 在中关村论坛"未来人工智能先锋论坛"上,生数科技联合清华大学正式发布中国首个长时长、高一致性、高动态性视频大模型Vidu,基于团队原创U-ViT架构,支持一键生成最长16秒、分辨率达1080P的高清视频,是Sora发布后全球范围内首个实现同等级突破的视频大模型。
- 链接: 中国首个Sora级视频大模型Vidu发布
- 图片:

2024-06-05 — 完成数亿元Pre-A轮融资
- 生数科技完成数亿元人民币Pre-A轮融资,由百度、北京市人工智能产业投资基金领投,中关村科学城公司、启明创投等跟投,蚂蚁集团、BV百度风投等老股东持续加注。融资完成后公司表示将坚持原生通用多模态技术路线,加速产品开发与市场拓展。
- 链接: 生数科技完成数亿元Pre-A轮融资,加速布局多模态大模型
2024-07 — Vidu海外商用版正式上线
- Vidu成为生数科技首个实现商业化的产品,2024年7月起面向全球用户开放商用,标志着公司完成从研究到商业化落地的关键一步,随后20天用户数即突破百万。
- 链接: ShengShu Technology Announces Vidu 2.0
2025-01-15 — 发布Vidu 2.0,进入"秒级生成"时代
- 生数科技发布Vidu 2.0,实现10秒内生成单条视频片段,生成成本较行业均价降低55%(每秒0.0375美元),生成失败率降低80%,多主体一致性达到92%。彼时Vidu上线100天用户数已突破千万,覆盖全球超200个国家和地区。
- 链接: ShengShu Technology Announces Vidu 2.0, Offering the Industry's Fastest Generative Video
2025-03-12 — 原字节跳动AI大将骆怡航加盟出任CEO
- 原字节跳动火山引擎AI应用产品线负责人骆怡航(清华大学自动化系博士)加盟生数科技出任CEO,全面负责研发、产品、商业化及团队管理;原CEO、联合创始人唐家渝升任总裁,负责公司战略发展与品牌。此次高管调整被视为生数科技加速商业化的重要信号。
- 链接: 生数科技加速商业化,字节跳动AI大将骆怡航加盟出任CEO
2025-03-29 — 发布高可控视频大模型Vidu Q1
- 在中关村论坛年会上,生数科技发布"业界首个高可控AI视频大模型"Vidu Q1,在多主体细节控制(尤其是动作与布局控制)、音效同步控制及画质提升方面取得突破,支持生成5秒、1080P高质量视频。
- 链接: 生数科技在中关村论坛重磅发布Vidu Q1模型
2025-04-21 — Vidu Q1全球上线,登顶VBench双榜
- 生数科技宣布Vidu Q1正式全球上线,在VBench-1.0与VBench-2.0基准测试中超越Runway Gen-3、OpenAI Sora与快手可灵,双双登顶榜首,成为国产视频大模型在国际竞争中的代表性成果。
- 链接: 生数科技 Vidu Q1发布,超OpenAI Sora夺下 VBench 双榜第一
2025-09-19 — 完成数亿元A轮融资
- 生数科技完成数亿元人民币规模A轮融资,由博华资本领投,百度战投、北京市人工智能产业投资基金、启明创投、达泰资本、卓源亚洲、BV百度风投等老股东持续跟投。CEO骆怡航表示多模态生成技术商业化仍处早期阶段,公司将持续投入模型研发与全球商业布局。
- 链接: 生数科技完成A轮数亿元融资,专注多模态大模型及应用
2025-09-25 — Vidu Q2图生视频模型全球上线,进入"演技生成"时代
- 生数科技新一代图生视频大模型Vidu Q2正式全球上线,在极致面部微表情生成、推拉运镜、语义理解等方面较Q1显著提升,提供"闪电模式"(20秒生成5秒1080P视频)与"影院模式"两种生成方式。
- 链接: AI视频生成走向"演技生成"时代,生数科技Vidu全球发布Vidu Q2
2025-12 — Vidu Q2"生图全家桶"上线,覆盖文生图与图像编辑
- Vidu Q2新增文生图与图像编辑能力,集成参考生图、文生图、图像编辑三项核心功能,支持4K画质输出及局部重绘、材质替换等操作,上线首日使用量突破50万次,构建起从生图到视频的一站式创作工作流。
- 链接: 生数科技宣布 Vidu Q2 全新上线文生图与图像编辑功能
2026-02-05 — 完成超6亿元人民币A+轮融资
- 生数科技完成超6亿元人民币A+轮融资,由中关村科学城公司、星连资本领投,公司表示将持续布局多模态大模型研发与应用,重构AI在数字和物理世界的生产力。
- 链接: 重构AI在数字和物理世界的生产力,生数科技完成超6亿元A+轮融资
2026-04-10 — 完成近20亿元B轮融资,阿里云领投,明确"通用世界模型"路线
- 生数科技宣布完成近20亿元人民币(约2.93亿美元)B轮融资,由阿里云领投,中网投、九安海棠、好未来、光合创投等参与战略投资,星连资本、达泰资本、BV百度风投等老股东持续追加投资。公司在此轮融资中首次系统性提出以"通用世界模型"定义下一代数字与物理世界生产力底座的战略方向,成为全球率先统一数字世界与物理世界通用世界模型的公司之一。融资前一日(4月9日),Vidu已正式登陆阿里云大模型服务平台"百炼"。
- 链接: 阿里云领投 生数科技完成近20亿元B轮融资 / Alibaba leads $290m investment for Shengshu Vidu AI world model(CNBC)
2026-04(同期) — 完成股份制改造,筹备港股IPO
- 生数科技完成股份制改造,公司主体由"北京生数科技有限公司"变更为"北京生数科技股份有限公司(未上市)",两个月内累计完成A+轮、B轮融资共约26亿元人民币,投后估值超120亿元人民币,拟按港交所18C章(特专科技公司上市规则)最快于2026年上半年启动港股IPO流程。
- 链接: 估值超120亿 两个月连融26亿的生数科技 拟最快上半年启动IPO
2026-04-13 — 发布Vidu Q3 Reference-to-Video,登顶SuperCLUE全球榜首
- 生数科技全球发布Vidu Q3 Reference-to-Video,支持通过参考主体、环境、服装道具与视觉风格进行叙事式视频生成,在SuperCLUE发布的全球首个Reference-to-Video榜单中排名第一;Vidu Q3本身此前已在Artificial Analysis榜单中排名中国第一、全球第二。
- 链接: ShengShu Launches Vidu Q3 Reference-to-Video with Expanded Visual and Audio Capabilities
- 图片:

2026-04-29 — 发布通用世界行动模型MotuBrain,正式切入具身智能/机器人赛道
- 生数科技发布世界行动模型(World Action Model)MotuBrain,将"看到的世界"与"要执行的动作"统一建模,基于UniDiffuser统一框架整合语言、视频与动作三种模态,定位为可跨机器人本体、跨任务泛化的通用具身智能大脑。创始人朱军在发布中提出"真正的世界模型必须能够构建对真实世界的统一表征并预测其演化",明确将Vidu的视频生成能力与MotuBrain的物理世界行动能力视为同一世界模型技术的两端。该模型在WorldArena与RoboTwin 2.0两项国际权威榜单同时登顶,已与无界动力、Astribot、SimpleAI、Anyverse Dynamics等具身智能机器人公司展开合作。
- 链接: ShengShu Technology Unveils World Action Model "Motubrain" / ShengShu unveils world action model to offer 'infinite possibilities' for robotic intelligence
- 图片:

- 图片:

2026-05-12 — 发布Vidu Claw,探索AI CMO广告生成场景
- 生数科技发布Vidu Claw,定位为"AI CMO"的第一步,用户仅需提供一个简要目标即可自动生成完整广告创意与视频素材,进一步拓展Vidu世界模型技术在广告营销行业的商业化落地场景。
- 链接: ShengShu Technology Unveils Vidu Claw, the AI CMO That Turns a Single Brief Into a Finished Ad
2026-07-03 — 发布Vidu S1,视频生成迈向"实时交互"
- 在2026全球数字经济大会上,生数科技发布新一代实时交互视频基础模型Vidu S1,采用自回归+扩散(AR+Diffusion)架构,支持540P/最高42FPS的无限时长实时视频生成,用户上传单张图片即可创建可语音实时互动的数字角色,应用于AI情感陪伴、虚拟偶像、互动直播、游戏NPC、XR等场景。
- 链接: 生数科技发布 Vidu S1,推动视频生成迈向"实时交互"新时代 / ShengShu Technology Unveils Vidu S1, Bringing Real-Time Interactive Generation to AI Video