World Models · 世界模型 创业公司

生数科技

Vidu

北京生数科技股份有限公司(ShengShu Technology) · 朱军(清华大学人工智能研究院副院长、教授,创始人/首席科学家)、唐家渝(联合创始人,现任总裁)、鲍凡(联合创始人)、骆怡航(2025年3月加盟,现任CEO,原字节跳动火

世界模型 / 视频生成

产品线9

底层架构

  1. 2022

    U-ViT

    全球首个 Diffusion+Transformer 融合框架,早于 DiT

Vidu 视频生成

  1. 2024

    Vidu

    中国首个 Sora 级视频大模型,最长 16 秒 1080P

  2. 2025

    Vidu 2.0

    10 秒内生成,成本降 55%,多主体一致性 92%

  3. 2025

    Vidu Q1

    高可控模型,VBench-1.0/2.0 双榜登顶

  4. 2025

    Vidu Q2

    图生视频进入演技生成时代,年底扩展生图全家桶

  5. 2026

    Vidu Q3 Reference-to-Video

    SuperCLUE 全球 R2V 榜第一

  6. 2026

    Vidu S1

    AR+Diffusion 架构,540P/42FPS 无限时长实时生成

世界行动模型

  1. 2026

    MotuBrain

    统一语言/视频/动作,两大国际榜单登顶

行业应用

  1. 2026

    Vidu Claw

    AI CMO,一句简报生成完整广告创意与素材

项目与产品时间线 15 个节点

  1. 2022
    1. 09 研究

      提出U-ViT扩散架构

      全球首个Diffusion与Transformer融合框架,早于Sora所用的DiT。

  2. 2023
    1. 03 机构

      生数科技在北京成立

      清华人工智能研究院朱军团队孵化,瑞莱智慧、蚂蚁集团与BV百度风投联合孵化。

    2. 06-19 融资

      完成近1亿元天使轮融资

      蚂蚁集团领投,融资后估值约1亿美元。

  3. 2024
    1. 04-27 产品

      发布视频大模型Vidu

      中国首个长时长高一致性视频大模型,一键生成最长16秒1080P视频。

    2. 06-05 融资

      完成数亿元Pre-A轮融资

      百度、北京市人工智能产业投资基金领投。

    3. 07 里程碑

      Vidu海外商用版上线

      首个实现商业化的产品,上线20天用户数突破百万。

  4. 2025
    1. 01-15 产品

      发布Vidu 2.0,进入秒级生成

      10秒内生成单条片段,成本较行业均价降低55%,失败率降低80%。

    2. 03-12 机构

      骆怡航加盟出任CEO

      原字节跳动火山引擎AI应用产品线负责人,唐家渝升任总裁。

    3. 03-29 产品

      发布高可控视频大模型Vidu Q1

      4月全球上线后在VBench-1.0与VBench-2.0双榜登顶,超越Sora与可灵。

    4. 09-19 融资

      完成数亿元A轮融资

      博华资本领投,百度战投、启明创投等老股东跟投。

    5. 09-25 产品

      Vidu Q2图生视频模型全球上线

      面部微表情与运镜显著提升,提供闪电模式与影院模式。

  5. 2026
    1. 02-05 融资

      完成超6亿元A+轮融资

      中关村科学城公司、星连资本领投。

    2. 04-10 融资

      近20亿元B轮融资,阿里云领投

      首次系统提出“通用世界模型”战略;两个月累计融资26亿元,估值超120亿元。

    3. 04-29 产品

      发布世界行动模型MotuBrain

      统一语言、视频与动作三模态,在WorldArena与RoboTwin 2.0双榜登顶。

    4. 07-03 产品

      发布实时交互视频模型Vidu S1

      AR+Diffusion架构,支持540P/最高42FPS无限时长实时生成。

方向: 世界模型 / 视频生成 核心人物: 朱军(清华大学人工智能研究院副院长、教授,创始人/首席科学家)、唐家渝(联合创始人,现任总裁)、鲍凡(联合创始人)、骆怡航(2025年3月加盟,现任CEO,原字节跳动火山引擎AI应用产品线负责人) 机构: 北京生数科技股份有限公司(ShengShu Technology) 简介: 生数科技成立于2023年3月,由清华大学人工智能研究院朱军团队孵化,核心技术源自团队2022年提出的U-ViT(Diffusion+Transformer融合架构)。公司先以视频生成大模型Vidu对标Sora并多次登顶国际榜单,2026年起明确提出"通用世界模型"(General World Model)技术路线,将视频生成技术延伸至具身智能/机器人领域,推出世界行动模型MotuBrain,覆盖"数字世界生成"与"物理世界行动"两端。

Vidu Q3 Reference-to-Video 产品海报

关键成就

  • 融资总额:天使轮(2023-06,近1亿元)→ Pre-A轮(2024-06,数亿元)→ A轮(2025-09,数亿元)→ A+轮(2026-02,超6亿元人民币)→ B轮(2026-04,近20亿元人民币/约2.93亿美元,阿里云领投),B轮后估值超120亿元人民币,两个月内累计融资约26亿元人民币。
  • 技术指标:Vidu Q1于2025年4月在VBench-1.0与VBench-2.0双榜登顶;Vidu Q3据Artificial Analysis排名中国第一、全球第二,并在SuperCLUE全球首个Reference-to-Video榜单中排名第一;世界行动模型MotuBrain在WorldArena(63.77 EWM分)与RoboTwin 2.0(50项任务均分96.0)两项国际权威具身智能榜单登顶。
  • 计划进展:2026年4月完成股份制改造(更名为"北京生数科技股份有限公司(未上市)"),拟以港交所18C章最快于2026年上半年启动港股IPO。
  • 媒体报道: Alibaba leads $290m investment for Shengshu Vidu AI world model(CNBC,2026-04-10)

时间线(2022-2026)

2022-09 — 提出U-ViT扩散架构,早于Sora的DiT

2023-03 — 生数科技在北京成立

2023-06-19 — 完成近1亿元人民币天使轮融资

2024-04-27 — 发布视频大模型Vidu,全面对标Sora

  • 在中关村论坛"未来人工智能先锋论坛"上,生数科技联合清华大学正式发布中国首个长时长、高一致性、高动态性视频大模型Vidu,基于团队原创U-ViT架构,支持一键生成最长16秒、分辨率达1080P的高清视频,是Sora发布后全球范围内首个实现同等级突破的视频大模型。
  • 链接: 中国首个Sora级视频大模型Vidu发布
  • 图片: Vidu Q3 Reference-to-Video 产品海报(示例产品视觉)

2024-06-05 — 完成数亿元Pre-A轮融资

  • 生数科技完成数亿元人民币Pre-A轮融资,由百度、北京市人工智能产业投资基金领投,中关村科学城公司、启明创投等跟投,蚂蚁集团、BV百度风投等老股东持续加注。融资完成后公司表示将坚持原生通用多模态技术路线,加速产品开发与市场拓展。
  • 链接: 生数科技完成数亿元Pre-A轮融资,加速布局多模态大模型

2024-07 — Vidu海外商用版正式上线

  • Vidu成为生数科技首个实现商业化的产品,2024年7月起面向全球用户开放商用,标志着公司完成从研究到商业化落地的关键一步,随后20天用户数即突破百万。
  • 链接: ShengShu Technology Announces Vidu 2.0

2025-01-15 — 发布Vidu 2.0,进入"秒级生成"时代

2025-03-12 — 原字节跳动AI大将骆怡航加盟出任CEO

  • 原字节跳动火山引擎AI应用产品线负责人骆怡航(清华大学自动化系博士)加盟生数科技出任CEO,全面负责研发、产品、商业化及团队管理;原CEO、联合创始人唐家渝升任总裁,负责公司战略发展与品牌。此次高管调整被视为生数科技加速商业化的重要信号。
  • 链接: 生数科技加速商业化,字节跳动AI大将骆怡航加盟出任CEO

2025-03-29 — 发布高可控视频大模型Vidu Q1

  • 在中关村论坛年会上,生数科技发布"业界首个高可控AI视频大模型"Vidu Q1,在多主体细节控制(尤其是动作与布局控制)、音效同步控制及画质提升方面取得突破,支持生成5秒、1080P高质量视频。
  • 链接: 生数科技在中关村论坛重磅发布Vidu Q1模型

2025-04-21 — Vidu Q1全球上线,登顶VBench双榜

2025-09-19 — 完成数亿元A轮融资

  • 生数科技完成数亿元人民币规模A轮融资,由博华资本领投,百度战投、北京市人工智能产业投资基金、启明创投、达泰资本、卓源亚洲、BV百度风投等老股东持续跟投。CEO骆怡航表示多模态生成技术商业化仍处早期阶段,公司将持续投入模型研发与全球商业布局。
  • 链接: 生数科技完成A轮数亿元融资,专注多模态大模型及应用

2025-09-25 — Vidu Q2图生视频模型全球上线,进入"演技生成"时代

2025-12 — Vidu Q2"生图全家桶"上线,覆盖文生图与图像编辑

  • Vidu Q2新增文生图与图像编辑能力,集成参考生图、文生图、图像编辑三项核心功能,支持4K画质输出及局部重绘、材质替换等操作,上线首日使用量突破50万次,构建起从生图到视频的一站式创作工作流。
  • 链接: 生数科技宣布 Vidu Q2 全新上线文生图与图像编辑功能

2026-02-05 — 完成超6亿元人民币A+轮融资

2026-04-10 — 完成近20亿元B轮融资,阿里云领投,明确"通用世界模型"路线

  • 生数科技宣布完成近20亿元人民币(约2.93亿美元)B轮融资,由阿里云领投,中网投、九安海棠、好未来、光合创投等参与战略投资,星连资本、达泰资本、BV百度风投等老股东持续追加投资。公司在此轮融资中首次系统性提出以"通用世界模型"定义下一代数字与物理世界生产力底座的战略方向,成为全球率先统一数字世界与物理世界通用世界模型的公司之一。融资前一日(4月9日),Vidu已正式登陆阿里云大模型服务平台"百炼"。
  • 链接: 阿里云领投 生数科技完成近20亿元B轮融资 / Alibaba leads $290m investment for Shengshu Vidu AI world model(CNBC)

2026-04(同期) — 完成股份制改造,筹备港股IPO

  • 生数科技完成股份制改造,公司主体由"北京生数科技有限公司"变更为"北京生数科技股份有限公司(未上市)",两个月内累计完成A+轮、B轮融资共约26亿元人民币,投后估值超120亿元人民币,拟按港交所18C章(特专科技公司上市规则)最快于2026年上半年启动港股IPO流程。
  • 链接: 估值超120亿 两个月连融26亿的生数科技 拟最快上半年启动IPO

2026-04-13 — 发布Vidu Q3 Reference-to-Video,登顶SuperCLUE全球榜首

2026-04-29 — 发布通用世界行动模型MotuBrain,正式切入具身智能/机器人赛道

  • 生数科技发布世界行动模型(World Action Model)MotuBrain,将"看到的世界"与"要执行的动作"统一建模,基于UniDiffuser统一框架整合语言、视频与动作三种模态,定位为可跨机器人本体、跨任务泛化的通用具身智能大脑。创始人朱军在发布中提出"真正的世界模型必须能够构建对真实世界的统一表征并预测其演化",明确将Vidu的视频生成能力与MotuBrain的物理世界行动能力视为同一世界模型技术的两端。该模型在WorldArena与RoboTwin 2.0两项国际权威榜单同时登顶,已与无界动力、Astribot、SimpleAI、Anyverse Dynamics等具身智能机器人公司展开合作。
  • 链接: ShengShu Technology Unveils World Action Model "Motubrain" / ShengShu unveils world action model to offer 'infinite possibilities' for robotic intelligence
  • 图片: MotuBrain 世界行动模型示意图
  • 图片: 生数科技通用世界模型系统架构图(数字世界-物理世界统一表征)

2026-05-12 — 发布Vidu Claw,探索AI CMO广告生成场景

2026-07-03 — 发布Vidu S1,视频生成迈向"实时交互"

← 返回世界模型