Humanoid & Embodied AI · 基础模型 (VLA) 课题组

清华大学具身智能团队

许华哲 · 星海图 Galaxea / 高阳 · 千寻智能 Spirit AI

清华大学交叉信息研究院(姚班所在院系)/ 上海期智研究院;产业化公司:星海图(北京)人工智能科技股份有限公司(Galaxea Dynamics)、千寻智能(杭州)科技有限公司(Spirit AI) · - 许华哲(Huazhe Xu)— 清

VLA模型 / 机器人基础模型

核心人物4

  1. 01

    许华哲(Huazhe Xu)

    清华大学交叉信息研究院助理教授 · TEA Lab 负责人

    RoboCook 获 CoRL'23 最佳系统论文,星海图联合创始人

  2. 02

    高阳(Yang Gao)

    清华大学交叉信息研究院助理教授 · EVAR Lab 负责人

    EfficientZero、ViLa 作者,千寻智能联创兼首席科学家

  3. 03

    高继扬

    星海图 CEO

    提出本能—作业—进化智能三重跃迁路线图

  4. 04

    韩峰涛

    千寻智能创始人兼 CEO

    十余年机器人产业经验,主导 Moz1 落地

项目与产品时间线 14 个节点

  1. 2021
    1. 11 研究

      EfficientZero 提出

      高阳课题组以 2 小时真实游戏经验在 Atari 100k 首次超越人类平均水平(194.3%)。

  2. 2022
    1. 09 机构

      许华哲加入清华,创立 TEA Lab

      任交叉信息研究院助理教授、上海期智研究院 PI,创立清华具身智能实验室。

  3. 2023
    1. 09 机构

      星海图(Galaxea)成立

      许华哲联合创立,主张「整机+智能」战略,研发具身基础模型与「一脑多形」本体。

    2. 11 研究

      ViLa 视觉-语言规划提出

      首次将视觉直接整合进大模型长时序规划,架构后被 Figure AI 采用。

  4. 2024
    1. 01 机构

      千寻智能(Spirit AI)成立

      杭州创立,韩峰涛任 CEO,高阳任联合创始人兼首席科学家,被称「中国版 Figure」。

    2. 03 研究

      3D 扩散策略 DP3 发布

      入选 RSS 2024,近 30 个模拟任务成功率超 90%,真机仅需 40 次演示达 85%。

    3. 10 里程碑

      星海图 R1 系列首批交付

      轮式双臂机器人身高 170cm、24 自由度,首个客户为斯坦福李飞飞团队。

  5. 2025
    1. 02 融资

      星海图完成近 3 亿元 A 轮融资

      蚂蚁集团独家领投,成立一年半累计融资近 1 亿美元。

    2. 06 产品

      千寻发布 Moz1 与 Spirit v1

      26 自由度人形机器人搭载自研 VLA 模型,后在宁德时代产线成功率稳定在 99% 以上。

    3. 08 研究

      星海图 G0 模型与开放世界数据集开源

      快慢双系统 VLA 实现 23 自由度全身控制;数据集含 500+ 小时、50 个场景、150 类任务。

  6. 2026
    1. 01-12 里程碑

      Spirit v1.5 登顶 RoboChallenge

      总分 66.09、成功率 50.33% 超越 Physical Intelligence 的 Pi0.5,被称具身智能「DeepSeek 时刻」。

    2. 06-02 产品

      星海图发布双足人形机器人「行客 Kengo」

      身高 1.4 米,单关节扭矩超 130N·m,可完成空翻踢腿及递物搬箱等双臂作业。

    3. 06-03 融资

      千寻完成 15 亿元 A+ 轮融资

      红杉中国、云锋基金等参投,3 个月内四轮融资累计超 45 亿元。

    4. 06-16 研究

      星海图 G0.5 开源与 Fast-WAM 发布

      统一自回归架构实现「边思考边行动」零样本泛化,世界模型单步推理压至 190 毫秒。

方向: VLA模型 / 机器人基础模型 核心人物:

  • 许华哲(Huazhe Xu)— 清华大学交叉信息研究院(IIIS)助理教授、博导,清华具身智能实验室(TEA Lab)负责人,上海期智研究院PI;具身智能独角兽星海图 Galaxea联合创始人
  • 高阳(Yang Gao)— 清华大学交叉信息研究院助理教授,具身视觉与机器人实验室(EVAR Lab)负责人;千寻智能 Spirit AI联合创始人兼首席科学家 机构: 清华大学交叉信息研究院(姚班所在院系)/ 上海期智研究院;产业化公司:星海图(北京)人工智能科技股份有限公司(Galaxea Dynamics)、千寻智能(杭州)科技有限公司(Spirit AI) 简介: 许华哲与高阳均为UC Berkeley博士、清华交叉信息研究院(叉院)青年助理教授,二人是当前中国VLA/机器人基础模型方向学术影响力与产业化程度最高的清华系代表人物。许华哲2023年联合创立"星海图",主打"整机+智能"路线,2025-2026年密集发布G0系列VLA模型、Galaxea开放世界数据集及双足人形机器人Kengo;高阳2024年联合创立"千寻智能",其ViLa视觉-语言规划算法被Figure AI采用,2026年初Spirit v1.5模型登顶RoboChallenge全球评测榜,公司也被称为"中国版Figure"。两支团队均获红杉中国、蚂蚁集团、高瓴创投等顶级机构连续加注,是清华叉院具身智能"学术-创业"双轨路径的典型样本。

星海图R1机器人

关键成就

  • 许华哲:清华叉院助理教授(2022年9月起),CoRL'23最佳系统论文奖(RoboCook),2024 WAIC"云帆奖·璀璨明星",在RSS、NeurIPS、ICRA等顶会发表论文50余篇(Google Scholar: t9HPFawAAAAJ
  • 高阳:清华叉院助理教授,Google Scholar引用超1700次,代表作EfficientZero(NeurIPS 2021)、ViLa(2023,被Figure AI采用其算法架构)
  • 星海图(Galaxea):成立于2023年9月,一年内完成四轮融资,累计融资近1亿美元,投资方包括蚂蚁集团、高瓴创投、IDG资本、百度风投、米哈游等;服务斯坦福、Physical Intelligence(π)、英伟达等近百家全球顶尖客户
  • 千寻智能(Spirit AI):成立于2024年1月,2026年6月完成15亿元A+轮融资,3个月内四轮融资累计超45亿元,创具身智能行业融资速度纪录,投资方包括红杉中国、云锋基金、华为哈勃等
  • 媒体报道: 清华TEA实验室负责人:具身智能入门/转行到底学什么?(知乎独家专访)
  • 媒体报道: 1年融资12亿?估值破10亿美元?万字解析清华系"七小龙"具身智能机器人公司(机器人大讲堂)

时间线(2021-2026)

2021-11 — 高阳课题组提出EfficientZero,样本效率强化学习登顶Atari基准

  • 高阳(联合作者:叶伟睿、刘少怀、Thanard Kurutach、Pieter Abbeel)提出EfficientZero模型,在仅有2小时真实游戏经验(Atari 100k基准)的条件下,首次实现超越人类平均水平(194.3%)的表现,是深度强化学习样本效率方向的代表性成果,被视为MuZero之后的重要改进工作,为其后续转向具身智能积累了核心算法能力。
  • 链接: Mastering Atari Games with Limited Data (arXiv:2111.00210)
  • 链接: EfficientZero 开源代码

2022-09 — 许华哲加入清华大学交叉信息研究院,创立TEA Lab

  • 许华哲博士毕业于UC Berkeley(师从Trevor Darrell),斯坦福大学博士后后于2022年9月加入清华大学交叉信息研究院任助理教授、博导,同时成为上海期智研究院PI,创立清华具身智能实验室(TEA Lab),研究方向聚焦策略泛化性、模仿学习与强化学习的数据效率、真机强化学习及多模态机器人数据采集。
  • 链接: 许华哲-清华大学交叉信息研究院
  • 图片: 许华哲

2023-11 — 高阳课题组提出ViLa:GPT-4V驱动的机器人视觉-语言规划

2023 — 许华哲团队论文RoboCook获CoRL'23最佳系统论文奖

2023-09 — 星海图(Galaxea)成立,许华哲联合创业

2024-01 — 千寻智能(Spirit AI)成立,高阳出任联合创始人兼首席科学家

2024-01 — 星海图完成千万美元级天使轮融资

2024-03 — 许华哲团队发布3D扩散策略(DP3),入选RSS 2024

2024-07 — 许华哲荣获2024 WAIC"云帆奖·璀璨明星"

  • 在2024世界人工智能大会(WAIC)"云帆奖颁奖典礼暨人工智能青年先锋论坛"上,许华哲凭借在具身智能与机器人学、强化学习、模仿学习等方向的系统性贡献获评"璀璨明星"奖项,并发表关于具身智能体与物理世界交互、泛化能力前沿进展的主题演讲。
  • 链接: 携手云帆,探索无界 | 许华哲荣获2024 WAIC 云帆奖

2024-08 — 千寻智能完成近2亿元天使轮融资

2024-10 — 星海图R1系列机器人首批交付,首个客户为斯坦福大学李飞飞团队

  • 星海图轮式双臂机器人R1系列正式开启交付,标准版身高170cm、24自由度,双臂最大负载10kg,首个交付客户即为斯坦福大学李飞飞团队,双方随后基于R1本体开展家务机器人科研合作。
  • 链接: 星海图(北京)人工智能科技股份有限公司-R1
  • 图片: Galaxea R1机器人

2024-11 — 星海图完成超2亿元Pre-A轮融资

2025-02 — 星海图完成近3亿元A轮融资,成立一年半累计融资近1亿美元

2025-03 — 斯坦福李飞飞团队基于星海图R1本体发布BEHAVIOR Robot Suite

2025-03 — 千寻智能完成5.28亿元Pre-A轮融资

2025-06 — 千寻智能发布人形机器人Moz1,搭载自研Spirit v1 VLA模型

  • 千寻智能发布首款自研人形机器人Moz1,被称为"中国首个拥有真正意义多任务连续泛化具身模型的机器人",搭载自研Spirit v1视觉-语言-动作(VLA)模型,拥有26个自由度及全球功率密度领先的力控关节,可完成叠衣、倒垃圾、做咖啡等复杂任务,后续在宁德时代动力电池PACK产线实现高压测试插头插接等非标工序作业,成功率稳定在99%以上。
  • 链接: Moz1_百度百科
  • 链接: 华为哈勃入股,千寻智能发布全力控人形机器人Moz1

2025-08 — 星海图发布并开源Galaxea Open-World Dataset与G0双系统VLA模型

  • 星海图正式发布端到端快慢双系统VLA模型G0,将负责多模态规划的视觉语言模型(VLM,System 2)与负责细粒度执行的VLA模型(System 1)异步耦合,采用跨本体预训练、单本体预训练、任务特定后训练的三阶段训练方案,实现23自由度机器人全身控制。同时开源全球首个开放场景高质量真机数据集Galaxea Open-World Dataset(500+小时,覆盖家庭、厨房、零售、办公等50个场景、150类任务),论文由许华哲与团队合作完成。
  • 链接: Galaxea Open-World Dataset and G0 Dual-System VLA Model (arXiv:2509.00576)
  • 链接: GalaxeaVLA 开源仓库

2026-01-12 — 千寻智能Spirit v1.5模型登顶RoboChallenge全球评测榜

2026-01/02 — 星海图开源G0Plus大模型与轻量化边缘模型G0Tiny

2026-06-02 — 星海图发布首款双足人形机器人"行客 Kengo"

  • 星海图正式发布自研双足人形机器人Kengo(行客),身高1.4米,搭载运动小脑与具身大脑,单关节扭矩超130N·m,可完成空翻踢腿、鲤鱼打挺等高动态动作,也能完成递物、搬箱、叠衣等贴近真实场景的双臂作业,标志公司从轮式双臂形态向双足人形形态扩展,完成"整机智能"闭环。
  • 链接: 星海图正式发布「双足」机器人,为什么是在现在?
  • 图片: Kengo双足人形机器人

2026-06-03 — 千寻智能完成15亿元A+轮融资,3个月内四轮融资超45亿元

2026-06-16 — 星海图开发者大会:G0.5模型开源、世界模型Fast-WAM发布

  • 星海图正式发布并开源新一代VLA基础模型G0.5,采用统一自回归架构将视觉理解、语言推理与动作生成纳入同一模型链路,实现"边思考边行动"的零样本泛化能力,刷新全球7大权威榜单;同时公布世界模型Fast-WAM(单步推理延迟压缩至190毫秒,较传统架构提速4倍以上)与全身控制基础模型,并启动与北京亦庄共建的"百万小时真实数据计划"。CEO高继扬提出具身智能"本能智能—作业智能—进化智能"三重跃迁路线图。
  • 链接: 刚刚,星海图甩出具身智能全家桶:双足人形、VLA模型、世界模型齐亮相
  • 图片: 星海图开发者大会现场

2026-07-17 — 千寻智能携Moz1/Moz2与Spirit v1.6亮相WAIC 2026

  • 千寻智能在2026世界人工智能大会(WAIC)现场展示Moz1完成"整理客厅"长时序家务任务(识别环境、跨家具连续操作、应对突发新增物体并动态重规划),以及首次公开亮相的商用服务机器人Moz2(32自由度、七自由度仿生手臂)。技术上,Spirit v1.6采用VLA与世界模型一体化架构,并引入抽象动作Token预测,用以解决长程任务中的"金鱼记忆"(上下文遗忘)问题;公司披露Moz1已在宁德时代产线规模化作业,并计划2026年内积累百万小时级真实交互数据。
  • 链接: 千寻智能最强大脑亮相WAIC:攻克「金鱼记忆」,终结单一任务Demo内卷
  • 图片: 千寻智能Spirit具身智能全栈架构
  • 图片: 千寻智能数据金字塔
← 返回人形机器人