智谱AI(Zhipu AI)— CogVideoX与世界模型方向
智谱AI / Z.ai(国际品牌,2025年7月启用);主体公司北京智谱华章科技有限公司,2026年更名为"智谱华章科技股份有限公司"(Knowledge Atlas Technology),港交所代码2513.HK · 张鹏(CEO)、唐




1 / 5 产品线10
语言基座模型
- 2021
GLM / ChatGLM 系列
自回归填空训练,全部产品线技术底座
- 2025
GLM-4.5 / GLM-5
原生融合推理、编码与 Agentic 能力
视频生成
- 2022
CogVideo
首个开源大规模 Transformer 文生视频模型,ICLR 2023
- 2024
清影(Ying)
消费级文生视频产品,约 30 秒生成 6 秒视频
- 2024
CogVideoX-2B/5B
3D 因果 VAE + 专家 Transformer,ICLR 2025 收录
- 2024
CogVideoX-5B-I2V / CogVLM2-Caption
图生视频版本与视频打标模型
- 2024
CogSound + 新清影
音画同步,10 秒/4K/60 帧,强化物理世界模拟
- 2024
CogVideoX1.5
最长 10 秒、768P、16fps,I2V 支持任意分辨率
智能体
- 2024
AutoGLM / AutoGLM 沉思
语音指令自主操作手机,2025 年升级为边思考边执行
开发工具
- 2025
CogKit
CogView4 与 CogVideoX 的统一微调与推理框架
项目与产品时间线 15 个节点
- 2021
-
GLM通用语言模型项目立项
清华KEG实验室启动,采用自回归填空训练策略,成为全部产品线技术底座。
-
- 2022
-
CogVideo开源
首个基于大规模Transformer的开源文生视频模型,可生成约4秒32帧视频。
-
- 2023
-
阿里腾讯等联合投资约25亿元
美团、蚂蚁、小米、红杉中国同时参投,跻身中国大模型第一梯队。
-
- 2024
-
张鹏表态对标Sora是通向AGI路径
首次公开将视频生成技术与AGI路线图正式关联。
-
Prosperity7参投4亿美元融资
沙特主权基金旗下基金参与,公司估值约30亿美元。
-
文生视频产品“清影”上线
约30秒生成一段6秒视频,用户可免费体验。
-
CogVideoX-2B/5B开源
提出3D因果VAE与专家Transformer架构,论文后被ICLR 2025收录。
-
AutoGLM智能体发布
可通过语音指令自主操作手机完成点餐、订票等跨应用任务。
-
“新清影”升级与CogVideoX1.5发布
支持10秒4K/60帧,配CogSound音效模型,强调人体动作与物理世界模拟提升。
-
D轮融资约4.11亿美元
约合30亿元人民币,为公司公开披露的单轮最大融资之一。
-
- 2025
-
启动港股IPO辅导
成为中国“AI六小龙”中首家公开推进上市进程的公司。
-
GLM-4.5发布,国际品牌更名Z.ai
原生融合推理、编码与智能体能力,48小时内登顶Hugging Face热门模型榜。
-
中关村科学城领投,投前估值200亿元
冲刺IPO前的关键增资节点,北京国资背景进一步强化。
-
- 2026
-
港交所主板上市(2513.HK)
发行价116.2港元,募资约52.3亿港元,成为中国大模型行业首家IPO公司。
-
GLM-5发布
主打从“氛围编码”到“智能体工程”的能力升级。
-
方向: 世界模型(潜在演进方向)/ 视频生成 / 通用大模型(AGI) 核心人物: 张鹏(CEO)、唐杰(首席科学家,清华大学计算机系教授,KEG实验室核心人物)、李涓子(联合创始人,清华大学教授)、刘德兵(董事长)、王绍兰(总裁) 机构: 智谱AI / Z.ai(国际品牌,2025年7月启用);主体公司北京智谱华章科技有限公司,2026年更名为"智谱华章科技股份有限公司"(Knowledge Atlas Technology),港交所代码2513.HK 简介: 智谱AI成立于2019年6月,由清华大学计算机系知识工程实验室(KEG,成立于1996年)技术成果转化而来,是中国最早布局大语言模型的公司之一,被视为"中国版OpenAI",产品矩阵覆盖GLM系列语言模型、CogView图像生成、CogVideoX视频生成及AutoGLM智能体。在视频生成方向,智谱自2022年开源CogVideo起持续迭代至CogVideoX/CogVideoX1.5,商业化产品为"清影"(Ying),技术上强调运动合理性与物理世界模拟能力的提升;不过截至目前,智谱官方并未将CogVideoX正式定位为对标NVIDIA Cosmos、DeepMind Genie的"世界模型"产品,其2026年的公开战略("摸高计划")聚焦长程任务、自主智能体等AGI方向,2026年WAIC具身智能/世界模型专场智谱亦罕见缺席,"潜在演进"更多体现在技术路线(3D因果VAE、时空建模、音画同步CogSound)而非官方话语层面。2026年1月,智谱在港交所上市,成为中国"AI六小龙"中首家完成IPO的大模型公司。

关键成就
- 融资与上市:成立6年间融资8轮,累计筹资超83亿元人民币;IPO前投后估值达243.8亿元人民币。2026年1月8日于港交所主板上市(股票代码2513.HK),发行价116.2港元/股,全球发售募资约52.3亿港元,上市首日市值578.9亿港元,是中国"AI六小龙"(智谱、月之暗面、MiniMax、百川智能、零一万物、阶跃星辰)中首家完成IPO的公司;2026年内股价一度冲高至市值约1.3万亿港元(约合1670亿美元)。
- CogVideoX技术影响力:CogVideoX(arXiv:2408.06072)提出3D因果变分自编码器(3D VAE)与专家Transformer(Expert Transformer)架构,在多项机器指标与人工评测上取得当时开源模型的最先进(SOTA)水平;模型权重在GitHub(zai-org/CogVideo)与Hugging Face开源,累计被40余篇后续论文引用,衍生出382个Hugging Face Spaces应用。
- 开源生态:GLM-4-9B等开源模型GitHub累计获超15万星标,全球下载量超3000万次;智谱MaaS开放平台聚集270万+企业及应用开发者,是国内首家实现MaaS规模化收入的大模型创业公司。
- 链接: 火线解析智谱AI招股书(量子位)
- 媒体报道: Zhipu AI says it is developing Sora-like technology as a path to AGI(南华早报);Zhipu AI launches video model as more Chinese tech firms take on OpenAI's Sora(南华早报)
时间线(2021-2026)
2021-12 — GLM通用语言模型项目立项
- 清华大学KEG实验室启动GLM(General Language Model)项目,目标是打造中英双语的高精度基座语言模型,采用"自回归填空"(autoregressive blank infilling)训练策略,成为此后ChatGLM及智谱全部产品线的技术底座。相关论文于2022年5月发表于ACL会议。
- 链接: GLM: General Language Model Pretraining with Autoregressive Blank Infilling(ACL Anthology)
- 链接: Z.ai — Wikipedia
2022-05 — CogVideo开源,首个开源大规模Transformer文生视频模型
- 2022年5月19日,智谱/清华团队开源CogVideo,这是首个基于大规模Transformer架构的开源文本生成视频模型,可生成约4秒、32帧的中等帧率视频,技术细节发表于ICLR 2023论文(arXiv:2205.15868)。CogVideo是CogVideoX系列的前身,奠定了智谱在视频生成方向的早期技术积累。
- 链接: CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers(arXiv)
- 链接: GitHub - zai-org/CogVideo
- 图片:

2023-10 — 阿里巴巴、腾讯等联合投资约25亿元人民币
- 2023年10月,智谱获得阿里巴巴、腾讯、美团、蚂蚁集团、小米、红杉中国(HongShan)等联合投资约25亿元人民币(约3.42亿美元),是当时中国大模型创业公司中获得互联网大厂集中押注的代表性案例,标志智谱正式跻身"中国大模型第一梯队"。
- 链接: Alibaba, Tencent among investors in China's rival to OpenAI with $341 million funding(CNBC)
- 链接: Alibaba and Tencent lead US$342 million total investment this year in Zhipu AI(南华早报)
2024-03 — CEO张鹏公开表态:对标Sora的视频生成技术是通向AGI的路径之一
- 2024年3月16日,OpenAI发布Sora技术报告(题为"作为世界模拟器的视频生成模型")后,智谱CEO张鹏公开回应称公司正在研发类似技术,并将其视为通向通用人工智能(AGI)的路径之一,同时承认智谱与Sora之间仍存在技术差距。这是智谱首次公开将视频生成技术与AGI路线图正式关联。
- 链接: China's Zhipu AI says it is developing Sora-like technology as a path to AGI(南华早报)
2024-05 — 沙特Prosperity7 Ventures领投4亿美元,估值约30亿美元
- 2024年5月31日,沙特阿拉伯主权财富基金旗下Prosperity7 Ventures参与智谱4亿美元融资轮,公司估值约达30亿美元(此前私募估值最高纪录)。该轮融资是智谱国际化融资阵容的重要一步,也是当时中国AI初创公司获得的最大规模融资之一。
- 链接: Saudi Fund Joins $400 Million Financing for China AI Firm Zhipu(彭博社)
2024-07 — "清影"(Ying)文生视频产品正式上线
- 2024年7月,智谱在智谱清言平台推出消费级视频生成产品"清影"(英文名Ying),支持文本生成视频与图像生成视频,用户可免费体验,约30秒即可生成一段6秒视频。这标志着智谱成为继多家中国科技公司之后又一家正式推出Sora对标产品的厂商。
- 链接: Zhipu AI launches video model as more Chinese tech firms take on OpenAI's Sora(南华早报)
- 链接: 智谱 AI 发布视频生成工具"清影":30 秒快速生成,免费体验(腾讯云开发者社区)
2024-08 — CogVideoX-2B/5B开源,3D因果VAE + 专家Transformer架构发布
- 2024年8月6日,智谱开源CogVideoX系列首个模型CogVideoX-2B及配套的3D因果变分自编码器(3D Causal VAE),可实现视频近乎无损重建;8月27日追加开源更大规模的CogVideoX-5B,显著提升推理性能,2B模型可在GTX 1080Ti等旧款GPU上运行。8月12日提交的技术论文(arXiv:2408.06072)详述了3D VAE与专家Transformer相结合的架构设计,后被ICLR 2025收录。
- 链接: CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer(arXiv)
- 链接: Higher Quality, Better Visual Effects! Zhipu Open Source CogVideoX-5B Video Generation Model(aibase)
- 图片:

2024-09 — CogVideoX-5B-I2V图生视频模型与CogVLM2-Caption开源
- 2024年9月19日,智谱开源CogVideoX系列的图生视频(Image-to-Video)版本CogVideoX-5B-I2V,支持以图像为背景输入结合文本提示生成视频,增强了生成结果的可控性;同期开源用于训练数据打标的视频理解模型CogVLM2-Caption,用于将视频转化为文本描述,提升训练数据质量。至此CogVideoX系列已支持文生视频、视频续写、图生视频三类任务。
- 链接: GitHub - zai-org/CogVideo
2024-10 — AutoGLM智能体发布,可自主操作手机完成任务
- 2024年10月30日,智谱发布AutoGLM,宣称是可通过语音指令自主操作智能手机完成点餐、订票、查房、生成视频等跨应用任务的智能体产品,被视为智谱从"内容生成"向"自主行动"能力延伸的重要一步,也是智谱2025年将Agent作为核心战略方向的先声。
- 链接: China's Zhipu AI says its app can operate your smartphone for you(南华早报)
2024-11 — "新清影"升级:10秒/4K/60帧 + CogSound音效模型,强化物理世界模拟
- 2024年11月8日,智谱发布"新清影"重要升级,基于CogVideoX最新技术进展和新推出的音效模型CogSound,实现音画同步的"视听一体"AI创作闭环。升级后支持生成10秒、4K、60帧超高清视频,并在图生视频质量、人物表演细节、运动合理性及复杂提示词语义理解等方面显著增强——官方在传播中特别强调了"人体动作和物理世界模拟"能力的提升,是智谱在公开物料中少数明确提及"物理世界模拟"的表述之一。
- 链接: 智谱视频生成大模型清影迎来升级(动点科技)
- 链接: 智谱「新清影」是怎样炼成的?CogVideoX+CogSound 技术详解(智源社区)
- 图片:

2024-11 — CogVideoX1.5发布,支持10秒超高分辨率生成
- 2024年11月8日,智谱开源CogVideoX1.5,作为CogVideoX的升级版本,CogVideoX1.5-5B系列支持最长10秒、768P分辨率、16帧/秒的视频生成,CogVideoX1.5-5B-I2V支持任意分辨率的图生视频;SAT版本代码率先更新,diffusers版本于11月15日跟进适配。
- 链接: GitHub - zai-org/CogVideo README
- 链接: The latest open-source video model CogVideoX v1.5 from Zhipu AI(aibase)
2024-12 — D轮融资约4.11亿美元
- 2024年12月,智谱完成新一轮约4.11亿美元(约合30亿元人民币)的融资,是公司迄今公开披露的单轮最大融资之一,进一步巩固其作为中国AI大模型领域头部独角兽的资本地位。
- 链接: Zhipu - 2026 Funding Rounds & List of Investors(Tracxn)
2025-03 — CogKit微调框架开源,AutoGLM沉思发布
- 2025年3月24日,智谱开源CogKit——面向CogView4与CogVideoX系列模型的统一微调与推理框架,帮助开发者更便捷地定制多模态生成模型。3月31日,智谱在中关村论坛推出智能体新品"AutoGLM沉思",宣称是全球首个可"边深度思考、边动手执行"的智能体,能像人一样打开浏览网页并完成数据检索、分析、报告生成等任务。
- 链接: GitHub - THUDM/CogKit
- 链接: 智谱张鹏:2025年是AI Agent的爆发之年(新浪财经)
2025-04 — 启动港股IPO辅导,成为"AI六小龙"中首家推进上市的公司
- 2025年4月,智谱正式披露启动港股IPO辅导备案,成为中国"AI六小龙"(智谱、月之暗面、MiniMax、百川智能、零一万物、阶跃星辰)中首家公开推进上市进程的公司。同期智谱以MIT开源许可证发布了两款模型,进一步强化其开源生态布局。
- 链接: Zhipu AI becomes first of China's 'AI Six' to pursue IPO(DigiTimes)
- 链接: 北京最火独角兽,要IPO了(投中网)
2025-07 — GLM-4.5发布,国际品牌更名为Z.ai
- 2025年7月28日,智谱发布新一代旗舰模型GLM-4.5及GLM-4.5 Air,首次在单一模型中原生融合推理、编码与智能体(Agentic)能力,发布48小时内登顶Hugging Face热门模型榜全球第一。同期,公司在海外正式将品牌更名为Z.ai(中国境内继续使用"智谱")。此外,2025年7月2日智谱还获得浦东创投、张江集团10亿元人民币战略投资,并开源新一代视觉语言模型GLM-4.1V-Thinking。
- 链接: GLM-4.5: Reasoning, Coding, and Agentic Abilities(Z.ai官方博客)
- 链接: China's latest AI model claims to be even cheaper to use than DeepSeek(CNBC)
2025-09 — 中关村科学城领投,投前估值200亿元人民币
- 2025年9月,中关村科学城公司宣布以投前200亿元人民币估值领投智谱新一轮融资,是智谱冲刺IPO前的关键增资节点之一,投资方阵容中北京国资背景进一步强化。
- 链接: 北京国资领投、投前估值200亿 这家AI独角兽完成新一轮融资(财联社)
- 链接: 估值200亿!"AI独角兽"智谱又融了30亿(Investing.com)
2025-12 — 通过港交所聆讯,6年融资8轮累计超83亿元人民币
- 2025年12月19日,智谱以秘密递表方式通过港交所上市聆讯,即将正式挂牌。招股书披露:智谱成立6年间累计完成8轮融资,总额超83亿元人民币,IPO前投后估值达243.8亿元人民币;2022-2024年营业收入分别为5740万元、1.245亿元、3.124亿元人民币,复合年增长率约130%;2025年上半年收入1.9亿元,已超2023年全年水平;截至2025年9月末,智谱模型服务全球超12000家企业客户、超8000万台终端设备、超4500万名开发者。
- 链接: 火线解析智谱AI招股书:年营收3亿增速130%,率先冲刺全球大模型第一股(量子位)
- 图片:

- 图片:

2026-01 — 港交所主板上市(2513.HK),成为中国大模型"第一股"
- 2026年1月8日,智谱正式在香港交易所主板挂牌上市,发行价116.2港元/股,全球发售募资约52.3亿港元,上市首日总市值578.9亿港元,成为中国"AI六小龙"及大模型行业首家完成IPO的公司;公司同时更名为"智谱华章科技股份有限公司"(Knowledge Atlas Technology)。上市后股价持续大幅波动,2026年内一度冲高至市值约1.3万亿港元(约1670亿美元),随后回落至约900多亿美元区间。
- 链接: The first of China's 'AI tigers' goes public as Zhipu climbs in Hong Kong debut(CNBC)
- 链接: China's AI Firm Zhipu Climbs in Debut, Lagging Hardware Peers(彭博社)
2026-02 — GLM-5发布
- 2026年2月11日,智谱/Z.ai发布新一代旗舰大模型GLM-5,主打从"氛围编码"(vibe coding)到"智能体工程"(agentic engineering)的能力升级,被路透社等媒体视为智谱对标国际头部模型厂商的关键新品。
- 链接: Chinese AI startup Zhipu releases new flagship model GLM-5(路透社)
- 链接: GLM-5: From Vibe Coding to Agentic Engineering(Z.ai官方博客)
2026-07 — WAIC 2026聚焦"世界模型",智谱在具身智能专场罕见缺席;张鹏、唐杰仍将战略重心放在AGI而非"世界模型"品牌
- 2026年7月17-20日,第九届世界人工智能大会(WAIC 2026)在上海举行,具身智能与"世界模型 vs. VLA"技术路线的比较成为现场焦点议题之一;据多家媒体观察,中国"AI六小龙"中除智谱外均设展台参展,智谱为近三年来首次缺席WAIC。与此同时,7月11日智谱联合创始人/首席科学家唐杰在公司市值突破万亿港元后发布内部信,公布面向AGI的"摸高计划",聚焦长程任务、自主智能体、全流程自训练、极致安全治理四大方向——表明尽管CogVideoX在技术路线上具备向物理世界模拟/世界模型演进的潜力,但截至目前智谱官方的战略叙事仍以"通用人工智能(AGI)"而非"世界模型"品牌进行公开表达,与NVIDIA Cosmos、DeepMind Genie、World Labs等公司主动以"世界模型"自我定位的路径存在明显差异。
- 链接: 暴走30000步抢先逛WAIC 2026!一份攻略拆解AI和具身智能新趋势(新浪科技)
- 链接: 三位具身大佬WAIC 2026谈:世界模型如何让机器人"看懂"现实世界?(网易订阅)
- 链接: Exclusive: Zhipu's "Touch High" Plan Revealed — Tang Jie's Internal Letter Bets on Long-Horizon AGI Breakthroughs(BigGo Finance)