GLM(General Language Model)是由北京智谱华章科技有限公司(智谱AI)研发的通用语言模型,其核心技术源于清华大学计算机系知识工程实验室(KEG),由清华大学教授唐杰创立。该模型系列基于Transformer架构,并于2019年采用“自回归填空”作为其通用预训练范式。
GLM系列始于2021年启动的框架研发。2022年8月推出千亿参数模型GLM-130B。2024年1月发布GLM-4。2025年9月,发布GLM-4.6;同年12月,GLM-4.7在全球“Intelligence Index”榜单中位列第六。2026年2月发布采用混合专家(MoE)架构的旗舰模型GLM-5;同年3月发布GLM-5.1,其在编程基准测试中于开源模型中排名第一;5月推出GLM-5.1高速版API。随着模型迭代,GLM系列在架构与训练技术上持续演进,应用了强化学习后训练、稀疏注意力等技术。该系列模型通过MaaS平台服务于政务、金融等行业。GLM系列模型已部署于Google Vertex AI、AWS Bedrock等云服务平台,其训练与推理采用国产化技术栈,并适配超过40款国产芯片。一款技术线索被指关联GLM系列的匿名模型上线OpenRouter平台。
GLM(General Language Model)是由北京智谱华章科技有限公司(智谱AI)研发的通用语言模型,其核心技术源于清华大学计算机系知识工程实验室(KEG)。
2019年,该团队启动了从零构建通用人工智能底座模型的任务,并提出了以‘自回归填空’作为通用预训练范式的GLM架构,该架构在结构上不同于GPT系列所采用的单向注意力机制。
GLM是中国首个自研的预训练大模型算法架构,并成为智谱AI后续系列模型的技术底座。
2021年,智谱启动GLM框架研发。2022年8月,推出千亿级大模型GLM-130B。2023年,推出对话式大模型ChatGLM。
2024年1月16日,智谱AI推出GLM-4新一代基座大模型。GLM-4采用在线大模型服务模式(MaaS),用户可通过API调用。
2025年,GLM系列模型进入快速迭代期。2025年9月,智谱发布GLM-4.6。该模型参与了全球百万用户盲测的大模型竞技场Code Arena的代码生成能力评测。同年12月发布的GLM-4.7参与了全球评测机构Artificial Analysis发布的“Intelligence Index”榜单评测。
2026年2月,智谱发布基座模型GLM-5。该模型采用MoE架构,支持超长程任务,并参与了SWE-bench Verified等评测。同年3月,发布GLM-5.1。2026年5月12日,GLM-5.1参与了全球评测机构Artificial Analysis发布的Coding Agent基准评测。
2026年5月22日,智谱宣布推出GLM-5.1高速版API,模型输出速度达到400 tokens/s。
GLM模型家族持续扩展,推出了包括GLM-5V-Turbo、GLM-Image、GLM-OCR等在内的专用模型。GLM系列模型已部署于Google Vertex AI、AWS Bedrock等云服务平台。
2026年8月24日,代号为Ox‑Alpha的匿名模型上线大模型聚合平台OpenRouter,上线首日调用量较高,其在OpenCode平台也受到了关注。有技术线索猜测该模型或与GLM系列有关。
GLM(General Language Model)的架构基于Transformer,但创新性地采用“自回归填空”作为其通用预训练范式。这使其在训练目标与生成方式上区别于GPT等单向自回归模型。核心结构主要包括Prefix Encoder和由多层GLMBlock组成的主模型,其中Prefix Encoder负责处理提示词。GLMBlock集成了多头自注意力机制、前馈网络、残差连接和层归一化技术,构成了模型处理序列的基础单元。
随着模型迭代,GLM系列在架构与训练技术上持续演进。旗舰模型GLM-5采用了混合专家(MoE)架构,总参数量达744B,其中激活参数量为40B。在GLM-5.1等后续模型上,智谱及合作伙伴支持并应用了强化学习后训练以优化模型对齐。并适配了稀疏注意力、多令牌预测等先进的训练技术以提升效率与性能。
GLM系列模型的训练与推理全面采用国产化技术栈。例如在华为昇腾910B芯片集群上使用自研的MindSpore框架进行大规模训练。并在推理端广泛适配了包括华为昇腾、摩尔线程、寒武纪、百度昆仑芯P800等昆仑芯系列在内的超过40款国产芯片。
智谱AI的商业模式核心是“MaaS(Model-as-a-Service)平台+B/G端客户”。其营收结构高度集中于国内政企市场,超七成收入来自政务、央企、金融能源行业本地化模型部署,剩余不到三成来自云端MaaS接口服务。2025年智谱全年营收7.24亿元,同比增长132%,综合毛利率41%;研发开支为31.8亿元。
根据瑞银研报披露,智谱AI的API平台年度经常性收入(ARR)已达约2.5亿美元。其面向全球开发者的“GLM Coding Plan”订阅用户数已突破24万,并经历多次提价。GLM-4.5的定价策略曾推动行业价格调整。
GLM模型已部署于Google Vertex AI、AWS Bedrock、Fireworks、Cerebras等云服务商,并入驻OpenRouter、Vercel等模型聚合平台,在OpenRouter付费模型中位列前列。例如,2026年8月,代号为“牛来”(Ox‑Alpha)的匿名模型在OpenRouter平台上线,支持百万Token上下文与多模态输入,上线首日调用量即登顶平台并刷新单日纪录,其强劲表现引发了社区对其与GLM系列技术关联的猜测。根据OpenCode平台官方信息,该匿名模型背后提供方每日拥有100万亿(100T)tokens的算力资源。其付费API收入规模较大。
智谱AI由清华大学教授、GLM模型创始人唐杰创立,唐杰同时担任清华大学计算机系知识工程实验室(KEG)主任。公司脱胎于清华大学知识工程实验室(KEG),其核心研发团队多为该实验室的师生,具有深厚的学术与技术背景。