智谱AI大模型开放平台提供多种AI模型服务,支持开发者和企业通过API接入GLM-4系列大模型。该系列包含GLM-4-Flash、GLM-4-Plus、支持长上下文的GLM-4-Long等版本,并提供视觉理解模型GLM-4V-Plus、文生图模型CogView-3-Plus、文生视频模型CogVideoX等多模态能力。平台为开发者提供模型API、Alltools API、批处理API等工具,覆盖医疗健康、汽车、游戏娱乐等行业解决方案。
2024年7月,智谱AI已有超过30万个智能体活跃在清言App可供使用。2025年7月,智谱AI发布新一代GLM-4.5大模型,该模型实现了推理、代码生成及智能体交互能力的融合。2026年1月,平台月访问量达121万次。开发者可创建自定义GLM智能体,通过API集成实现AI应用部署。2026年2月22日,针对GLM-5发布后规则透明度不够、灰度太慢等问题,智谱AI发布致歉信,承诺按照Max、Pro、Lite的顺序逐步开放GLM-5,并支持受影响用户申请退款。
GLM全名General Language Model,是一款基于自回归填空的预训练语言模型,其ChatGLM系列模型支持相对复杂的自然语言指令并且能够解决困难的推理类问题。
Embedding是一种将数据转化为向量形式的表示方法,通过将文本字符串转换为向量,使得数据能够有效用于搜索、聚类、推荐系统、异常检测和分类等应用场景。
Token是模型用来表示自然语言文本的基本单位,在GLM系列模型中token和字数的换算比例约为1:1.6。
上下文窗口是指模型在一次对话中能够处理的最大长度,包括用户输入的内容、模型生成的回复以及模型在生成回复过程中进行推理或调用工具时产生的中间内容;如果总文本量超过了上下文窗口的限制,超出的部分将被自动截断无法被处理,对于多模态模型,输入内容有严格长度限制。
智谱AI大模型开放平台通过API接口向开发者提供服务。
平台提供免费体验额度。
平台支持用户使用私有数据对模型进行微调。
截至2024年7月,平台已有超过40万注册用户,日均调用量达到600亿Tokens。
医疗健康行业:利用AI模型提升医疗服务效率,构建患者服务新生态。
汽车行业:通过AI技术提升客户用车体验,构建数字化转型。
游戏娱乐行业:AI技术赋能游戏制作,提升玩家沉浸乐趣。
智谱(Z.AI)成立于2019年,由清华大学计算机系知识工程实验室(KEG)技术成果转化而来,具备从底层算法、预训练框架到国产硬件适配的大模型全链路自主研发能力。公司以“让机器像人一样思考”为愿景,以实现通用人工智能(AGI)为目标,极致专注探索人工智能上限,致力于用大模型实现甚至超越人类的语言、推理、视觉、听觉、工具使用等能力。