返回 AI 工具目录

GLM

开发框架人工精选最近核验 2026年7月23日

GLM 是智谱(zai-org / z.ai)推出的开源大语言模型家族,面向复杂系统工程与长程 Agent(智能体)任务。GLM-5 系列采用 Mixture-of-Experts(混合专家)架构,在推理、代码生成与多步骤 Agent 执行上做了强化,并提供长上下文能力。模型权重以 Apache-2.0 许可在 Hugging Face、魔搭(ModelScope)开放,提供 BF16 与 FP8 精度,可通过 vLLM、SGLang、Transformers 等本地部署,也可经 z.ai 平台调用 API。支持中英文并附中文文档,适合需要自主可控、可私有部署强模型的团队。

定价开源部署API 接入、本地运行、自托管国内可达国内可达许可Apache-2.0

解决什么问题

  • 提供可私有部署的开源强基座模型
  • 面向代码生成与长程 Agent 任务优化
  • MoE 架构在同规模下控制推理成本
  • 长上下文支持处理大篇幅输入
  • 中英文能力与中文文档齐备

适合

  • 需要自主可控、可私有部署基座模型的团队
  • 以代码、推理或 Agent 为核心的应用
  • 希望规避闭源 API 数据出域的场景
  • 有 GPU 资源做本地推理或微调

不适合

  • 权重体量大,本地部署需较高显存与工程投入
  • 轻量场景用小模型或直接调 API 更划算
  • 官方基准分数以其自测为准,需自行验证
  • 经 z.ai API 调用属境外入口,合规需评估

如何接入

  • 从 Hugging Face 或魔搭下载开源权重
  • 用 vLLM、SGLang、Transformers 本地推理
  • 经 Slime、ms-swift 做微调
  • 经 z.ai 平台以 API 方式调用

已知限制

  • 大参数模型对显存与算力要求高
  • 官方发布的基准指标需独立复现
  • z.ai 平台为境外入口,访问与出域需评估
  • 开源许可条款与商用范围需自行核对

接入与使用事实

部署方式
API 接入、本地运行、自托管
实现语言
中文、英文
中文界面
待确认
中文文档
待确认
定价方式
开源
许可证
Apache-2.0
国内可达性
国内可达
可达性观察
待补充

权限、依赖与维护信号

这些字段记录公开可见信号,不等同于安全审计结论。

权限信号

暂无公开信号。

依赖信号

暂无公开信号。

维护信号

暂无公开信号。

公开来源与证据

暂无可公开的来源链接。

访问官网