返回 AI 工具目录
GLM
开发框架人工精选最近核验 2026年7月23日
GLM 是智谱(zai-org / z.ai)推出的开源大语言模型家族,面向复杂系统工程与长程 Agent(智能体)任务。GLM-5 系列采用 Mixture-of-Experts(混合专家)架构,在推理、代码生成与多步骤 Agent 执行上做了强化,并提供长上下文能力。模型权重以 Apache-2.0 许可在 Hugging Face、魔搭(ModelScope)开放,提供 BF16 与 FP8 精度,可通过 vLLM、SGLang、Transformers 等本地部署,也可经 z.ai 平台调用 API。支持中英文并附中文文档,适合需要自主可控、可私有部署强模型的团队。
定价开源部署API 接入、本地运行、自托管国内可达国内可达许可Apache-2.0
解决什么问题
- 提供可私有部署的开源强基座模型
- 面向代码生成与长程 Agent 任务优化
- MoE 架构在同规模下控制推理成本
- 长上下文支持处理大篇幅输入
- 中英文能力与中文文档齐备
适合
- 需要自主可控、可私有部署基座模型的团队
- 以代码、推理或 Agent 为核心的应用
- 希望规避闭源 API 数据出域的场景
- 有 GPU 资源做本地推理或微调
不适合
- 权重体量大,本地部署需较高显存与工程投入
- 轻量场景用小模型或直接调 API 更划算
- 官方基准分数以其自测为准,需自行验证
- 经 z.ai API 调用属境外入口,合规需评估
如何接入
- 从 Hugging Face 或魔搭下载开源权重
- 用 vLLM、SGLang、Transformers 本地推理
- 经 Slime、ms-swift 做微调
- 经 z.ai 平台以 API 方式调用
已知限制
- 大参数模型对显存与算力要求高
- 官方发布的基准指标需独立复现
- z.ai 平台为境外入口,访问与出域需评估
- 开源许可条款与商用范围需自行核对
接入与使用事实
- 部署方式
- API 接入、本地运行、自托管
- 实现语言
- 中文、英文
- 中文界面
- 待确认
- 中文文档
- 待确认
- 定价方式
- 开源
- 许可证
- Apache-2.0
- 国内可达性
- 国内可达
- 可达性观察
- 待补充
权限、依赖与维护信号
这些字段记录公开可见信号,不等同于安全审计结论。
权限信号
暂无公开信号。
依赖信号
暂无公开信号。
维护信号
暂无公开信号。
公开来源与证据
暂无可公开的来源链接。
