Skip to main content

概述

ZAI 的 GLM 聊天模型运行在 VibeToken 上,通过标准的兼容 OpenAI 的聊天补全端点提供服务,支持流式输出和工具调用。涵盖 GLM-4.5GLM-4.6GLM-4.7GLM-5 系列,包括具备视觉能力的 GLM-4.5V / GLM-4.6V

模型

  • zai/glm-5.3-flash
  • zai/glm-5.2
  • zai/glm-5.1
  • zai/glm-5
  • zai/glm-4.7
  • zai/glm-4.6
  • zai/glm-4.6v
  • zai/glm-4.5
  • zai/glm-4.5v
  • zai/glm-4.5-air
本页不再列出价格。费率按模型配置在 VibeToken 目录中,并且可以按账号单独覆盖, 任何抄写到文档里的数字都会在下一次调价后失效。请通过 Models API 获取任一模型的实时费率:
模型 ID 中的斜杠需要 URL 编码 —— 例如 zai%2Fglm-5.2

端点

与 OpenAI 的 Chat Completions API 无缝兼容 —— 将你现有的 OpenAI 客户端指向 https://vibetoken.cn/v1,并使用 你的 VibeToken 密钥即可。有关所有支持的参数,请参阅完整的 Chat Completions 参考文档

快速开始

设置 "stream": true 即可启用 token 流式输出(Server-Sent Events), 与 OpenAI API 完全一致。将 model 替换为上表中的任意 id 即可。

视觉输入(GLM-4.5V / GLM-4.6V)

*V 模型使用标准的 OpenAI content-parts 格式,可在文本之外同时接受图像: