对话补全 (Chat)
智谱 GLM 系列
GLM-5 系列对话模型的 OpenAI 兼容调用方式
适用模型
| 模型 | 上下文 | 最大输出 | 定位 |
|---|---|---|---|
glm-5.2 | 1,000,000 | 128,000 | 长上下文旗舰 |
glm-5-turbo | 200,000 | 128,000 | 低延迟版本 |
glm-5.1 | 200,000 | 128,000 | 通用模型 |
GLM-5.0 | 200,000 | 128,000 | 通用模型 |
公开协议
使用 POST /v1/chat/completions,请求和响应采用 OpenAI Chat Completions 格式。
curl https://api.vibelab.me/v1/chat/completions \
-H "Authorization: Bearer $LOOPTOKEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.2",
"messages": [{"role": "user", "content": "分析这份方案的三个主要风险"}],
"stream": false,
"max_tokens": 2048
}'请求参数
| 参数 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
model | string | 是 | - | 本页适用模型之一,大小写敏感 |
messages | array | 是 | - | 非空消息数组,按对话顺序排列 |
messages[].role | string | 是 | - | system、user、assistant 或 tool |
messages[].content | string/array | 是 | - | 文本,或模型支持的多模态内容块 |
stream | boolean | 否 | false | 是否使用 SSE 流式返回 |
max_tokens | integer | 否 | 模型默认 | 最大输出 Token 数,同时用于费用预估 |
temperature | number | 否 | 1 | 采样温度,建议范围 [0, 2) |
top_p | number | 否 | 1 | 核采样阈值,范围 (0, 1] |
stop | string/array | 否 | - | 遇到指定内容时停止生成 |
tools | array | 否 | - | 可调用的函数工具定义 |
tool_choice | string/object | 否 | auto | 工具调用策略 |
response_format | object | 否 | {"type":"text"} | 文本或 JSON 输出格式 |
seed | integer | 否 | - | 固定随机种子,提高复现概率 |
user | string | 否 | - | 终端用户标识 |
响应参数
| 参数 | 类型 | 说明 |
|---|---|---|
id | string | 本次补全请求 ID |
object | string | chat.completion;流式时为 chat.completion.chunk |
created | integer | 创建时间,Unix 秒 |
model | string | 实际使用的公开模型名称 |
choices | array | 生成结果列表 |
choices[].index | integer | 结果序号 |
choices[].message.role | string | 固定为 assistant |
choices[].message.content | string/null | 最终文本;工具调用时可能为 null |
choices[].message.tool_calls | array | 模型请求调用的工具 |
choices[].finish_reason | string | stop、length、tool_calls 或内容安全原因 |
usage.prompt_tokens | integer | 输入 Token 数 |
usage.completion_tokens | integer | 输出 Token 数 |
usage.total_tokens | integer | 总 Token 数 |
{
"id": "chatcmpl_01H...",
"object": "chat.completion",
"created": 1783819200,
"model": "glm-5.2",
"choices": [{
"index": 0,
"message": {"role": "assistant", "content": "主要风险包括需求边界、交付周期和外部依赖。"},
"finish_reason": "stop"
}],
"usage": {"prompt_tokens": 18, "completion_tokens": 22, "total_tokens": 40}
}错误响应格式及状态码见错误码。