LoopToken
对话补全 (Chat)

DeepSeek 系列

DeepSeek 通用与 R1 推理模型

适用模型

模型类型上下文最大输出
deepseek-v4-flash通用1,000,000128,000
deepseek-v4-pro通用1,000,000128,000
deepseek-v3.2通用128,0008,000
DeepSeek-R1推理128,00016,000
DeepSeek-R1-0528推理128,00016,000

公开协议

DeepSeek 官方 API 与 OpenAI 格式兼容,因此统一调用 POST /v1/chat/completions。R1 模型的推理内容可能出现在 reasoning_content,不要把该字段回传到下一轮 messages;只回传最终 content 和工具调用消息。

{
  "model": "DeepSeek-R1-0528",
  "messages": [{"role": "user", "content": "证明根号 2 是无理数"}],
  "stream": true,
  "max_tokens": 4096
}

请求参数

参数类型必填默认值说明
modelstring-本页适用模型之一
messagesarray-对话消息列表
messages[].rolestring-systemuserassistanttool
messages[].contentstring-消息文本
streambooleanfalse是否启用 SSE 流式输出
max_tokensinteger模型默认最大输出 Token 数
temperaturenumber1采样温度,范围 [0, 2)
top_pnumber1核采样阈值,范围 (0, 1]
frequency_penaltynumber0频率惩罚,范围 [-2, 2]
presence_penaltynumber0存在惩罚,范围 [-2, 2]
stopstring/array-停止序列
toolsarray-函数工具定义
tool_choicestring/objectauto工具选择策略
response_formatobject{"type":"text"}可设置 JSON Object 输出

响应参数

参数类型说明
idstring请求 ID
objectstringchat.completionchat.completion.chunk
createdintegerUnix 时间戳
modelstring模型名称
choices[].message.contentstring/null最终答案
choices[].message.reasoning_contentstring/nullR1 模型的推理内容
choices[].message.tool_callsarray工具调用列表
choices[].finish_reasonstringstoplengthtool_calls
usage.prompt_tokensinteger输入 Token 数
usage.completion_tokensinteger输出 Token 数,包含模型返回的推理 Token
usage.total_tokensinteger总 Token 数
R1 成功响应
{
  "id": "chatcmpl_01H...",
  "object": "chat.completion",
  "created": 1783819200,
  "model": "DeepSeek-R1-0528",
  "choices": [{
    "index": 0,
    "message": {
      "role": "assistant",
      "reasoning_content": "采用反证法,假设根号 2 可以写成最简分数……",
      "content": "假设 √2=a/b 且 a、b 互质……因此 √2 是无理数。"
    },
    "finish_reason": "stop"
  }],
  "usage": {"prompt_tokens": 16, "completion_tokens": 230, "total_tokens": 246}
}

推理字段的流式读取与多轮对话规则见推理模型,错误响应见错误码

本页内容