Skip to main content
POST
通过 OpenAI Chat Completions 兼容接口调用 Kimi智谱 GLMDeepSeek。创建 API Key 时请选择对应令牌分组,否则无法调用该组模型。
豆包 Seed 对话模型见 豆包对话模型,与上表分组相互独立。实际是否可用以控制台「定价」页为准。

快速示例

参考单价(元 / 百万 token)

以下为平台挂牌参考价(输入 / 输出 / 缓存命中)。若令牌分组配置了倍率,实收 = 挂牌价 × 分组倍率。以控制台定价为准。

LLM - Kimi

LLM - GLM

LLM - DeepSeek

思考(thinking)默认行为

请求未传思考相关字段时,平台会按模型补默认参数;你显式传入的字段不会被覆盖

关思考示例(GLM-5.2)

GLM-5.3 调用要点

  • 1M 上下文,最大输出 128K tokens;始终启用思考,强度三档 low / high / max
  • 不传思考参数时按上游默认:thinking.type=enabledreasoning_effort=maxmax 档思考 token 占比高,输出计费相应增加;传 "reasoning_effort": "low" 可减少思考 token。
  • thinkingreasoning_effort 为智谱厂商参数,平台原样透传。
  • glm-5.2 迁移:若原请求带 "thinking": { "type": "disabled" },需改为 enabled 或删除该字段,否则请求会被上游拒绝。
glm-5.3"thinking": { "type": "disabled" }、或 reasoning_effortlow / high / max 之外的值时,上游不返回参数错误,请求表现为 504 Gateway Timeout

开思考示例(DeepSeek)

开思考时,输出预算会被推理内容占用。短回答场景请提高 max_completion_tokens,或显式关闭思考。

参数说明

string
required
API Key 鉴权,格式 Bearer YOUR_API_KEY。Key 所属分组须覆盖目标模型。
string
required
模型 ID,见上方各分组支持列表。
array
required
OpenAI 兼容消息数组,每项含 rolecontent
integer
本次回复最大输出 token(含思考 token)。开思考时建议适当加大。
boolean
default:false
设为 true 时以 SSE 流式返回。
object
Kimi / GLM 思考开关,例如 { "type": "enabled" }{ "type": "disabled" }
boolean
DeepSeek 思考开关。未传时平台默认 false
string
GLM 思考强度。glm-5.3 支持 low / high / max(默认 max);glm-5.2 关闭思考时请设为 none

相关页面