对话模型
通用大模型(Kimi / GLM / DeepSeek)
通过 OpenAI Chat Completions 调用 Kimi、智谱 GLM、DeepSeek;按令牌分组开通
POST
通过 OpenAI Chat Completions 兼容接口调用 Kimi、智谱 GLM、DeepSeek。创建 API Key 时请选择对应令牌分组,否则无法调用该组模型。
豆包 Seed 对话模型见 豆包对话模型,与上表分组相互独立。实际是否可用以控制台「定价」页为准。
快速示例
参考单价(元 / 百万 token)
以下为平台挂牌参考价(输入 / 输出 / 缓存命中)。若令牌分组配置了倍率,实收 = 挂牌价 × 分组倍率。以控制台定价为准。LLM - Kimi
LLM - GLM
LLM - DeepSeek
思考(thinking)默认行为
请求未传思考相关字段时,平台会按模型补默认参数;你显式传入的字段不会被覆盖。关思考示例(GLM-5.2)
GLM-5.3 调用要点
- 1M 上下文,最大输出 128K tokens;始终启用思考,强度三档
low/high/max。 - 不传思考参数时按上游默认:
thinking.type=enabled、reasoning_effort=max。max档思考 token 占比高,输出计费相应增加;传"reasoning_effort": "low"可减少思考 token。 thinking与reasoning_effort为智谱厂商参数,平台原样透传。- 从
glm-5.2迁移:若原请求带"thinking": { "type": "disabled" },需改为enabled或删除该字段,否则请求会被上游拒绝。
开思考示例(DeepSeek)
参数说明
string
required
API Key 鉴权,格式
Bearer YOUR_API_KEY。Key 所属分组须覆盖目标模型。string
required
模型 ID,见上方各分组支持列表。
array
required
OpenAI 兼容消息数组,每项含
role 与 content。integer
本次回复最大输出 token(含思考 token)。开思考时建议适当加大。
boolean
default:false
设为
true 时以 SSE 流式返回。object
Kimi / GLM 思考开关,例如
{ "type": "enabled" } 或 { "type": "disabled" }。boolean
DeepSeek 思考开关。未传时平台默认
false。string
GLM 思考强度。
glm-5.3 支持 low / high / max(默认 max);glm-5.2 关闭思考时请设为 none。