创建聊天
为给定的对话请求模型回应。支持串流与非串流两种模式,单一 OpenAI 兼容请求/响应格式跨所有模型与供应商通用。
/api/v1/chat/completions验证
Authorization必填在 Authorization 标头以 Bearer token 传入 API 密钥。
Body
model必填要使用的模型,供应商前缀格式,例如 "openai/gpt-4.1"。 常见家族的简称(例如 "gpt-4o")会自动解析为完整的 canonical id("openai/gpt-4o");已是 canonical 形式的值原样通过。无法解析的简称不会被硬改写,模型解析阶段会返回清楚的「找不到模型」错误。
"openai/gpt-4.1"messages必填对话消息数组,至少一条。每条含 role(system/user/assistant/tool)与 content。
models备用模型列表——依序尝试,主要模型的候选组全部失败时才会用到。
streamtrue 时以 SSE 串流回应;省略或 false 为一次性 JSON 回应。
temperature采样温度,越高越随机、越低越确定。
max_tokens响应可生成的最大 token 数。
max_completion_tokensmax_tokens 的别名,语义相同。
top_p核采样(nucleus sampling)阈值。
top_k限制采样时只从概率最高的 K 个 token 中选。
frequency_penalty依 token 已出现的频率惩罚重复。
presence_penalty依 token 是否曾出现过(不论次数)惩罚重复。
repetition_penalty重复 token 的惩罚系数,独立于 frequency/presence penalty 的另一种机制。
min_p相对于最高概率 token 的最小概率门槛。
top_a另一种动态调整采样范围的机制,依最高概率的平方缩放门槛。
seed确定性采样种子;非所有供应商都保证可重现。
n要生成的回应数量。
stop遇到即停止生成的字符串,最多 4 个。
tools模型可调用的工具/函数定义列表。
tool_choice控制模型是否/如何被强制调用工具。
parallel_tool_calls有提供 tools 时,是否允许并行工具调用。默认 true。 仅限 OpenAI 系列模型——目标模型不是 OpenAI 自家的时,此字段会被静默拿掉,不会报错。
response_format限制输出格式,例如 {type:"json_object"} 或带 JSON Schema 的 {type:"json_schema"}。
logit_bias把 token ID 对映到 [-100, 100] 的偏差值,在采样前加上。 仅限 OpenAI 系列模型——目标模型不是 OpenAI 自家的时,此字段会被静默拿掉,不会报错。
logprobs返回每个输出 token 的对数概率。 仅限 OpenAI 系列模型——目标模型不是 OpenAI 自家的时,此字段会被静默拿掉,不会报错。
top_logprobs每个位置返回概率最高的候选 token 数(需搭配 logprobs: true)。 仅限 OpenAI 系列模型——目标模型不是 OpenAI 自家的时,此字段会被静默拿掉,不会报错。
user终端使用者识别码,用于监控与滥用侦测。对计费无影响。 仅限 OpenAI 系列模型——目标模型不是 OpenAI 自家的时,此字段会被静默拿掉,不会报错。
reasoning推理模型的思考控制对象(例如 {effort, max_tokens})。
reasoning_effortreasoning.effort 的简写平面字段。
lowmediumhighimage_config图片生成/图生图选项(当 modalities 含 image 时使用)。
modalities要求的输出模态。含 image 时走图片生成派工路径。
textimageplugins插件数组(例如 {id:"web"} 启用网页搜索)。仅部分模型路由支持,不支持时无效;:online 模型变体会自动注入 {id:"web"},同样仅限支持的路由。