สร้างแชท
ร้องขอการตอบสนองของโมเดลสำหรับบทสนทนาแชทที่กำหนด รองรับทั้งโหมด streaming และ non-streaming ด้วยรูปแบบคำขอ/การตอบกลับที่เข้ากันได้กับ OpenAI แบบเดียวกันในทุกโมเดลและผู้ให้บริการ
/api/v1/chat/completionsการอนุญาต
Authorizationจำเป็นAPI key เป็น bearer token ใน header Authorization
Body
modelจำเป็นโมเดลที่จะใช้ ในรูปแบบมีคำนำหน้าผู้ให้บริการ เช่น "openai/gpt-4.1" id แบบสั้นของตระกูลโมเดลทั่วไป (เช่น "gpt-4o") จะถูกแปลงเป็น canonical id แบบเต็มโดยอัตโนมัติ ("openai/gpt-4o"); ค่าที่เป็น canonical อยู่แล้วจะผ่านไปตามเดิม id แบบสั้นที่ไม่รู้จักจะไม่ถูกเขียนทับโดยบังคับ — ขั้นตอนแก้ไขโมเดลจะคืนข้อผิดพลาด model-not-found ที่ชัดเจนแทน
"openai/gpt-4.1"messagesจำเป็นอาร์เรย์ของข้อความสนทนา อย่างน้อยหนึ่งรายการ แต่ละข้อความมี role (system/user/assistant/tool) และ content
modelsรายการโมเดลสำรอง — ลองตามลำดับ ใช้ก็ต่อเมื่อกลุ่มตัวเลือกของโมเดลหลักหมดแล้วเท่านั้น
streamtrue จะสตรีมการตอบกลับแบบ SSE; ละไว้หรือ false จะคืนค่าการตอบกลับ JSON เดียว
temperatureอุณหภูมิการสุ่มตัวอย่าง — ยิ่งสูงยิ่งสุ่ม ยิ่งต่ำยิ่งแน่นอน
max_tokensจำนวนโทเค็นสูงสุดที่การตอบกลับสามารถสร้างได้
max_completion_tokensชื่อแทนของ max_tokens ที่มีความหมายเดียวกัน
top_pเกณฑ์ nucleus sampling
top_kจำกัดการสุ่มตัวอย่างให้เหลือ K โทเค็นที่มีความน่าจะเป็นสูงสุด
frequency_penaltyลงโทษโทเค็นตามความถี่ที่ปรากฏมาแล้ว
presence_penaltyลงโทษโทเค็นตามว่าเคยปรากฏหรือไม่ ไม่นับจำนวนครั้ง
repetition_penaltyค่าสัมประสิทธิ์บทลงโทษการซ้ำ — กลไกแยกจาก frequency/presence penalty
min_pเกณฑ์ความน่าจะเป็นขั้นต่ำเทียบกับโทเค็นที่มีโอกาสสูงสุด
top_aกลไกการสุ่มตัวอย่างแบบตัดขอบเขตแบบไดนามิกอีกแบบ ปรับเกณฑ์ตามกำลังสองของความน่าจะเป็นสูงสุด
seedseed สุ่มแบบกำหนดได้ ไม่ใช่ทุกผู้ให้บริการที่รับประกันการทำซ้ำได้
nจำนวนการตอบกลับที่จะสร้าง
stopลำดับที่ทำให้การสร้างหยุด สูงสุด 4 รายการ
toolsรายการนิยามเครื่องมือ/ฟังก์ชันที่โมเดลสามารถเรียกใช้ได้
tool_choiceควบคุมว่าโมเดลจะถูกบังคับให้เรียกเครื่องมือหรือไม่/อย่างไร
parallel_tool_callsอนุญาตให้เรียกเครื่องมือแบบขนานเมื่อมี tools หรือไม่ ค่าเริ่มต้น true ใช้ได้เฉพาะโมเดลตระกูล OpenAI เท่านั้น — จะถูกตัดออกอย่างเงียบ ๆ เมื่อโมเดลเป้าหมายไม่ใช่ของ OpenAI ไม่ใช่ข้อผิดพลาด
response_formatจำกัดรูปแบบเอาต์พุต เช่น {type:"json_object"} หรือ {type:"json_schema"} พร้อม JSON Schema
logit_biasแมป ID โทเค็นไปยังค่าอคติ [-100, 100] ที่เพิ่มก่อนการสุ่มตัวอย่าง ใช้ได้เฉพาะโมเดลตระกูล OpenAI เท่านั้น — จะถูกตัดออกอย่างเงียบ ๆ เมื่อโมเดลเป้าหมายไม่ใช่ของ OpenAI ไม่ใช่ข้อผิดพลาด
logprobsคืนค่า log probabilities ของแต่ละโทเค็นเอาต์พุต ใช้ได้เฉพาะโมเดลตระกูล OpenAI เท่านั้น — จะถูกตัดออกอย่างเงียบ ๆ เมื่อโมเดลเป้าหมายไม่ใช่ของ OpenAI ไม่ใช่ข้อผิดพลาด
top_logprobsจำนวนโทเค็นที่น่าจะเป็นไปได้มากที่สุดต่อตำแหน่ง (ต้องใช้ logprobs: true) ใช้ได้เฉพาะโมเดลตระกูล OpenAI เท่านั้น — จะถูกตัดออกอย่างเงียบ ๆ เมื่อโมเดลเป้าหมายไม่ใช่ของ OpenAI ไม่ใช่ข้อผิดพลาด
userตัวระบุผู้ใช้ปลายทางสำหรับการตรวจสอบและตรวจจับการละเมิด ไม่มีผลต่อการเรียกเก็บเงิน ใช้ได้เฉพาะโมเดลตระกูล OpenAI เท่านั้น — จะถูกตัดออกอย่างเงียบ ๆ เมื่อโมเดลเป้าหมายไม่ใช่ของ OpenAI ไม่ใช่ข้อผิดพลาด
reasoningอ็อบเจ็กต์ควบคุมการคิดของโมเดล reasoning (เช่น {effort, max_tokens})
reasoning_effortฟิลด์แบบย่อของ reasoning.effort
lowmediumhighimage_configตัวเลือกการสร้าง/แก้ไขภาพ (ใช้เมื่อ modalities มี image)
modalitiesโมดัลลิตีเอาต์พุตที่ร้องขอ หากมี image จะเดินทางผ่านเส้นทาง dispatch การสร้างภาพ
textimagepluginsอาร์เรย์ปลั๊กอิน (เช่น {id:"web"} เพื่อเปิดค้นหาเว็บ) รองรับเฉพาะบางเส้นทางโมเดล ไม่มีผลกรณีอื่น ตัวแปรโมเดล :online จะแทรก {id:"web"} อัตโนมัติ ก็จำกัดเฉพาะเส้นทางที่รองรับเช่นกัน