BazaarLinkBazaarLink
Anmelden
DokumentationAPI-ReferenzSDK-ReferenzAgentic-NutzungKI-Skills
Chat

Chat erstellen

Fordert eine Modellantwort für die angegebene Chat-Konversation an. Unterstützt sowohl Streaming- als auch Nicht-Streaming-Modi, mit einer OpenAI-kompatiblen Anfrage-/Antwortform über alle Modelle und Anbieter hinweg.

POST/api/v1/chat/completions

Autorisierung

Authorizationerforderlich
string · header

API-Schlüssel als Bearer-Token im Authorization-Header.

Body

modelerforderlich
string

Das zu verwendende Modell, mit Provider-Präfix, z. B. "openai/gpt-4.1". Kurz-IDs gängiger Modellfamilien (z. B. "gpt-4o") werden automatisch zur vollständigen kanonischen ID ("openai/gpt-4o") aufgelöst; bereits kanonische Werte werden unverändert durchgereicht. Eine nicht erkannte Kurz-ID wird nicht zwangsweise umgeschrieben — die Modellauflösung liefert stattdessen einen klaren Model-not-found-Fehler.

minLength: 1
Example: "openai/gpt-4.1"
messageserforderlich
Message[]

Array von Konversationsnachrichten, mindestens eine. Jede hat eine role (system/user/assistant/tool) und content.

minLength: 1
models
string[]

Fallback-Modellliste — wird der Reihe nach versucht, nur verwendet, wenn die Kandidatengruppe des primären Modells erschöpft ist.

stream
boolean

true streamt die Antwort als SSE; weggelassen oder false liefert eine einzelne JSON-Antwort.

temperature
number

Sampling-Temperatur — höher ist zufälliger, niedriger ist deterministischer.

0–2
max_tokens
integer

Maximale Anzahl an Tokens, die die Antwort generieren darf.

max_completion_tokens
integer

Alias von max_tokens mit identischer Semantik.

top_p
number

Nucleus-Sampling-Schwellenwert.

0–1
top_k
integer

Begrenzt das Sampling auf die K wahrscheinlichsten Tokens.

frequency_penalty
number

Bestraft Tokens basierend darauf, wie oft sie bereits aufgetreten sind.

-2.0–2.0
presence_penalty
number

Bestraft Tokens basierend darauf, ob sie überhaupt aufgetreten sind, unabhängig von der Anzahl.

-2.0–2.0
repetition_penalty
number

Wiederholungsstrafkoeffizient — ein separater Mechanismus von frequency/presence penalty.

min_p
number

Mindestwahrscheinlichkeitsschwelle relativ zum wahrscheinlichsten Token.

0–1
top_a
number

Ein weiterer dynamischer Cutoff-Sampling-Mechanismus, der den Schwellenwert durch das Quadrat der höchsten Wahrscheinlichkeit skaliert.

seed
integer

Deterministischer Sampling-Seed; nicht alle Provider garantieren Reproduzierbarkeit.

n
integer

Anzahl der zu generierenden Antworten.

stop
string | string[]

Sequenzen, bei denen die Generierung stoppt, bis zu 4.

tools
Tool[]

Liste der Tool-/Funktionsdefinitionen, die das Modell aufrufen kann.

tool_choice
string | object

Steuert, ob/wie das Modell zum Aufrufen eines Tools gezwungen wird.

parallel_tool_calls
boolean

Ob parallele Tool-Aufrufe erlaubt sind, wenn tools bereitgestellt werden. Standard true. Nur für Modelle der OpenAI-Familie — wird stillschweigend entfernt, wenn das Zielmodell nicht von OpenAI stammt, kein Fehler.

response_format
object

Schränkt das Ausgabeformat ein, z. B. {type:"json_object"} oder {type:"json_schema"} mit einem JSON Schema.

logit_bias
object

Ordnet Token-IDs Bias-Werten [-100, 100] zu, die vor dem Sampling addiert werden. Nur für Modelle der OpenAI-Familie — wird stillschweigend entfernt, wenn das Zielmodell nicht von OpenAI stammt, kein Fehler.

logprobs
boolean

Gibt Log-Wahrscheinlichkeiten jedes Ausgabe-Tokens zurück. Nur für Modelle der OpenAI-Familie — wird stillschweigend entfernt, wenn das Zielmodell nicht von OpenAI stammt, kein Fehler.

top_logprobs
integer

Anzahl der wahrscheinlichsten zurückzugebenden Tokens pro Position (erfordert logprobs: true). Nur für Modelle der OpenAI-Familie — wird stillschweigend entfernt, wenn das Zielmodell nicht von OpenAI stammt, kein Fehler.

0–20
user
string

Endbenutzer-Kennung für Überwachung und Missbrauchserkennung. Hat keine Auswirkung auf die Abrechnung. Nur für Modelle der OpenAI-Familie — wird stillschweigend entfernt, wenn das Zielmodell nicht von OpenAI stammt, kein Fehler.

reasoning
object

Denk-Steuerungsobjekt für Reasoning-Modelle (z. B. {effort, max_tokens}).

reasoning_effort
string

Flaches Kurzformfeld für reasoning.effort.

lowmediumhigh
image_config
object

Optionen für Bildgenerierung/-bearbeitung (verwendet, wenn modalities image enthält).

modalities
string[]

Angeforderte Ausgabemodalitäten. Bei image erfolgt Routing über den Bildgenerierungs-Dispatch-Pfad.

textimage
plugins
object[]

Array von Plugins (z. B. {id:"web"} für Websuche). Nur auf manchen Modellrouten unterstützt, sonst wirkungslos; die Modellvariante :online injiziert automatisch {id:"web"}, ebenfalls nur auf unterstützenden Routen.

POST /api/v1/chat/completions
curl https://bazaarlink.ai/api/v1/chat/completions \
  -H "Authorization: Bearer $BAZAARLINK_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-4.1",
    "messages": [{"role": "user", "content": "Explain quantum computing in one paragraph."}]
  }'
Antwortbeispiele

Erfolg. BazaarLink normalisiert genau zwei Felder — model und die Entfernung eines provider-Felds — und leitet den Rest der Upstream-Antwort unverändert weiter, einschließlich Feldern wie native_finish_reason, system_fingerprint und reasoning, die nur vorhanden sind, wenn der jeweilige Anbieter sie befüllt. usage.cost ist die Ausnahme — immer der von BazaarLink selbst abgerechnete Betrag, kein von Upstream weitergeleiteter Wert.

{
  "id": "chatcmpl-abc123",
  "object": "chat.completion",
  "created": 1740000000,
  "model": "openai/gpt-4o",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Quantum computing leverages quantum mechanics..."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 28,
    "completion_tokens": 74,
    "total_tokens": 102,
    "cost": 0.000648
  }
}
Support
Support
Hi! How can we help you?
Send a message and we'll get back to you soon.
Chat erstellen — BazaarLink API