Skip to main content
POST
Creates a stateless model response.
Du nutzt die API in einem Dedicated Deployment? Ersetze api.langdock.com durch die Base URL deines Deployments: <deployment-url>/api/public
Erstelle mit POST /openai/{region}/v1/responses eine Modellantwort. Langdock unterstützt die OpenAI-Responses-Request- und Response-Form für die unten genannten Felder. Du kannst daher die OpenAI-SDK-Methode responses.create und andere Responses-kompatible Clients mit einem Langdock API-Key verwenden.
Erstelle einen persönlichen API-Key oder frage deinen Workspace-Admin nach einem Workspace-API-Key mit dem Scope Completion API. Persönliche Keys enthalten ausschließlich den Scope Completion API.
Nutze diesen Endpunkt für Codex und andere Clients, die Responses-input-Elemente senden und Responses-output-Elemente lesen. Für Integrationen, die messages senden und choices auslesen, verwende OpenAI Chat Completions.

Unterstützte Felder

Übergebe einen String, Nachrichtenelemente oder Tool-Ergebnisse in input. Langdock leitet unterstützte Werte für instructions, max_output_tokens, temperature, top_p, reasoning, text, metadata, include, truncation, service_tier, tools, tool_choice und parallel_tool_calls weiter. Der Endpunkt unterstützt natives Streaming mit Server-Sent Events und Function Tools, einschließlich paralleler Function Calls. Welche Einstellungen greifen, hängt vom ausgewählten Modell ab. Der Pfadwert {region} muss eu, us oder global sein und zur Region passen, in der dein Modell verfügbar ist. Rufe GET /openai/{region}/v1/models mit derselben Region auf, um die in deinem Workspace verfügbaren Modelle aufzulisten. Wenn dein Workspace Bring your own key (BYOK) verwendet, können andere Modelle verfügbar sein.

Unterschiede zur OpenAI API

Langdock speichert keinen Zustand für die Responses API. Sende den vollständigen Gesprächsverlauf mit jeder Anfrage.
  • Lasse store weg oder setze den Wert auf false. store=true wird abgelehnt.
  • previous_response_id wird nicht unterstützt und abgelehnt. Übergebe vorherige Nachrichten und Tool-Ergebnisse in input.
  • Background Responses werden nicht unterstützt. Lasse background weg oder setze den Wert auf false.
  • Gehostete Tools wie Web-Suche, File Search, Code Interpreter, Bildgenerierung, Computer Use und MCP werden nicht unterstützt.
  • Function Tools werden unterstützt, einschließlich paralleler Function Calls.

OpenAI-Python-Bibliothek verwenden

Lege Langdock als Basis-URL fest und verwende responses.create:

Response streamen

Setze stream=True, um native Events der Responses API zu erhalten:

Zustandslose Unterhaltung mit Tool-Aufruf fortsetzen

Füge die zurückgegebenen Output-Elemente und das passende function_call_output zur nächsten Anfrage hinzu:

Codex verbinden

Erstelle einen persönlichen API-Key und öffne dann Deine Tools verbinden > Codex unter Einstellungen > Account > API-Keys. Wähle ein verfügbares OpenAI-kompatibles Modell und folge den generierten Schritten für dein Betriebssystem. Die Einrichtung zeigt Codex auf den Responses-Endpunkt von Langdock (wire_api = "responses") und dein ausgewähltes Modell.

Rate Limits

Die Standard-Limits sind 500 RPM (Anfragen pro Minute) und 60.000 TPM (Tokens pro Minute).
  • RPM wird je Workspace, Modell und API-Key begrenzt.
  • TPM teilen sich alle API-Keys, die dasselbe Modell in einem Workspace verwenden.
  • In Dedicated Deployments können Admins unter Einstellungen > Workspace > Produkte > API eigene Limits je Modell festlegen.
Bei einer Überschreitung erhältst du 429 Too Many Requests. Erfolgreiche Antworten und Antworten mit Rate-Limit-Fehler enthalten die Response-Header x-ratelimit-limit-requests, x-ratelimit-limit-tokens, x-ratelimit-remaining-requests und x-ratelimit-remaining-tokens. Die Nutzung persönlicher API-Keys zählt zusammen mit Chat- und Agenten-Nutzung zum Extra-Usage-Budget des Mitglieds. Die Nutzung von Workspace-API-Keys zählt zum API-Spend-Limit des Workspace. Siehe Persönliche API-Keys und Preise.
Browser- und CORS-Integrationen werden nicht unterstützt. Bewahre API-Keys serverseitig auf und rufe den Endpunkt über einen Server, eine CLI oder ein lokales Entwicklungstool auf. Weitere Informationen findest du in den Best Practices für API-Keys.

Autorisierungen

Authorization
string
header
erforderlich

API key as Bearer token. Format "Bearer YOUR_API_KEY"

Pfadparameter

region
enum<string>
erforderlich

The region of the API to use.

Verfügbare Optionen:
eu,
us,
global

Body

application/json
model
string
erforderlich

The model ID. Use the models endpoint to list models available in your workspace.

input
erforderlich

The input text or full conversation state to process.

instructions
string | null

Instructions added to the model context.

max_output_tokens
integer | null

The maximum number of output tokens.

Erforderlicher Bereich: x >= 1
temperature
number | null

Controls response randomness.

top_p
number | null

Controls nucleus sampling.

stream
boolean | null
Standard:false

Whether to return native Responses API server sent events.

tools
object[]

Function tool definitions. Hosted tools are not supported.

tool_choice

Controls whether the model can call a function.

Verfügbare Optionen:
none,
auto,
required
parallel_tool_calls
boolean | null

Whether the model can return multiple function calls.

reasoning
object

OpenAI Responses reasoning configuration.

text
object

OpenAI Responses text output configuration.

metadata
object | null

String metadata attached to the request.

store
enum<boolean> | null

Responses are not persisted. Omit this field or set it to false.

Verfügbare Optionen:
false
background
enum<boolean> | null

Background responses are not supported.

Verfügbare Optionen:
false
include
string[] | null

Additional response fields to include.

truncation
enum<string> | null
Verfügbare Optionen:
auto,
disabled
service_tier
string | null

The OpenAI service tier forwarded to the model provider.

Antwort

Successful response or event stream.

A response returned by the OpenAI-compatible Responses endpoint.

id
string
erforderlich

Unique identifier for the response.

Beispiel:

"resp_09e99d1f7f163d10016a678387353481"

object
enum<string>
erforderlich

The object type, which is always response.

Verfügbare Optionen:
response
created_at
integer
erforderlich

Unix timestamp in seconds when the response was created.

Beispiel:

1785168775

status
enum<string>
erforderlich

Current response status.

Verfügbare Optionen:
completed,
failed,
in_progress,
cancelled,
queued,
incomplete
Beispiel:

"completed"

model
string
erforderlich

Model used to generate the response.

Beispiel:

"gpt-5-mini-2025-08-07"

output
object[]
erforderlich

Output items generated by the model.

Reasoning information generated by a reasoning model.

completed_at
integer | null

Unix timestamp in seconds when the response completed.

Beispiel:

1785168778

background
enum<boolean>

Langdock does not support background responses.

Verfügbare Optionen:
false
output_text
string

Aggregated text from all output_text items.

error
object | null

Error information when the response failed.

incomplete_details
object | null

Details explaining why the response is incomplete.

instructions
string | null

Instructions used for the response.

max_output_tokens
integer | null

Maximum number of output tokens configured for the response.

parallel_tool_calls
boolean

Whether the model can return multiple function calls.

reasoning
object | null

Reasoning configuration used for the response.

store
enum<boolean>

Langdock Responses are never persisted.

Verfügbare Optionen:
false
temperature
number | null

Sampling temperature used for the response.

text
object | null

Text output configuration used for the response.

service_tier
string | null

Service tier used to process the response.

tool_choice

Tool choice used for the response.

tools
object[]

Function tools available to the model.

top_p
number | null

Nucleus sampling value used for the response.

truncation
enum<string>

Truncation strategy used for the response.

Verfügbare Optionen:
auto,
disabled
usage
object

Token usage for the response.

metadata
object | null

Metadata attached to the request.