OpenAI Responses API
Erstelle zustandslose Modellantworten für Codex, SDKs und andere OpenAI-kompatible Clients.
api.langdock.com durch die Base URL deines Deployments: <deployment-url>/api/publicPOST /openai/{region}/v1/responses eine Modellantwort. Langdock unterstützt die OpenAI-Responses-Request- und Response-Form für die unten genannten Felder. Du kannst daher die OpenAI-SDK-Methode responses.create und andere Responses-kompatible Clients mit einem Langdock API-Key verwenden.
input-Elemente senden und Responses-output-Elemente lesen. Für Integrationen, die messages senden und choices auslesen, verwende OpenAI Chat Completions.
Unterstützte Felder
Übergebe einen String, Nachrichtenelemente oder Tool-Ergebnisse ininput. Langdock leitet unterstützte Werte für instructions, max_output_tokens, temperature, top_p, reasoning, text, metadata, include, truncation, service_tier, tools, tool_choice und parallel_tool_calls weiter. Der Endpunkt unterstützt natives Streaming mit Server-Sent Events und Function Tools, einschließlich paralleler Function Calls. Welche Einstellungen greifen, hängt vom ausgewählten Modell ab.
Der Pfadwert {region} muss eu, us oder global sein und zur Region passen, in der dein Modell verfügbar ist. Rufe GET /openai/{region}/v1/models mit derselben Region auf, um die in deinem Workspace verfügbaren Modelle aufzulisten. Wenn dein Workspace Bring your own key (BYOK) verwendet, können andere Modelle verfügbar sein.
Unterschiede zur OpenAI API
- Lasse
storeweg oder setze den Wert auffalse.store=truewird abgelehnt. previous_response_idwird nicht unterstützt und abgelehnt. Übergebe vorherige Nachrichten und Tool-Ergebnisse ininput.- Background Responses werden nicht unterstützt. Lasse
backgroundweg oder setze den Wert auffalse. - Gehostete Tools wie Web-Suche, File Search, Code Interpreter, Bildgenerierung, Computer Use und MCP werden nicht unterstützt.
- Function Tools werden unterstützt, einschließlich paralleler Function Calls.
OpenAI-Python-Bibliothek verwenden
Lege Langdock als Basis-URL fest und verwenderesponses.create:
Response streamen
Setzestream=True, um native Events der Responses API zu erhalten:
Zustandslose Unterhaltung mit Tool-Aufruf fortsetzen
Füge die zurückgegebenen Output-Elemente und das passendefunction_call_output zur nächsten Anfrage hinzu:
Codex verbinden
Erstelle einen persönlichen API-Key und öffne dann Deine Tools verbinden > Codex unter Einstellungen > Account > API-Keys. Wähle ein verfügbares OpenAI-kompatibles Modell und folge den generierten Schritten für dein Betriebssystem. Die Einrichtung zeigt Codex auf den Responses-Endpunkt von Langdock (wire_api = "responses") und dein ausgewähltes Modell.
Rate Limits
Die Standard-Limits sind 500 RPM (Anfragen pro Minute) und 60.000 TPM (Tokens pro Minute).- RPM wird je Workspace, Modell und API-Key begrenzt.
- TPM teilen sich alle API-Keys, die dasselbe Modell in einem Workspace verwenden.
- In Dedicated Deployments können Admins unter Einstellungen > Workspace > Produkte > API eigene Limits je Modell festlegen.
429 Too Many Requests. Erfolgreiche Antworten und Antworten mit Rate-Limit-Fehler enthalten die Response-Header x-ratelimit-limit-requests, x-ratelimit-limit-tokens, x-ratelimit-remaining-requests und x-ratelimit-remaining-tokens.
Die Nutzung persönlicher API-Keys zählt zusammen mit Chat- und Agenten-Nutzung zum Extra-Usage-Budget des Mitglieds. Die Nutzung von Workspace-API-Keys zählt zum API-Spend-Limit des Workspace. Siehe Persönliche API-Keys und Preise.
Autorisierungen
API key as Bearer token. Format "Bearer YOUR_API_KEY"
Pfadparameter
The region of the API to use.
eu, us, global Body
The model ID. Use the models endpoint to list models available in your workspace.
The input text or full conversation state to process.
Instructions added to the model context.
The maximum number of output tokens.
x >= 1Controls response randomness.
Controls nucleus sampling.
Whether to return native Responses API server sent events.
Function tool definitions. Hosted tools are not supported.
Controls whether the model can call a function.
none, auto, required Whether the model can return multiple function calls.
OpenAI Responses reasoning configuration.
OpenAI Responses text output configuration.
String metadata attached to the request.
Responses are not persisted. Omit this field or set it to false.
false Background responses are not supported.
false Additional response fields to include.
auto, disabled The OpenAI service tier forwarded to the model provider.
Antwort
Successful response or event stream.
A response returned by the OpenAI-compatible Responses endpoint.
Unique identifier for the response.
"resp_09e99d1f7f163d10016a678387353481"
The object type, which is always response.
response Unix timestamp in seconds when the response was created.
1785168775
Current response status.
completed, failed, in_progress, cancelled, queued, incomplete "completed"
Model used to generate the response.
"gpt-5-mini-2025-08-07"
Output items generated by the model.
Reasoning information generated by a reasoning model.
- Option 1
- Option 2
- Option 3
Unix timestamp in seconds when the response completed.
1785168778
Langdock does not support background responses.
false Aggregated text from all output_text items.
Error information when the response failed.
Details explaining why the response is incomplete.
Instructions used for the response.
Maximum number of output tokens configured for the response.
Whether the model can return multiple function calls.
Reasoning configuration used for the response.
Langdock Responses are never persisted.
false Sampling temperature used for the response.
Text output configuration used for the response.
Service tier used to process the response.
Tool choice used for the response.
Function tools available to the model.
Nucleus sampling value used for the response.
Truncation strategy used for the response.
auto, disabled Token usage for the response.
Metadata attached to the request.