Skip to main content
POST
OpenAI-compatible chat completion

Point de terminaison compatible OpenAI

SecureAI expose une surface compatible OpenAI afin que vous puissiez intégrer n’importe quel SDK OpenAI en modifiant uniquement l’URL de base et la clé API — aucune modification de code. La pile de sécurité complète SecureAI (authentification par clé API, listes d’autorisation de modèle/index, application de la politique SMLTP + droits, Prompt Shield, PII/DLP, facturation des points et le moteur de redondance de modèle) s’exécute en dessous.

Point de terminaison

Pointez le base_url de votre client OpenAI vers :
Zéro-Connaissance uniquementCette surface ne prend pas en charge les RAG/bases de connaissances. Les demandes sont épinglées sur Zero-Knowledge. Si vous avez besoin d’une récupération de base de connaissances, utilisez le point de terminaison classique Chat Completion.

Authentification

Utilisation d’un SDK OpenAI

###Python (openai)
###JavaScript (openai)

Corps de la demande

Les champs OpenAI standard sont pris en charge. messages est requis (il n’y a pas de prompt sur cette surface). max_completion_tokens est accepté comme alias pour max_tokens. Les paramètres OpenAI suivants sont transmis tels quels au fournisseur : tools, tool_choice, parallel_tool_calls, response_format, stop, top_p, frequency_penalty, presence_penalty, seed, logprobs, top_logprobs, user.

Champs d’extension SecureAI

Envoyez-les sous forme de champs de corps supplémentaires (via extra_body dans les SDK OpenAI) :

Réponse

Forme OpenAI standard chat.completion, plus un objet d’extension secureai.
secureai.smltp_bundle_id (lorsqu’il est présent) peut être échangé contre un [reçu] de conformité signé (/fr/en/api/receipts).

Diffusion

Réglez stream: true. Les cadres sont des objets natifs OpenAI chat.completion.chunk terminés par data: [DONE]. L’extension secureai est attachée au premier morceau. choices (y compris les deltas tool_calls et finish_reason) traversent intacts.

Erreurs

Les erreurs de ce gestionnaire utilisent l’enveloppe OpenAI :
Lorsqu’une chaîne de redondance entière échoue, l’erreur utilise code: "all_models_failed" et l’état 429 (toutes les limites de débit) ou 502 (sinon). Les rejets de middleware de sécurité conservent la forme SecureAI { "success": false, ... } ; les deux portent toujours un message.

Connexes

Autorisations

Authorization
string
header
requis

API key authentication using Bearer token format. Example: Authorization: Bearer sk-your-api-key-here

Corps

application/json
model
string
requis
Exemple:

"openai/gpt-5-nano"

messages
object[]
requis
temperature
number
max_tokens
integer
stream
boolean
models
string[]
fallback_models
string[]
redundancy
object

{ timeout_ms, first_token_timeout_ms, on[] }

smltp_policy
string
prompt_shield
object

{ enabled?, policy? } per-call Prompt Shield override

Réponse

OpenAI chat.completion object plus a secureai extension