Skip to main content

API du bouclier d’invite

L’API Prompt Shield vous permet d’analyser les invites et les réponses de n’importe quelle application. Vous n’avez pas besoin d’utiliser l’infrastructure de chatbot intégrée de SecureAI. Intégrez le moteur d’analyse dans votre propre pipeline LLM avec trois points de terminaison REST. Prompt Shield peut être utilisé de deux manières :
  1. API d’analyse autonome : les points de terminaison /scan, /scan-output et /scan-conversation documentés ci-dessous, pour votre propre pipeline LLM.
  2. En ligne lors des complétions — lorsque vous appelez Chat Completion ou le Point de terminaison compatible OpenAI, Prompt Shield s’exécute automatiquement et peut être réglé par appel. Voir Contrôle par appel des achèvements.

Contrôle par appel sur les achèvements

Les demandes d’achèvement analysent automatiquement les entrées (et les sorties) via Prompt Shield lorsque la clé API l’a activé. Vous pouvez remplacer le comportement d’un seul appel avec un objet prompt_shield dans le corps de la requête :
Vous ne pouvez pas combiner policy avec enabled: false. La stratégie appliquée est renvoyée sur la réponse (metadata.prompt_shield_policy sur le point de terminaison classique, secureai.prompt_shield_policy sur le point de terminaison /v1). Pour prévisualiser le verdict d’un appel sans exécuter le modèle, utilisez Policy Check.

Authentification

Toutes les requêtes API Prompt Shield nécessitent une clé API SecureAI dans l’en-tête Authorization :
Les clés API sont créées et gérées dans Admin -> Clés API. Pour activer Prompt Shield pour une clé API, modifiez la clé et activez Activer Prompt Shield. Vous pouvez éventuellement lier une politique spécifique à la clé.

URL de base


POST /analyse

Analysez une invite d’utilisateur unique pour les attaques par injection avant de l’envoyer à votre LLM.

Demande

Réponse

Modèle d’intégration recommandé


POST /scan-sortie

Analysez une réponse LLM à la recherche de preuves de compromission, notamment une fuite d’invite du système, une fuite de jeton Canary ou une dérive de rôle.

Demande

Réponse


POST /scan-conversation

Analysez l’intégralité d’une conversation à plusieurs tours en même temps. Ceci est utile pour l’analyse par lots ou pour évaluer les conversations historiques en vue d’une détection rétroactive.

Demande

Réponse


Réponses d’erreur


Limites de débit et performances

  • La latence d’analyse est généralement de 1 à 5 ms pour les couches regex et heuristique.
  • L’ajout de la couche ML augmente la latence à 20-50 ms selon le fournisseur d’intégration.
  • L’API externe partage les limites de débit avec le reste de votre allocation de clé API.
  • Le disjoncteur renvoie des réponses 503 si le moteur subit 5 pannes consécutives dans les 30 secondes.

Activation de Prompt Shield sur une clé API

  1. Accédez à Admin -> Clés API.
  2. Modifiez la clé API que vous utilisez pour les appels externes.
  3. Activez Activer le bouclier d’invite.
  4. Vous pouvez éventuellement définir Sensibilité du bouclier d’invite sur strict, balanced ou permissive.
  5. Définissez éventuellement Prompt Shield Policy pour lier une stratégie spécifique à cette clé.
  6. Enregistrez.
Toutes les requêtes /api/external/prompt-shield/* effectuées avec cette clé passent par le moteur avec la stratégie configurée.