API du bouclier d’invite
L’API Prompt Shield vous permet d’analyser les invites et les réponses de n’importe quelle application. Vous n’avez pas besoin d’utiliser l’infrastructure de chatbot intégrée de SecureAI. Intégrez le moteur d’analyse dans votre propre pipeline LLM avec trois points de terminaison REST. Prompt Shield peut être utilisé de deux manières :- API d’analyse autonome : les points de terminaison
/scan,/scan-outputet/scan-conversationdocumentés ci-dessous, pour votre propre pipeline LLM. - En ligne lors des complétions — lorsque vous appelez Chat Completion ou le Point de terminaison compatible OpenAI, Prompt Shield s’exécute automatiquement et peut être réglé par appel. Voir Contrôle par appel des achèvements.
Contrôle par appel sur les achèvements
Les demandes d’achèvement analysent automatiquement les entrées (et les sorties) via Prompt Shield lorsque la clé API l’a activé. Vous pouvez remplacer le comportement d’un seul appel avec un objetprompt_shield dans le corps de la requête :
Vous ne pouvez pas combiner
policy avec enabled: false. La stratégie appliquée est renvoyée sur la réponse (metadata.prompt_shield_policy sur le point de terminaison classique, secureai.prompt_shield_policy sur le point de terminaison /v1). Pour prévisualiser le verdict d’un appel sans exécuter le modèle, utilisez Policy Check.
Authentification
Toutes les requêtes API Prompt Shield nécessitent une clé API SecureAI dans l’en-têteAuthorization :
URL de base
POST /analyse
Analysez une invite d’utilisateur unique pour les attaques par injection avant de l’envoyer à votre LLM.Demande
Réponse
Modèle d’intégration recommandé
POST /scan-sortie
Analysez une réponse LLM à la recherche de preuves de compromission, notamment une fuite d’invite du système, une fuite de jeton Canary ou une dérive de rôle.Demande
Réponse
POST /scan-conversation
Analysez l’intégralité d’une conversation à plusieurs tours en même temps. Ceci est utile pour l’analyse par lots ou pour évaluer les conversations historiques en vue d’une détection rétroactive.Demande
Réponse
Réponses d’erreur
Limites de débit et performances
- La latence d’analyse est généralement de 1 à 5 ms pour les couches regex et heuristique.
- L’ajout de la couche ML augmente la latence à 20-50 ms selon le fournisseur d’intégration.
- L’API externe partage les limites de débit avec le reste de votre allocation de clé API.
- Le disjoncteur renvoie des réponses
503si le moteur subit 5 pannes consécutives dans les 30 secondes.
Activation de Prompt Shield sur une clé API
- Accédez à Admin -> Clés API.
- Modifiez la clé API que vous utilisez pour les appels externes.
- Activez Activer le bouclier d’invite.
- Vous pouvez éventuellement définir Sensibilité du bouclier d’invite sur
strict,balancedoupermissive. - Définissez éventuellement Prompt Shield Policy pour lier une stratégie spécifique à cette clé.
- Enregistrez.
/api/external/prompt-shield/* effectuées avec cette clé passent par le moteur avec la stratégie configurée.
