Skip to main content
Les guardrails sont les règles absolues de ton agent. Elles sont vérifiées avant chaque réponse et passent devant tout le reste — même la base de connaissances. Si ton agent voit qu’une réponse va enfreindre une guardrail, il escalade au lieu d’envoyer. C’est ta ligne de sécurité quand tu lâches l’IA en autonomie.

Où se trouvent les guardrails

Sidebar : Mon Agent → Restrictions. Tu vois la liste de tes règles actives, avec un compteur en haut (“3 règles actives — appliquées avant chaque réponse IA”).

Ajouter une règle

1

Tape la règle en français, à l'impératif

Le système accepte du langage naturel. Pas besoin de format spécial.
2

Clique 'Ajouter'

La règle apparaît dans la liste, activée par défaut.
3

Vérifie qu'elle est claire et non ambigüe

Une règle floue donne des résultats flous. Préfère “Ne jamais promettre un délai inférieur à 5 jours ouvrés” plutôt que “Ne pas faire de promesses”.

Exemples qui fonctionnent bien

  • “Ne jamais proposer de remboursement sans escalade humaine”
  • “Ne jamais mentionner la concurrence par son nom”
  • “Toujours rediriger les questions sur les prix B2B vers l’équipe commerciale”
  • “Ne jamais partager les données personnelles d’un autre client”
  • “Toujours demander le numéro de commande avant de traiter un retour”
  • “Ne jamais promettre un délai de livraison spécifique en jours”
  • “Ne jamais dire ‘je suis une IA’ — utiliser ‘l’équipe SAV’ à la place”
  • “Ne jamais répondre à une question juridique — escalader systématiquement”

Activer / désactiver / supprimer

Chaque règle a un toggle. Désactive-la temporairement (pendant des soldes par exemple) sans la supprimer. La poubelle supprime définitivement. Tu peux aussi réordonner par priorité : les règles en haut sont vérifiées en premier.

Quand une règle se déclenche

Si l’agent détecte qu’il s’apprête à enfreindre une guardrail :
  1. Il n’envoie pas la réponse au client
  2. Il escalade vers ton équipe avec le motif out_of_policy
  3. Le ticket apparaît dans À traiter avec un drapeau rouge “Guardrail violée”
Tu retrouves ces escalades dans l’onglet Escalades.

Bien rédiger une guardrail

Une bonne guardrail :
  • Commence par “Ne jamais” ou “Toujours”
  • Décrit un comportement observable (pas une intention vague)
  • N’a pas plus d’une condition par règle
  • Précise quoi faire à la place quand c’est utile
Mauvaise : “Sois prudent avec les remboursements”
Bonne : “Ne jamais valider un remboursement supérieur à 50 € — escalader systématiquement”

Limites

Pas de limite stricte. Au-delà de 20 règles, ton agent devient lent et peut commencer à se contredire. Vise 8-15 règles ciblées.
Oui, formulée en langage naturel. Ex : “Si le client demande un remboursement et que sa commande date de plus de 30 jours, escalader”. L’IA comprend la condition.
Oui. Si une règle dit “Ne jamais partager le numéro de téléphone du SAV” et qu’une entrée KB contient ce numéro, la règle gagne. L’agent escaladera plutôt que de transmettre.

Workflow recommandé

  1. Démarre avec 3-5 règles génériques (les exemples ci-dessus). Ça couvre 80 % des risques.
  2. Teste dans le Simulateur — joue des scénarios qui essayent d’enfreindre tes règles. Vérifie que l’agent escalade.
  3. Affine après 2 semaines de prod — regarde les escalades remontées dans À traiter. Si une situation revient souvent, transforme-la en règle.
  4. Audite mensuellement — supprime les règles obsolètes, fusionne les redondantes.

FAQ

99 % du temps, c’est que la règle est mal formulée. Va dans le drawer Reasoning de l’escalade pour voir ce que l’agent a interprété. Reformule avec plus de précision et re-teste dans le Simulateur.
Pas encore. Toutes les règles s’appliquent à tous les canaux. Si tu as un cas pressant, contacte contact@actero.fr.
Marginalement. Chaque règle ajoute 10-30 tokens au prompt. À l’échelle d’un mois, l’impact est négligeable.
Active une règle globale : “Ne jamais envoyer de réponse automatique — toujours escalader pour validation humaine”. Tu passes en mode “AI assist” pur. Voir aussi le mode auto-send dans Escalades.