Guardrails
Rédiger les règles qu'un agent doit respecter : le champ Guardrails, ce qu'il doit contenir et comment vérifier qu'il tient.
Agents à prompt uniqueGuardrails (garde-fous) est le troisième champ de prompt de Settings (paramètres) : règles de style, formulations à employer ou à éviter, et limites de ce que l’agent accepte de faire. C’est là que vous placez les règles qu’un responsable conformité ou support exigerait, et elles sont lues à chaque tour de parole, au même titre que Agent Identity (identité de l’agent) et Tasks (tâches).

Ce qui a sa place dans Guardrails
| Type de règle | Exemple |
|---|---|
| Sujets à refuser | Ne jamais donner de conseil médical, juridique ou financier. Proposer de réserver une consultation. |
| Faits à ne pas inventer | Ne citez pas de prix, de dates ou de disponibilités qui ne vous ont pas été fournis. Dites que vous allez vérifier. |
| Identité | Ne prétendez pas être une personne. Si on vous pose la question, dites que vous êtes un assistant virtuel. |
| Traitement des données | Ne demandez pas de numéros de carte ni de mots de passe. Orientez l’appelant vers le lien sécurisé. |
| Escalade | Lorsque l’appelant demande une personne, ou qu’il est contrarié, utilisez l’outil de transfert. |
| Style | Une question à la fois. Des réponses de moins de deux phrases. Lisez les chiffres un par un. |
| Langue | Répondez dans la langue de l’appelant s’il s’agit d’une langue prise en charge ; sinon, dites-le. |
Rédiger des règles qui tiennent
- Une règle par ligne, la plus importante en premier.
- Indiquez l’alternative. « Ne jamais X », à lui seul, laisse le modèle sans solution de repli ; « Ne jamais X. À la place, Y. » lui en donne une.
- Soyez concret. « Ne parlez pas des concurrents » est plus vague que « Si l’on vous interroge sur d’autres cliniques, dites que vous ne pouvez parler qu’au nom de Riverside Dental ».
- Ne répétez pas les tâches. Les garde-fous sont des limites, pas le plan. Dupliquer ici la liste des tâches affaiblit les deux.
- Restez bref. Une longue liste de règles est suivie moins fidèlement qu’une courte ; déplacez les remarques de style vers Agent Identity si la liste s’allonge.
Contrôles hors du prompt
- Tools (outils) : un agent ne peut effectuer que les actions pour lesquelles il dispose d’outils. Pas d’outil de transfert, pas de transfert. Voir Tools overview.
- Outcomes (résultats d’appel) : enregistrez le non-respect d’une règle sous forme
de champ, par exemple
gave_medical_adviceavec les valeursyesetno, puis filtrez les Call Logs (journaux d’appels) dessus. Voir Outcomes. - L’anonymisation des données personnelles et la rétention protègent les données après l’appel, quoi qu’il ait été dit. Voir Privacy and data.
- Les limites de durée d’appel et de silence mettent fin aux appels là où le prompt ne le peut pas. Voir Silence, reminders and call duration.
- Les évaluations rejouent des scénarios sur chaque version et signalent les régressions. Voir Evaluations.
Vérifier
Rédigez un scénario de test pour chaque règle dans Evaluation (évaluation) : un appelant qui demande un diagnostic, un appelant qui demande une personne, un appelant qui demande un prix. Exécutez-les après chaque modification du prompt.