IA
Guardrails
Aussi : garde-fous · safety rails
En clair
Les garde-fous sont les règles et les filtres placés autour du modèle, indépendamment de ce qu’il produit : sujets interdits, vérification des réponses avant affichage, actions bloquées avant exécution. Ils ne dépendent pas de sa bonne volonté. C’est la différence entre demander poliment à un système de ne pas faire quelque chose, et l’en empêcher.
Concrètement
Un contrôle bloque toute réponse contenant un numéro de compte bancaire avant qu’elle ne s’affiche, quelle que soit la question posée.
Pourquoi ça compte
Une règle écrite dans la consigne peut être contournée par un utilisateur déterminé. Un filtre qui s’exécute après le modèle, non.
Définition technique
Règles et filtres (policy, classifiers, allowlists) qui limitent les sorties ou actions dangereuses d’un système IA.
Termes liés
Vu dans ces articles
- LLM auto-hébergés en agence : choisir selon l’usage, pas le benchmark13 septembre 2026
- Meta Muse : quand l’IA agit à votre place, la sécurité change d’échelle9 septembre 2026
- ChatGPT Images 2.5 : ce qui change vraiment pour créer et retoucher des images8 septembre 2026
- Quand Gutenberg devient la grammaire des agents IA dans WordPress4 septembre 2026
- GPT-6 Astra : le modèle de code qu’OpenAI a dû ralentir3 septembre 2026