Chargement des modèles…
SRE agentique (exploitation auto-réparatrice)(ASRE)
Une architecture d'exploitation en boucle fermée dans laquelle des agents maintiennent un système externe en bon état : détecter une anomalie, diagnostiquer la cause racine probable, exécuter une remédiation encadrée par des politiques, puis vérifier le rétablissement au regard des objectifs de fiabilité avant de refermer la boucle. Elle prend généralement la forme d'une équipe aux rôles spécialisés (détecteur, diagnostiqueur, remédiateur, vérificateur) opérant sous une gouvernance human-on-the-loop, où les ingénieurs définissent les politiques, les garde-fous et l'ensemble des actions autorisées tandis que les agents agissent dans ces limites et rendent compte. Des permissions à moindre privilège et une politique sous forme de code (policy-as-code) maintiennent les remédiations dans une enveloppe sûre, les actions les plus risquées étant soumises à une approbation humaine. À distinguer de `predictive-agent-fault-tolerance` : celui-ci maintient en vie le système d'agents lui-même, tandis qu'ici les agents effectuent un travail de fiabilité sur les systèmes externes qu'ils exploitent.
Aperçu en 30 secondes
- Quoi
- Les agents détectent les anomalies, diagnostiquent les causes racines, exécutent des correctifs encadrés par des politiques, puis vérifient le rétablissement au regard des SLO, en boucle fermée et sous supervision humaine.
- Quand l'utiliser
- Des systèmes externes doivent se rétablir de manière autonome après des modes de défaillance connus, tout en laissant les humains maîtres des actions que les agents peuvent entreprendre.
- Vigilance
- Des politiques trop permissives ou une vérification trop faible peuvent conduire les agents à masquer les symptômes au lieu de traiter les causes racines, ou à propager des défaillances en cascade.
Interrogez l'expert IA sur ce pattern
Ouvre l'assistant avec votre question préremplie. Vous la relisez avant l'envoi.
SRE agentique (exploitation auto-réparatrice): Vue d’ensemble
Une architecture d'exploitation en boucle fermée dans laquelle des agents maintiennent un système externe en bon état : détecter une anomalie, diagnostiquer la cause racine probable, exécuter une remédiation encadrée par des politiques, puis vérifier le rétablissement au regard des objectifs de fiabilité avant de refermer la boucle. Elle prend généralement la forme d'une équipe aux rôles spécialisés (détecteur, diagnostiqueur, remédiateur, vérificateur) opérant sous une gouvernance human-on-the-loop, où les ingénieurs définissent les politiques, les garde-fous et l'ensemble des actions autorisées tandis que les agents agissent dans ces limites et rendent compte. Des permissions à moindre privilège et une politique sous forme de code (policy-as-code) maintiennent les remédiations dans une enveloppe sûre, les actions les plus risquées étant soumises à une approbation humaine. À distinguer de `predictive-agent-fault-tolerance` : celui-ci maintient en vie le système d'agents lui-même, tandis qu'ici les agents effectuent un travail de fiabilité sur les systèmes externes qu'ils exploitent.
- Closed loop: detect, diagnose, remediate, verify
- Role-specialized team: detector, diagnoser, remediator, verifier
- Policy-bounded autonomy with a least-privilege set of allowed actions
- Human-on-the-loop: engineers set policy, agents execute and report
- Recovery verified against SLOs before an incident is closed
- Automatic rollback and generated incident reports for audit
The Agent Architect
Un pattern, un compromis, une panne de production racontée. Un brief hebdomadaire court pour ceux qui construisent des systèmes agentiques.
Un email par semaine, désinscription en un clic. Votre adresse ne sert qu'à envoyer le brief.
Références
Les articles, spécifications et dépôts sur lesquels repose ce modèle.
Par l’ingénieur derrière ce catalogue
Faites auditer l’architecture de vos agents
Cette page documente un pattern. Votre système en fait tourner des dizaines, et l’essentiel des pannes se loge dans la façon dont ils s’articulent. Faites relire toute la conception à l’aune des 288 patterns de ce catalogue : architecture, fiabilité, évaluation et coûts, chaque constat relié au pattern qui le corrige.
750 € au lieu de 1 500 €, une semaine, rapport écrit et appel de restitution, jusqu’au 30 septembre