Muster werden geladen…
Agentisches SRE (selbstheilender Betrieb)(ASRE)
Eine Betriebsarchitektur mit geschlossenem Regelkreis, in der Agenten ein externes System gesund halten: eine Anomalie erkennen, die wahrscheinliche Grundursache diagnostizieren, eine richtliniengebundene Behebung ausführen und anschließend die Wiederherstellung anhand von Zuverlässigkeitszielen überprüfen, bevor der Regelkreis geschlossen wird. Üblicherweise wird es als rollenspezialisiertes Team (Detektor, Diagnostiker, Behebender, Prüfer) aufgebaut, das unter einer Human-on-the-Loop-Governance läuft, in der Ingenieure Richtlinien, Leitplanken und den Satz erlaubter Aktionen festlegen, während die Agenten innerhalb dieser Grenzen handeln und Bericht erstatten. Least-Privilege-Berechtigungen und Policy-as-Code halten Behebungen in einem sicheren Rahmen, wobei risikoreichere Aktionen an eine menschliche Freigabe gekoppelt sind. Zu unterscheiden von `predictive-agent-fault-tolerance`: Jenes hält das Agentensystem selbst am Leben, während hier Agenten Zuverlässigkeitsarbeit an den externen Systemen leisten, die sie betreiben.
In 30 Sekunden
- Was
- Agenten erkennen Anomalien, ermitteln Grundursachen, führen richtlinienbegrenzte Korrekturen aus und prüfen die Wiederherstellung anhand von SLOs, in einer geschlossenen Schleife unter menschlicher Aufsicht.
- Wann einsetzen
- Externe Systeme sollen sich bei bekannten Fehlerbildern autonom erholen, während Menschen die Kontrolle darüber behalten, welche Aktionen Agenten ausführen dürfen.
- Achtung
- Zu freizügige Richtlinien oder schwache Verifikation können dazu führen, dass Agenten Symptome kaschieren statt Grundursachen zu beheben oder Fehler kaskadieren lassen.
Fragen Sie den KI-Experten zu diesem Pattern
Öffnet den Assistenten mit vorbereiteter Frage. Sie prüfen sie vor dem Senden.
Agentisches SRE (selbstheilender Betrieb): Überblick
Eine Betriebsarchitektur mit geschlossenem Regelkreis, in der Agenten ein externes System gesund halten: eine Anomalie erkennen, die wahrscheinliche Grundursache diagnostizieren, eine richtliniengebundene Behebung ausführen und anschließend die Wiederherstellung anhand von Zuverlässigkeitszielen überprüfen, bevor der Regelkreis geschlossen wird. Üblicherweise wird es als rollenspezialisiertes Team (Detektor, Diagnostiker, Behebender, Prüfer) aufgebaut, das unter einer Human-on-the-Loop-Governance läuft, in der Ingenieure Richtlinien, Leitplanken und den Satz erlaubter Aktionen festlegen, während die Agenten innerhalb dieser Grenzen handeln und Bericht erstatten. Least-Privilege-Berechtigungen und Policy-as-Code halten Behebungen in einem sicheren Rahmen, wobei risikoreichere Aktionen an eine menschliche Freigabe gekoppelt sind. Zu unterscheiden von `predictive-agent-fault-tolerance`: Jenes hält das Agentensystem selbst am Leben, während hier Agenten Zuverlässigkeitsarbeit an den externen Systemen leisten, die sie betreiben.
- Closed loop: detect, diagnose, remediate, verify
- Role-specialized team: detector, diagnoser, remediator, verifier
- Policy-bounded autonomy with a least-privilege set of allowed actions
- Human-on-the-loop: engineers set policy, agents execute and report
- Recovery verified against SLOs before an incident is closed
- Automatic rollback and generated incident reports for audit
The Agent Architect
Ein Pattern, ein Tradeoff, eine Produktionspanne. Ein kurzes wöchentliches Briefing für alle, die agentische Systeme bauen.
Wöchentliche E-Mail, Abmeldung mit einem Klick. Ihre Adresse wird nur für das Briefing verwendet.
Quellen
Die Veröffentlichungen, Spezifikationen und Repositories, auf denen dieses Muster beruht.
Vom Ingenieur hinter diesem Katalog
Lassen Sie Ihre Agenten-Architektur prüfen
Diese Seite dokumentiert ein Pattern. Ihr System betreibt Dutzende, und die meisten Ausfälle entstehen im Zusammenspiel. Lassen Sie den gesamten Entwurf an den 288 Patterns dieses Katalogs messen: Architektur, Zuverlässigkeit, Evaluation und Kosten, jeder Befund verknüpft mit dem Pattern, das ihn behebt.
750 € statt 1.500 €, eine Woche, schriftlicher Bericht und Walkthrough-Call, bis 30. September