Muster werden geladen…
Reflexion(RX)
Agenten lernen aus Erfahrung durch verbale Selbstreflexion und episodisches Gedächtnis
In 30 Sekunden
- Was
- Der Agent führt eine Aufgabe aus, reflektiert das Scheitern in natürlicher Sprache, speichert diese Reflexion und nutzt sie, um den nächsten Versuch ohne Neutraining zu verbessern.
- Wann einsetzen
- Aufgaben, bei denen der Agent gefahrlos scheitern, aus Fehlern lernen und erneut ansetzen kann und bei denen Fehlschläge verwertbare Hinweise enthalten, die der Agent benennen kann.
- Achtung
- Die Qualität der Reflexion hängt vollständig davon ab, ob der Agent die eigentlichen Ursachen erkennt; eine vage oder falsche Selbstanalyse verstärkt Fehler über die Versuche hinweg.
Fragen Sie den KI-Experten zu diesem Pattern
Öffnet den Assistenten mit vorbereiteter Frage. Sie prüfen sie vor dem Senden.
Reflexion: Überblick
Agenten lernen aus Erfahrung durch verbale Selbstreflexion und episodisches Gedächtnis
- Verbal reinforcement learning
- Episodic memory integration
- Learning from failures
- No fine-tuning required
The Agent Architect
Ein Pattern, ein Tradeoff, eine Produktionspanne. Ein kurzes wöchentliches Briefing für alle, die agentische Systeme bauen.
Wöchentliche E-Mail, Abmeldung mit einem Klick. Ihre Adresse wird nur für das Briefing verwendet.
Quellen
Die Veröffentlichungen, Spezifikationen und Repositories, auf denen dieses Muster beruht.
- Reflexion: Language Agents with Verbal Reinforcement Learning (Shinn et al., 2023)arXiv:2303.11366
- ReAct: Synergizing Reasoning and Acting in Language Models (Yao et al., 2023)arXiv:2210.03629
- Self-Refine: Iterative Refinement with Self-Feedback (Madaan et al., 2023)arXiv:2303.17651
- Teaching Large Language Models to Self-Debug (Chen et al., 2023)arXiv:2304.05128
- Reflexion reference implementation
Vom Ingenieur hinter diesem Katalog
Lassen Sie Ihre Agenten-Architektur prüfen
Diese Seite dokumentiert ein Pattern. Ihr System betreibt Dutzende, und die meisten Ausfälle entstehen im Zusammenspiel. Lassen Sie den gesamten Entwurf an den 288 Patterns dieses Katalogs messen: Architektur, Zuverlässigkeit, Evaluation und Kosten, jeder Befund verknüpft mit dem Pattern, das ihn behebt.
750 € statt 1.500 €, eine Woche, schriftlicher Bericht und Walkthrough-Call, bis 30. September