Loading...
Apprentissage basé sur la mémoire(MBL)
Améliore le comportement de l'agent en récupérant et en réutilisant des expériences stockées au moment de la décision, plutôt qu'en mettant à jour les poids du modèle. Les interactions passées, les résultats et les retours des utilisateurs sont indexés sous forme de souvenirs et rappelés par similarité pour orienter les nouvelles décisions, ce qui permet une personnalisation continue sans réentraînement.
In 30 seconds
- What
- Stocke les interactions passées avec leurs résultats et les retours reçus, puis retrouve des cas similaires au moment de décider, afin d'orienter les nouveaux choix sans réentraîner le modèle.
- When to use
- La personnalisation compte au fil d'interactions répétées et vous pouvez capter des signaux de retour fiables pour pondérer les expériences passées à réutiliser.
- Watch out
- La qualité du rappel chute nettement si les souvenirs ne portent pas d'étiquette de résultat claire ou si l'appariement par similarité fait remonter des cas passés hors sujet dans les décisions en cours.
Loading technique guide…