Loading...
基于记忆的学习(MBL)
通过在决策时检索并复用已存储的经验来改善智能体行为,而非更新模型权重。过往交互、结果和用户反馈被索引为记忆,并按相似度召回以塑造新的决策,从而无需重新训练即可实现持续的个性化。
In 30 seconds
- What
- 把过往交互连同结果与反馈一并存下来,在决策时检索相似案例,从而无需重训模型就能影响新的选择。
- When to use
- 在反复交互中个性化很重要,而且你能采集到可靠的反馈信号,用来衡量该复用哪些过往经验。
- Watch out
- 如果记忆缺少清晰的结果标签,或相似度匹配把无关的旧案例带进当前决策,召回质量就会急剧下滑。
Loading technique guide…