Loading...
記憶ベース学習(MBL)
モデルの重みを更新するのではなく、意思決定の時点で蓄積された経験を検索して再利用することで、エージェントの振る舞いを改善する。過去のやり取り、結果、ユーザーフィードバックは記憶としてインデックス化され、類似度によって呼び出されて新たな意思決定を形づくり、再訓練なしに継続的なパーソナライズを可能にする。
In 30 seconds
- What
- 過去のやり取りを結果やフィードバックとともに蓄積し、判断が必要な場面で類似ケースを呼び出すことで、モデルを再学習させずに新たな選択を方向づけます。
- When to use
- 繰り返しのやり取りを通じたパーソナライズが重要で、どの過去経験を再利用するか重み付けできる信頼性の高いフィードバック信号を取得できる場合。
- Watch out
- 記憶に明確な結果ラベルが付いていない場合や、類似度マッチングが無関係な過去事例を現在の判断に引き込んでしまう場合、想起の質は急激に落ちます。
Loading technique guide…