パターンを読み込んでいます…
Reflexion(RX)
エージェントが言語的な自己省察とエピソード記憶を通じて経験から学習する
30秒でわかる概要
- 概要
- エージェントがタスクを実行し、失敗を自然言語で振り返り、その振り返りを保存して、再学習なしに次の試行を改善するために使う。
- 使いどころ
- エージェントが安全に失敗し、誤りから学び、やり直せるタスク。失敗の中に、エージェントが言葉にできる実行可能な手がかりが含まれている場合。
- 注意点
- 振り返りの質は、エージェントが根本原因を診断できるかにすべてかかっている。曖昧または誤った自己分析は、試行を重ねるほど誤りを積み上げる。
このパターンについてAIエキスパートに質問
質問が入力済みの状態でアシスタントが開きます。送信前に内容を確認できます。
Reflexion: 概要
エージェントが言語的な自己省察とエピソード記憶を通じて経験から学習する
- Verbal reinforcement learning
- Episodic memory integration
- Learning from failures
- No fine-tuning required
The Agent Architect
1つのパターン、1つのトレードオフ、1つの本番障害事例。エージェントシステムを構築する人のための短い週刊ブリーフィング。
週1回のメール、ワンクリックで購読解除できます。アドレスはブリーフィングの送信のみに使用します。
参考文献
このパターンの根拠となる論文、仕様、リポジトリです。
- Reflexion: Language Agents with Verbal Reinforcement Learning (Shinn et al., 2023)arXiv:2303.11366
- ReAct: Synergizing Reasoning and Acting in Language Models (Yao et al., 2023)arXiv:2210.03629
- Self-Refine: Iterative Refinement with Self-Feedback (Madaan et al., 2023)arXiv:2303.17651
- Teaching Large Language Models to Self-Debug (Chen et al., 2023)arXiv:2304.05128
- Reflexion reference implementation
このカタログを作ったエンジニアが担当
エージェント構成をレビューします
このページが扱うのは1つのパターンです。実際のシステムは数十を組み合わせて動き、障害の多くはその繋ぎ目で起きます。カタログの288パターンに照らして設計全体をレビューします。アーキテクチャ、信頼性、評価、コストまで、指摘ごとに対応するパターンを示します。
€750(通常€1,500)・1週間・文書レポートとウォークスルーコール・9月30日まで