パターンを読み込んでいます…
プロデューサー・クリティック・パターン(PC)
別個のプロデューサー・エージェントとクリティック・エージェントが品質向上のために協働する、アーキテクチャ上のパターン
30秒でわかる概要
- 概要
- 一方のエージェントが出力を生成し、別のエージェントがそれを評価して構造化されたフィードバックを返す。これを品質基準を満たすまで繰り返す。
- 使いどころ
- 反復的な改善が必要で、独立した評価によって生成側が自らの誤りを強化するのを防ぎたい作業。
- 注意点
- フィードバックが曖昧だったり矛盾していたり、生成側に明確な改善の道筋がなかったりすると、批評側と生成側が不毛なループに陥る。
このパターンについてAIエキスパートに質問
質問が入力済みの状態でアシスタントが開きます。送信前に内容を確認できます。
プロデューサー・クリティック・パターン: 概要
別個のプロデューサー・エージェントとクリティック・エージェントが品質向上のために協働する、アーキテクチャ上のパターン
- Separation of concerns
- Unbiased evaluation
- Flexible critic implementation
- Structured feedback loops
The Agent Architect
1つのパターン、1つのトレードオフ、1つの本番障害事例。エージェントシステムを構築する人のための短い週刊ブリーフィング。
週1回のメール、ワンクリックで購読解除できます。アドレスはブリーフィングの送信のみに使用します。
参考文献
このパターンの根拠となる論文、仕様、リポジトリです。
- Self-Refine: Iterative Refinement with Self-Feedback (Madaan et al., 2023)arXiv:2303.17651
- Constitutional AI: Harmlessness from AI Feedback (Bai et al., 2022)arXiv:2212.08073
- Reflexion: Language Agents with Verbal Reinforcement Learning (Shinn et al., 2023)arXiv:2303.11366
- Training Language Models to Self-Correct via RL (Kumar et al., 2024)arXiv:2409.12917
- LangChain Multi-Agent Workflows Documentation
このカタログを作ったエンジニアが担当
エージェント構成をレビューします
このページが扱うのは1つのパターンです。実際のシステムは数十を組み合わせて動き、障害の多くはその繋ぎ目で起きます。カタログの288パターンに照らして設計全体をレビューします。アーキテクチャ、信頼性、評価、コストまで、指摘ごとに対応するパターンを示します。
€750(通常€1,500)・1週間・文書レポートとウォークスルーコール・9月30日まで