パターンを読み込んでいます…
自己批評(SC)
エージェントが体系的な分析を通じて自らの出力を評価し、的を絞った改善を生成する
30秒でわかる概要
- 概要
- エージェントが出力を生成し、その欠陥を体系的に洗い出したうえで、外部からのフィードバックなしに修正版を作ります。
- 使いどころ
- コードレビュー、文章の推敲、論理の検証のように、エージェントが自分のミスを確実に見つけられるタスク。
- 注意点
- エージェントは自身の偏りを強めたり、もともと自分が犯した誤りをそのまま見落としたりすることがあります。とくに時間的な制約があるときに起きがちです。
このパターンについてAIエキスパートに質問
質問が入力済みの状態でアシスタントが開きます。送信前に内容を確認できます。
自己批評: 概要
エージェントが体系的な分析を通じて自らの出力を評価し、的を絞った改善を生成する
- Systematic quality assessment
- Error identification and correction
- Iterative refinement cycles
- Confidence scoring
The Agent Architect
1つのパターン、1つのトレードオフ、1つの本番障害事例。エージェントシステムを構築する人のための短い週刊ブリーフィング。
週1回のメール、ワンクリックで購読解除できます。アドレスはブリーフィングの送信のみに使用します。
参考文献
このパターンの根拠となる論文、仕様、リポジトリです。
- Self-Refine: Iterative Refinement with Self-Feedback (Madaan et al., 2023)arXiv:2303.17651
- Constitutional AI: Harmlessness from AI Feedback (Bai et al., 2022)arXiv:2212.08073
- CRITIC: Large Language Models Can Self-Correct (Gou et al., 2024)arXiv:2305.11738
- Self-Consistency Improves Chain of Thought Reasoning (Wang et al., 2022)arXiv:2203.11171
- LangChain Self-Critique Chains Documentation
このカタログを作ったエンジニアが担当
エージェント構成をレビューします
このページが扱うのは1つのパターンです。実際のシステムは数十を組み合わせて動き、障害の多くはその繋ぎ目で起きます。カタログの288パターンに照らして設計全体をレビューします。アーキテクチャ、信頼性、評価、コストまで、指摘ごとに対応するパターンを示します。
€750(通常€1,500)・1週間・文書レポートとウォークスルーコール・9月30日まで