パターンを読み込んでいます…
自己整合性(SC)
非ゼロの温度で複数の多様な思考連鎖の経路をサンプリングし、それらの最終回答を多数決または信頼度で重み付けした投票によって集約する。正しい答えは多くの異なる推論経路によって到達されやすい一方、個々の誤りはばらつくため、コンセンサスによる回答は単一の貪欲デコードよりもはるかに信頼性が高い。
30秒でわかる概要
- 概要
- 温度をゼロ以外に設定して複数の推論経路をサンプリングし、多数決または確信度の重み付けで最終的な答えを選びます。
- 使いどころ
- 正解を検証できる問題で、多様な推論経路が存在し、誤りがサンプル間に散らばる場合。
- 注意点
- 推論コストが N 倍必要になります。大半の経路が同じ誤った答えに収束すると、多数決は機能しません。
このパターンについてAIエキスパートに質問
質問が入力済みの状態でアシスタントが開きます。送信前に内容を確認できます。
自己整合性: 概要
非ゼロの温度で複数の多様な思考連鎖の経路をサンプリングし、それらの最終回答を多数決または信頼度で重み付けした投票によって集約する。正しい答えは多くの異なる推論経路によって到達されやすい一方、個々の誤りはばらつくため、コンセンサスによる回答は単一の貪欲デコードよりもはるかに信頼性が高い。
- Samples N independent reasoning paths at nonzero temperature
- Marginalizes over reasoning by voting on final answers only
- Majority or confidence-weighted aggregation of candidates
- Correct answers converge while sporadic errors are outvoted
- Foundation of best-of-N test-time compute scaling
- Universal Self-Consistency extends voting to free-form outputs
The Agent Architect
1つのパターン、1つのトレードオフ、1つの本番障害事例。エージェントシステムを構築する人のための短い週刊ブリーフィング。
週1回のメール、ワンクリックで購読解除できます。アドレスはブリーフィングの送信のみに使用します。
参考文献
このパターンの根拠となる論文、仕様、リポジトリです。
このカタログを作ったエンジニアが担当
エージェント構成をレビューします
このページが扱うのは1つのパターンです。実際のシステムは数十を組み合わせて動き、障害の多くはその繋ぎ目で起きます。カタログの288パターンに照らして設計全体をレビューします。アーキテクチャ、信頼性、評価、コストまで、指摘ごとに対応するパターンを示します。
€750(通常€1,500)・1週間・文書レポートとウォークスルーコール・9月30日まで