パターンを読み込んでいます…
テストタイムスケーリング(TTS)
候補生成、探索、検証、または改良のために、推論時の計算リソースを追加で割り当てる手法
30秒でわかる概要
- 概要
- 推論時に複数の解候補を生成し、検証器でランク付けまたは絞り込みを行ってから、最良の結果を返します。
- 使いどころ
- レイテンシよりも品質が重要な、影響の大きい出力で、より良い答えを得るために複数回の推論を許容できる場合に。
- 注意点
- 計算コストは候補数に比例して膨らみ、検証器が高価だったり狙いがずれていたりすると、検証の負荷が生成コストを上回ります。
このパターンについてAIエキスパートに質問
質問が入力済みの状態でアシスタントが開きます。送信前に内容を確認できます。
テストタイムスケーリング: 概要
候補生成、探索、検証、または改良のために、推論時の計算リソースを追加で割り当てる手法
- Inference-time compute budgets
- Best-of-N candidate sampling
- Search over reasoning paths
- Verifier-guided selection
- Iterative critique and refinement
- Adaptive stopping rules
The Agent Architect
1つのパターン、1つのトレードオフ、1つの本番障害事例。エージェントシステムを構築する人のための短い週刊ブリーフィング。
週1回のメール、ワンクリックで購読解除できます。アドレスはブリーフィングの送信のみに使用します。
参考文献
このパターンの根拠となる論文、仕様、リポジトリです。
このカタログを作ったエンジニアが担当
エージェント構成をレビューします
このページが扱うのは1つのパターンです。実際のシステムは数十を組み合わせて動き、障害の多くはその繋ぎ目で起きます。カタログの288パターンに照らして設計全体をレビューします。アーキテクチャ、信頼性、評価、コストまで、指摘ごとに対応するパターンを示します。
€750(通常€1,500)・1週間・文書レポートとウォークスルーコール・9月30日まで