Loading...
Constitutional AI(CAI)
Использование явного набора принципов для управления самокритикой, доработкой и генерируемой ИИ обратной связью о предпочтениях в процессе обучения
In 30 seconds
- What
- Модель учится критиковать и перерабатывать собственные ответы в соответствии с явными принципами, а затем ранжирует ответы с помощью согласованной с принципами обратной связи, без разметки человеком.
- When to use
- При обучении систем, когда есть чёткие принципы поведения, но ограниченные возможности для обратной связи от людей, и нужна интерпретируемая согласованность прямо в процессе обучения.
- Watch out
- Противоречивые или расплывчатые принципы дают несогласованные обучающие сигналы; модель может научиться обходить проверку принципов вместо того, чтобы усвоить сами ценности.
Loading technique guide…