Constitutional AI — это метод обучения искусственного интеллекта, разработанный компанией Anthropic. Модель сама оценивает свои ответы по заранее заданным принципам или 'конституции' и постепенно улучшает их с учётом этих критериев. Такой подход позволяет уменьшить влияние субъективных оценок человека в процессе обучения. В отличие от RLHF, здесь модель ориентируется на формализованный набор правил, а не только на обратную связь от людей.
Пример
Для обучения Claude компания Anthropic применяет Constitutional AI: модель анализирует свои ответы по списку этических принципов и корректирует поведение без прямого вмешательства человека.