OpenAI разработала систему для оценки мониторируемости цепочки рассуждений в ИИ, что открывает новые возможности для контроля и повышения прозрачности моделей.
Кратко:
- ●OpenAI создала фреймворк для мониторинга цепочек рассуждений
- ●13 оценок, охватывающих 24 среды, показывают эффективность
- ●Мониторинг рассуждений лучше, чем наблюдение за итогами
- ●Новые подходы к контролю ИИ, включая follow-up вопросы
Новый фреймворк от OpenAI
OpenAI представила новый фреймворк и набор оценок для мониторинга цепочек рассуждений в своих моделях. В исследовании от 18 декабря 2025 года описаны 13 оценок, охватывающих 24 среды. Основная находка — мониторинг внутреннего мышления модели более эффективен, чем наблюдение за её действиями или итогами.
Структура и результаты исследования
Исследование включает три архетипа оценок: интервенции, процесс и свойства результата. Это позволяет более глубоко понять, как модели, такие как o3-mini, o3, o4-mini и GPT-5 Thinking, обрабатывают информацию. По мере увеличения глубины рассуждений повышается и мониторируемость, что создаёт так называемый «налог мониторируемости».