OpenAI выпустила обновление для GPT-5.1, улучшив безопасность и адаптивность моделей.
Кратко:
●OpenAI представила обновление для GPT-5.1
●Усилены метрики безопасности, включая mental health
●Новые модели лучше реагируют на сложные запросы
●Снижена эмоциональная зависимость пользователей
12 ноября 2025 года OpenAI выпустила «Addendum to System Card» для моделей GPT‑5.1 Instant и GPT‑5.1 Thinking. Эти версии представляют собой следующую итерацию семейства моделей GPT‑5, с улучшениями в области безопасности и адаптивности.
Обновленные модели: GPT‑5.1 Instant и Thinking
GPT‑5.1 Instant разработан для более разговорчивого и адаптивного взаимодействия, тогда как GPT‑5.1 Thinking лучше регулирует время рассуждения в зависимости от сложности запроса. OpenAI
также предлагает GPT‑5.1 Auto, который автоматически направляет запросы к оптимальной версии модели.
Новые метрики безопасности
В новом дополнении к System Card добавлены две важные метрики безопасности:
Mental health — модели оцениваются на способность корректно реагировать на признаки одиночных бредовых идей, психоза или мании.
Emotional reliance — выявляется и корректируется склонность пользователей к нездоровой эмоциональной зависимости от ChatGPT.
Эти улучшения позволяют моделям более точно отвечать на сложные и чувствительные запросы пользователей.
Результаты тестирования
Тестирование на выборке из более чем 1 000 сложных разговоров показало, что новая модель GPT‑5 достигает 92 % соответствия желаемому поведению по метрике mental health, тогда как предыдущая версия — лишь 27 %. По метрике emotional reliance соответствие улучшилось до 97 % против 50 % у прежней версии.
В производственной среде доля нежелательных ответов по эмоциональной зависимости снизилась на 80 %. Анализ показывает, что около 0,15 % активных пользователей и 0,03 % сообщений демонстрируют потенциально повышенную эмоциональную привязанность к ChatGPT.
Динамические мультурунные оценки
Таблицы с динамическими мультурунными оценками показывают следующие результаты:
●Mental health: 0.818
●Emotional reliance: 0.976
●Self-harm: 0.842
Эти показатели подтверждают стабильность и улучшение уровней безопасности моделей в сравнении с последующими версиями, такими как GPT‑5.2–5.5.
Перспективы и выводы
Внедрение новых метрик безопасности в GPT‑5.1 Instant и GPT‑5.1 Thinking демонстрирует значительный прогресс в адаптации моделей к сложным запросам. Разработка OpenAI продолжает улучшать безопасность взаимодействия пользователей с ИИ, снижая риски эмоциональной зависимости и реагируя на психические расстройства.
Возможности этих моделей уже активно используются различными компаниями, такими как JetBrains и Scania, что подтверждает их эффективность и востребованность.
Частые вопросы
Что нового в GPT‑5.1 Instant и Thinking?
Новые модели улучшены в плане безопасности и адаптивности, включают новые метрики для оценки mental health и emotional reliance.
Каковы результаты тестирования новых метрик?
Новая модель GPT‑5 достигла 92 % соответствия по mental health и 97 % по emotional reliance.
Как это влияет на пользователей?
Снижена доля нежелательных ответов и уменьшена эмоциональная зависимость пользователей от ChatGPT.
Будут ли улучшения продолжаться?
OpenAI планирует дальнейшее улучшение моделей, что подтверждается последующими версиями, такими как GPT‑5.2–5.5.