Новости, обновления и кейсы в реальном времени
Anthropic временно ограничила доступ к моделям Fable 5 и Mythos 5 после директивы США из-за рисков безопасности.
OpenAI и Anthropic провели уникальное совместное испытание, тестируя модели друг друга на безопасность. Этот шаг демонстрирует важность кросс-лабораторного сотрудничества.
Anthropic представила Cowork, расширяющий возможности Claude Code для не-технических пользователей. Новый AI-агент работает с файлами без надобности в программировании.
Anthropic прекратила доступ к моделям Fable 5 и Mythos 5 после приказа правительства США из-за угрозы национальной безопасности.
Anthropic представила Claude Fable 5 — новую модель ИИ класса Mythos с уникальными механизмами безопасности для публичного использования.
Anthropic опубликовала исследование нового метода выравнивания: вместо списка запрещённых действий модели обучаются принципам этического рассуждения. Первые результаты — впечатляющие.
Anthropic передаёт разработанный инструмент оценки безопасности AI-моделей под управление независимого фонда. Это важный шаг к стандартизации AI safety в индустрии.
Исследователи Anthropic научились расшифровывать внутренние представления Claude и переводить их в понятные концепты. Это прорыв в интерпретируемости — и новый уровень понимания AI.