DeepSeek представила модели V4, способные эффективно обрабатывать до миллиона токенов, что открывает новые горизонты для ИИ-агентов.
Кратко:
- ●DeepSeek выпустила V4 с контекстом до 1 млн токенов.
- ●Модели V4-Pro и V4-Flash используют MoE для снижения затрат.
- ●Поддерживается три режима рассуждения для различных задач.
- ●Модели доступны с открытыми весами под MIT-лицензией.
Новые горизонты для ИИ с DeepSeek-V4
24 апреля 2026 года компания DeepSeek представила новые модели V4, которые могут эффективно работать с контекстом до миллиона токенов. Это открывает новые перспективы для сложных задач, требующих обработки больших текстов, таких как многопроходные взаимодействия и длинные сессии.
Архитектурные инновации
DeepSeek-V4 использует Mixture-of-Experts (MoE), что позволяет активировать лишь часть параметров, снижая вычислительные затраты. Новая архитектура включает Compressed Sparse Attention (CSA) и Heavily Compressed Attention (HCA), что сокращает размер KV-кэша на 90% по сравнению с предыдущей версией V3.2.