OpenAI и Cerebras: ускорение ChatGPT в реальном времени
Мария Соколова14 июля 2026 г.5 мин чтения
OpenAI и Cerebras заключили партнёрство на $20 млрд для внедрения 750 МВт вычислительных мощностей, что ускорит работу ChatGPT и других приложений.
Кратко:
●OpenAI заключила партнёрство с Cerebras на $20 млрд
●Внедрение 750 МВт мощностей до 2028 года
●Использование Wafer-Scale Engine для минимальной задержки
●Запущена модель Codex-Spark с инференсом 1000 токенов/с
Новое партнёрство: OpenAI и Cerebras
В январе 2026 года OpenAI и Cerebras объявили о стратегическом партнёрстве, направленном на значительное ускорение работы AI-моделей, включая ChatGPT. Это сотрудничество предполагает внедрение до 750 мегаватт вычислительных мощностей от Cerebras, что позволит сократить задержки при инференсе и сделать ChatGPT более быстрым для real-time задач.
Cerebras использует Wafer-Scale Engine (WSE-3), объединяющий огромный объём памяти и вычислительных ресурсов на одном чипе. Это позволяет хранить модель целиком в on-chip памяти, обеспечивая невероятную пропускную способность и минимальные задержки. Благодаря этому, пользователи смогут взаимодействовать с AI быстрее и эффективнее.
Финансовые аспекты сделки
Сделка оценивается более чем в $20 млрд и оформлена как многолетняя, с развёртыванием поэтапно до 2028 года. В отчёте за первый квартал 2026 года Cerebras сообщила о доходе в $193,4 млн, что на 92% больше по сравнению с предыдущим годом. Это свидетельствует о высоком уровне интереса к их технологиям.
Реальные результаты: запуск Codex-Spark
Одним из первых результатов сотрудничества стал запуск модели Codex-Spark, оптимизированной для обработки кода в реальном времени. Эта модель, работающая на инфраструктуре Cerebras, обеспечивает инференс на уровне 1000 токенов в секунду, что позволяет разработчикам программировать практически мгновенно.
Стратегические перспективы и расширение
Сотрудничество OpenAI и Cerebras не ограничивается только покупкой мощностей. Они также работают над совместной разработкой моделей для оптимальной работы на архитектуре Cerebras, что создаёт структурное преимущество для обеих компаний. Также были запущены другие инициативы, включая партнёрство с AWS и расширение инфраструктуры в Европе.
Цитаты лидеров индустрии
Andrew Feldman, CEO Cerebras, отметил, что их процессоры позволят принести ведущие AI-модели на самые быстрые AI-процессоры в мире. Sachin Katti из OpenAI добавил, что это партнёрство обеспечит более быстрые ответы и более естественное взаимодействие с AI.
Частые вопросы
Что такое Wafer-Scale Engine от Cerebras?
Это уникальные процессоры, объединяющие огромный объём памяти и вычислительных ресурсов на одном чипе, что обеспечивает минимальную задержку и высокую пропускную способность.
Какое влияние окажет партнёрство на пользователей ChatGPT?
Пользователи смогут получать ответы от AI практически мгновенно благодаря снижению задержек.
Какие ещё инициативы планируются в рамках этого партнёрства?
Кроме внедрения мощностей, планируется совместная разработка моделей и расширение инфраструктуры в Европе.