OpenAI представила модель o1 с улучшенными функциями и Realtime API для разработчиков.
Кратко:
●OpenAI o1 снижает задержки и поддерживает vision
●Новая интеграция WebRTC в Realtime API
●Метод Preference Fine-Tuning для гибкой настройки
●SDK для Go и Java упрощают интеграцию
OpenAI o1: Новое поколение моделей
OpenAI представила свою новую модель o1, ориентированную на сложное многошаговое рассуждение и поддержку vision. Этот шаг стал заменой предыдущей версии о1-preview и предлагает более эффективное использование reasoning-токенов, снижая задержки на 60%. Для оптимизации работы добавлен параметр reasoning_effort, который позволяет задавать время размышления модели перед ответом.
Текущий снапшот o1-2024-12-17
демонстрирует выдающиеся результаты в широком спектре задач, включая кодинг и визуальные задачи.
— пример успешного применения моделей такого класса.
Доступ к o1 открыт для разработчиков на уровне usage tier 5, и в будущем планируется постепенное расширение доступа.
Улучшения Realtime API
Среди ключевых обновлений — интеграция с WebRTC, что делает разработку речевых приложений более доступной за счёт нативной поддержки в браузерах и мобильных устройствах. Это решение обрабатывает кодирование аудио и шумоподавление, улучшая качество связи.
Цены на аудио токены также были снижены: входные токены для GPT-4o теперь стоят $40 за миллион, а выходные — $80 за миллион. Новые модели gpt-realtime-2.1 и gpt-realtime-2.1-mini снижают латентность на 25% и поддерживают улучшенное распознавание речи, что важно для нового уровня стриминга с FastRTC от Hugging Face и Cloudflare.
Preference Fine-Tuning: Гибкая настройка
OpenAI представила метод Preference Fine-Tuning (PFT), который позволяет моделям отдавать предпочтение более желательным ответам, основываясь на сравнении предпочтительных и неподходящих результатов. Это особенно полезно для субъективных задач, таких как стиль и тональность.
Пример успешного внедрения — проект Rogo AI, где точность анализа финансовых данных выросла с 75% до более 80%. PFT уже доступен для модели gpt-4o-2024-08-06, а для gpt-4o-mini-2024-07-18 появится в ближайшее время.
SDK для Go и Java: Больше возможностей для интеграции
Официальные SDK для Go и Java в бета-версии упрощают разработчикам интеграцию с API OpenAI, что расширяет возможности использования в бизнес-сценариях и ускоряет создание новых приложений.
Завершение поддержки Fine-Tuning
OpenAI объявила о планах завершения поддержки Fine-Tuning API к 6 января 2027 года. Это означает, что новые задачи будут приниматься лишь до этой даты. Инференс на уже дообученных моделях будет поддерживаться до устаревания базовой модели.
Частые вопросы
Что такое OpenAI o1?
OpenAI o1 — это новая модель, оптимизированная для сложных многошаговых рассуждений и поддержки vision.
Какие улучшения в Realtime API?
Интеграция с WebRTC, снижение цен на токены и новые возможности управления сессиями.
Как использовать Preference Fine-Tuning?
PFT позволяет моделям отдавать предпочтение более желательным ответам, улучшая работу с субъективными задачами.
Когда завершится поддержка Fine-Tuning?
Поддержка завершится 6 января 2027 года, после чего новые задачи приниматься не будут.