Длина контекста — это максимальное количество токенов, которое языковая модель может обработать за один запрос. Этот параметр задаёт предел объёма текста, который модель учитывает при генерации ответа или выполнении задачи. Важно: длина контекста не равна объёму всей обучающей информации, а ограничивает только текущий рабочий отрывок.
Пример
Gemini 1.5 может принимать до 1 миллиона токенов за один запрос, что позволяет анализировать крупные документы или несколько глав книги без потери информации.