Gemini 3.5 Flash-Lite
10 +
О модели
Самый быстрый и дешёвый текущий уровень Flash от Google (около 350 токенов/с), доступный с июля 2026 года для высоконагруженных текстовых задач с низкой задержкой.
Доступные настройки: Температура, Длина контекста, Длина ответа.
Настройки
Длина ответа- Максимальное количество токенов в ответе.
Температура- Температура модели. Чем выше значение, тем более творческий и чем ниже значение, тем более фокусированный.
Контроль разнообразия- Top_p. Фильтрует ответы AI на основе вероятности.
Меньшие значения = несколько наиболее вероятных ответов,
Большие значения = больший набор вариантов.
Меньшие значения = несколько наиболее вероятных ответов,
Большие значения = больший набор вариантов.
Длина контекста- Максимальное количество токенов для использования в качестве входных данных для модели.