Google представила Gemini 3.1 Flash-Lite — самую быструю и самую доступную модель в линке Gemini 3 для задач с высокой нагрузкой. Она уже доступна в preview через Gemini API в Google AI Studio и Vertex AI.
Главное здесь — цена и скорость. Модель стоит $0,25 за 1 млн входных токенов и $1,50 за 1 млн выходных. По данным Artificial Analysis, она в 2,5 раза быстрее Gemini 2.5 Flash по времени до первого токена, а скорость генерации у неё выше на 45%.
По бенчмаркам модель тоже выглядит сильной: Elo 1432 в Arena.ai, 86,9% в GPQA Diamond и 76,8% в MMMU Pro. Google утверждает, что в ряде тестов она обходит не только модели своего класса, но и более крупные Gemini прошлых поколений.
Ещё одна важная особенность — настраиваемый уровень “thinking” в AI Studio и Vertex AI. Это позволяет выбирать баланс между скоростью, стоимостью и глубиной обработки задачи.
Модель рассчитана на массовые сценарии вроде перевода и модерации контента, но подходит и для более сложных задач — например, генерации интерфейсов, дашбордов и работы по точным инструкциям. Среди ранних пользователей Google называет Latitude, Cartwheel и Whering.