Simon Willison выпустил две новые версии плагина llm-gemini для своей утилиты LLM: 0.32 и 0.32a0. Первая добавляет поддержку модели Gemini 3.5 Flash, вторая — экспериментальную возможность стриминга токенов рассуждений.
Что нового в llm-gemini 0.32
Версия 0.32 — стабильный релиз. Главное изменение — новая модель gemini-3.5-flash для Gemini 3.5 Flash. Это обновление уже доступно всем пользователям. Willison также опубликовал заметки о Gemini 3.5 Flash и показал пример использования — рисунок пеликана, созданный с помощью этого обновления.
Экспериментальная версия 0.32a0
Версия 0.32a0 — альфа-релиз, совместимый с llm>=0.32a0. Главная фича — возможность стримить токены рассуждений (reasoning tokens). Это позволяет в реальном времени наблюдать за процессом «размышлений» модели, что особенно полезно для отладки и понимания логики генерации.
Почему это важно
Оба обновления расширяют функциональность LLM — инструмента для работы с языковыми моделями из командной строки. Gemini 3.5 Flash — одна из последних моделей Google, оптимизированная для скорости и эффективности. Стриминг токенов рассуждений — востребованная функция для разработчиков, которые хотят видеть внутренние шаги модели.
Релизы вышли в один день, что говорит о быстрой итерации разработки. Пользователи могут выбрать стабильную версию с новой моделью или альфа-версию с экспериментальными возможностями.