Google DeepMind представила Gemma 4 — новое поколение открытых моделей с упором на reasoning, агентные сценарии и высокую эффективность на единицу параметров. Линейка вышла под лицензией Apache 2.0.
В семейство вошли четыре версии: E2B, E4B, 26B MoE и 31B Dense. Старшие модели ориентированы на сложную логику, код и агентные workflow, а компактные — на запуск прямо на устройствах с низкой задержкой, включая смартфоны и edge-железо.
Gemma 4 поддерживает function calling, структурированный JSON, system instructions, длинный контекст до 256 тысяч токенов, а также работу с изображениями и видео. Модели E2B и E4B дополнительно умеют принимать аудио.
В Google заявляют, что 31B сейчас занимает третье место среди открытых моделей на Arena AI, а 26B — шестое. При этом компания делает акцент на том, что Gemma 4 может конкурировать с системами значительно большего размера при меньших требованиях к железу.
Модели уже доступны через Google AI Studio, Hugging Face, Kaggle и Ollama, а поддержка заявлена для широкого набора инструментов, включая vLLM, llama.cpp, MLX, NVIDIA NIM и Android AI Core.