Архивы открытая модель - AI Founder

Z.ai анонсировала GLM-5.2

Z.ai открыла GLM-5.2 для всех пользователей GLM Coding Plan, включая Lite, Pro, Max и Team. Компания называет модель новым флагманом для программирования, длинного контекста и долгих задач. GLM-5.2 поддерживает контекст до 1 млн токенов и два уровня reasoning: High и Max. Для coding-задач Z.ai рекомендует Max — он должен давать более глубокое рассуждение и стабильнее … Читать далее

Google выпустила DiffusionGemma

Google представила DiffusionGemma — экспериментальную открытую text diffusion-модель для быстрой генерации текста. В отличие от обычных autoregressive LLM, которые пишут токены последовательно, модель генерирует блоки текста параллельно и затем итеративно уточняет результат. DiffusionGemma основана на семействе Gemma 4 и исследованиях Gemini Diffusion. Это 26B Mixture of Experts-модель, которая активирует 3,8B параметров при инференсе и может … Читать далее

Gemma 4 12B

Google DeepMind представила Gemma 4 12B — мультимодальную модель для локального запуска на ноутбуках. Она занимает промежуточное место между E4B и 26B MoE и впервые в линейке mid-size Gemma поддерживает native audio input. Главная особенность модели — unified architecture без отдельных multimodal encoders. Изображения и аудио передаются напрямую в LLM backbone: для vision используется легкий … Читать далее

Cosmos 3

NVIDIA представила Cosmos 3 — открытую foundation-модель для физичиского AI: робототехники, автономного транспорта и vision-агентов. Модель понимает и генерирует текст, изображения, видео, звук и действия, а также симулирует физические сценарии. Cosmos 3 построена на mixture-of-transformers-архитектуре: один transformer отвечает за reasoning, другой — за генерацию. Это помогает модели понимать движение, взаимодействие объектов и пространственно-временные связи перед … Читать далее

Nemotron 3 Ultra

NVIDIA представила Nemotron 3 Ultra — крупнейшую и самую сильную модель семейства Nemotron 3. Она содержит 550 млрд параметров, из которых активны 55 млрд. Модель построена на гибридной MoE-архитектуре Mamba-Attention, поддерживает контекст до 1 млн токенов и позволяет управлять reasoning-бюджетом во время inference. NVIDIA также добавила MTP-слои для ускорения через native speculative decoding. По данным … Читать далее