Архивы vLLM - AI Founder

Qwen3.8-Flash-Next

Qwen выпустила Qwen3.8-Flash-Next — экспериментальную модель с открытыми весами, архитектура которой станет основой Qwen4. Модель содержит 125 млрд параметров, но при работе активирует 6 млрд. Еще 51 млрд параметров приходятся на n-граммные представления. Главные изменения — разреженное внимание Qwen Sparse Attention, управляемые остаточные связи и n-граммные представления, рассчитанные на снижение затрат при длинном контексте. Базовая … Читать далее

DeepSeek выпустила финальную V4 Pro

DeepSeek официально представила DeepSeek-V4-Pro-0813 — финальную версию V4 Pro, которая пришла на смену предварительному релизу. Компания заметно улучшила модель в задачах для AI-агентов, программировании и работе с инструментами. В большинстве опубликованных тестов новая версия уверенно обходит V4-Pro Preview. Например, в Terminal Bench 2.1 она набрала 87,9 балла против 72,1 у предварительной версии, а в AutomationBench … Читать далее

DeepSeek-V4-Flash

DeepSeek представила финальную версию DeepSeek-V4-Flash-0731, которая пришла на смену предварительному релизу. Главное изменение — модель стала лучше справляться с задачами, где нужно самостоятельно планировать действия, работать с инструментами и выполнять несколько шагов подряд. По тестам DeepSeek-V4-Flash-0731 обходит DeepSeek-V4-Pro (Preview), хотя использует меньше активных параметров. Например, в Terminal Bench 2.1 модель набрала 82,7 балла, а в … Читать далее